惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

量子位
Google DeepMind News
Google DeepMind News
爱范儿
爱范儿
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
NISL@THU
NISL@THU
T
Threat Research - Cisco Blogs
freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More
L
Lohrmann on Cybersecurity
V
Visual Studio Blog
Cyberwarzone
Cyberwarzone
D
Docker
The Hacker News
The Hacker News
C
CERT Recently Published Vulnerability Notes
Vercel News
Vercel News
Project Zero
Project Zero
S
Schneier on Security
aimingoo的专栏
aimingoo的专栏
I
Intezer
腾讯CDC
M
MIT News - Artificial intelligence
Hugging Face - Blog
Hugging Face - Blog
P
Palo Alto Networks Blog
C
CXSECURITY Database RSS Feed - CXSecurity.com
AWS News Blog
AWS News Blog
GbyAI
GbyAI
MongoDB | Blog
MongoDB | Blog
Cyber Security Advisories - MS-ISAC
Cyber Security Advisories - MS-ISAC
V
Vulnerabilities – Threatpost
G
Google Developers Blog
N
Netflix TechBlog - Medium
The Cloudflare Blog
Microsoft Security Blog
Microsoft Security Blog
Y
Y Combinator Blog
A
Arctic Wolf
S
Securelist
酷 壳 – CoolShell
酷 壳 – CoolShell
Cisco Talos Blog
Cisco Talos Blog
Recent Announcements
Recent Announcements
C
Cyber Attacks, Cyber Crime and Cyber Security
L
LINUX DO - 热门话题
T
Threatpost
Latest news
Latest news
Blog — PlanetScale
Blog — PlanetScale
Security Latest
Security Latest
Engineering at Meta
Engineering at Meta
大猫的无限游戏
大猫的无限游戏
H
Help Net Security
The GitHub Blog
The GitHub Blog
T
Tor Project blog
P
Proofpoint News Feed

人人都是产品经理

为什么你的产品找不到差异化?90%的失败都卡在第一步上(下) – 人人都是产品经理, 3年从30万到1300万用户、获2200万美元融资,这个AI教育产品用“抽卡”破解了获客难题 – 人人都是产品经理, 园区招商系统怎么做才能真正帮到去化?我加了这一个功能,推广链接转发400次阅读过万 – 人人都是产品经理, AI大事件:OpenAI发完网络安全模型又搞药物研发,小鹏汽车要抓”DeepSeek时刻” – 人人都是产品经理, 电商不是卖货,是一场更残酷的产品经理实战 – 人人都是产品经理, 没想到,活动营销又回来了! – 人人都是产品经理, 为何All-in海外KOC:一场关于AI时代窗口期的豪赌 – 人人都是产品经理, 重新理解企业的内部协作 – 人人都是产品经理, 苹果的 AI 战略到底是什么? – 人人都是产品经理, 医疗智能体·第2讲——合规护城河:等保、PIPL与HIPAA的架构实战 – 人人都是产品经理, 向量知识库五步法:从“答非所问”到“精准回复” – 人人都是产品经理, 鸿蒙PC三方库构建总指挥HPKBUILD(sha)库为例 – 人人都是产品经理, 何时该用LLM?AI产品经理的LLM设计指南 – 人人都是产品经理, 医疗信息领域的需求方、决策方、准入方以及关注点(二) – 人人都是产品经理, 即梦涨价:一场被误读的「傲慢」 – 人人都是产品经理, 面试AI PM必答题:Hermes和OpenClaw的区别,如何讲清楚业务价值 – 人人都是产品经理, AI的下一张船票:世界模型——AI产品经理必须理解的技术拐点 – 人人都是产品经理, 小红书做GEO,怎么让AI信你?记住这 3 个重要信息 – 人人都是产品经理, 5 家印度 AI 初创公司,看看印度 AI 再做什么 – 人人都是产品经理, AI项目跨团队协作:产品技术业务如何不打架 – 人人都是产品经理, Agentic Workflow(智能体工作流):让AI从”答案生成器”变成”数字员工” – 人人都是产品经理, lycium_plusplus 项目全景解读:OpenHarmony 三方库构建的“大管家” – 人人都是产品经理, 从爆单救火到前置履约:两套预采策略,把生鲜大促履约效率拉满 – 人人都是产品经理, 什么时候该补货?我用一轮数据做了一个决定 – 人人都是产品经理, 从“机械兜底”到“动态分流”:AI客服重复进线治理的4大底层逻辑 – 人人都是产品经理, 抖音拼效率,红书拼洞察 – 人人都是产品经理, 全民狂欢与退潮——为什么龙虾这波热潮冷却得如此之快? – 人人都是产品经理, Stripe押注!MPP重塑全球支付 – 人人都是产品经理, 小红书GEO:AI引用你的内容,不是因为你对,而是因为你看起来可信 – 人人都是产品经理, 前百度副总裁押注办公Agent,日韩付费爆发,Manus迎来强劲对手 – 人人都是产品经理, 企事业单位数字化的业务供需本质 – 人人都是产品经理, 医疗智能体·第1讲——医疗信息化重构:从“辅助软件”到“自主智能体”的范式转移 – 人人都是产品经理, 粉丝量就是空气!!! – 人人都是产品经理, 用户说“薯片碎了”,机器回“要买吗?”:意图识别的翻车与破局 – 人人都是产品经理, RAG召回准确率从75到90 我做对了这三件事 – 人人都是产品经理, AI大事件:Anthropic改收费、OpenAI发安全版、手术机器人纳入医保、阿里发布”秒悟” – 人人都是产品经理, Chrome 推出 Skills 新功能,Agent 重塑上网方式 – 人人都是产品经理, GitHub前创始人拿了a16z的1700万美元,做Agent时代的Git – 人人都是产品经理 拷贝或克隆其他 Flutter OH 项目到本地后无法运行 – 人人都是产品经理, 优惠券设计:优惠券创建 – 人人都是产品经理, 不用死磕文档!AI 助手 1 小时搞定飞书 CLI 安装 + 配置 + 知识库 – 人人都是产品经理, 用小龙虾做竞品分析报告:从2天到20分钟,我是怎么做到的 – 人人都是产品经理 用小龙虾做市场分析报告:搞懂这3个公式,市场规模不再靠猜 – 人人都是产品经理, 你早就在做 Harness 工程,只是不知道它叫这个名字 – 人人都是产品经理, Think Long就够?你可能想多了! – 人人都是产品经理, 货代SRM实战:供应商准入怎么做,才能让资源池不是通讯录而是可交付网络? – 人人都是产品经理, 如何做好用户调研?详解基本技巧 – 人人都是产品经理, 木鸟、途家、美团对打,平台春天行动开“卷” – 人人都是产品经理, 入职才发现公司不靠谱?小红书从业者求职避坑指南 – 人人都是产品经理, 美国 AI 三巨头联手封堵,中国 AI 突围之路在何方 – 人人都是产品经理, 小红书,放在需求对面的镜子 – 人人都是产品经理, AI 会带来大规模失业吗? – 人人都是产品经理, 从出单到补货前,我第一次犹豫:该不该放大? – 人人都是产品经理, Flutter 三方库鸿蒙化适配:5 种高效检查方式,快速判断是否需要适配 – 人人都是产品经理, 从做产品进阶拿结果:医美机构产品经理转岗科室运营经理 – 人人都是产品经理, 阿里HappyHorse,一场关于“Token经济”的阳谋 – 人人都是产品经理, To B AI:客户留存落地的观察与思考 – 人人都是产品经理, AI产品的“生命线”——数据采集、标注、清洗的产品化设计 – 人人都是产品经理, 谈谈AI Agent(二):当“孩子”能自己“体验世界”时,你该学什么? – 人人都是产品经理, UI/UX设计师的3层能力进阶,前两层让你活下来,第三层…才是真正的分水岭 – 人人都是产品经理, 2分钟 → 30秒,效率提升75%:B端产品经理如何用「规则枷锁」驯服AI幻觉? – 人人都是产品经理, 还没来得及学OpenClaw,来了个更猛的:Hermes Agent – 人人都是产品经理, AI日报:宇树机器人跑出10m/s刷新世界纪录 – 人人都是产品经理, 一文说透基金互金如何用情绪价值引导用户决策做转化 – 人人都是产品经理, 当浏览器开始替你”看”网页:AI 浏览器正在亲手拆掉它脚下的那张网 – 人人都是产品经理, 0代码,一天时间我Vibe Coding了个网站 – 人人都是产品经理, Hermes 和 OpenClaw 之争,Agent 的能力应该“装上去”还是“长出来”? – 人人都是产品经理 视频生成的“桌子”,字节Seedance 2掀完,阿里快乐马掀 – 人人都是产品经理, 从听不懂到完全信任:我的 Codex 深度产品体验 – 人人都是产品经理, 当虚拟偶像有了北京户口,与真人偶像还有什么区别? – 人人都是产品经理, 会说,远远比会做更重要 —— 对 SBTI 爆火现象的五层观察 – 人人都是产品经理, AI产品经理必看:当“搭环境”比“选模型”更重要,你的认知还在2024年吗? – 人人都是产品经理, 2026年AI产品商业化核心逻辑:从功能demo到规模化营收的3个必破卡点 – 人人都是产品经理, 京东围绕供应链,卷起裤腿下场的那些事儿 – 人人都是产品经理, SBTI一夜刷屏:它赢在了“太会说人话” – 人人都是产品经理, 折扣零售的真相:不是便宜,而是价值感! – 人人都是产品经理, 和甲方吵了一架,最后加钱做了——我学到的ToB产品经理生存法则 – 人人都是产品经理, 和几位小红书操盘手聊了8小时,干货全在这 – 人人都是产品经理, 智谱GLM-5.1登场,开源模型首超Opus4.6!!! – 人人都是产品经理 Anthropic收入凭什么反超OpenAI,终于有人把这事说清楚了 – 人人都是产品经理, 史上最有故事感的技术报告——Claude最强模型Mythos 7个极其精彩的细节 – 人人都是产品经理, 模型不是壁垒,Harness 也不是 – 人人都是产品经理, 抖音本地生活业务思考21 – 人人都是产品经理, Superpowers:145k Star的AI编码框架,到底是什么来头? Superpowers:145k Star的AI编码框架,到底是什么来头? – 人人都是产品经理, OpenAI 的路走错了,Anthropic Harness 解法启示:模型需要实践专科生 – 人人都是产品经理, 画原型图的前一步:设计站点地图 – 人人都是产品经理, 给 DeepSeek 的最后一封催更信 – 人人都是产品经理, 手把手教你用 Claude Code 搭建 AI 营销团队:5 个 Agent、12 项技能,独立完成研究、写作、设计全流程 – 人人都是产品经理, 你以为大模型在学语言?不,它在重新发明语言学 – 人人都是产品经理 所谓Skill,不过是AI时代的工业垃圾 – 人人都是产品经理, 聊一聊内容传播的几个方法 – 人人都是产品经理, 当平台开始吃掉生态:从 OpenClaw 被封杀,读懂 Anthropic 的这盘棋 – 人人都是产品经理, 你装了 10 个 AI 插件,Obsidian 还是一个文件夹 – 人人都是产品经理 关于AI智能体架构演进的系统性思考:从单体试水到多体协同的重构 – 人人都是产品经理, 当“人”变成Skill,我们又该何去何从? – 人人都是产品经理 Mythos 事件:前沿 AI 治理的意外实验 – 人人都是产品经理, 货代CRM:信用与风险管理怎么做,才能把坏账风险拦在放货之前? – 人人都是产品经理, 从HR收集自拍照到员工自助录入——我见证了园区人脸识别从”不可用”到”真好用”的全过程 – 人人都是产品经理 千问闯关AI混沌期:阿里画靶,吴嘉张弓,马云射箭? – 人人都是产品经理,
DeepSeek告别“孤胆英雄”时代 – 人人都是产品经理,
吴怼怼 · 2026-04-24 · via 人人都是产品经理

DeepSeek V4的发布不仅标志着其在Agent能力和推理技术上的重大突破,更揭示了这家中国AI独角兽从研究团队向基础设施级玩家的战略转变。面对训练成本飙升、人才争夺战和生态布局需求,DeepSeek正在与腾讯、阿里展开18亿美元融资谈判,这场关乎中国大模型未来格局的资本博弈背后,隐藏着技术路线与商业逻辑的深层抉择。

DeepSeek V4发布是确定的,而融资仍属于媒体报道和交易传闻阶段。

DeepSeek官网已经显示“DeepSeek-V4 Preview”上线,并称其具备更强Agent能力和顶级推理能力,已可在网页、App和API使用。

DeepSeek在4月24日开始预览V4,包含Pro和Flash两个版本,将接替2024年12月发布的V3。

融资这边,截至目前公开口径仍是“洽谈中”。腾讯、阿里正在洽谈投资DeepSeek,估值超过200亿美元;并强调DeepSeek、腾讯、阿里均未立即回应。

《财经》进一步报道称,DeepSeek正在洽谈融资,投资方为腾讯和阿里,两家预计合计投资18亿美元,估值约200亿美元,但交易方案尚未完全敲定。

01 V4发布意味着什么?

DeepSeek上一次真正改写行业叙事,是V3到R1那一轮。那时它同时打穿了几件事:低成本、高性能、开源权重、推理模型。

R1之后,DeepSeek面对的真正考验,是能不能继续交出下一代东西。

很多技术公司的高光时刻只有一次。一次爆款模型、一次舆论破圈、一次资本市场震动,都可能把一家公司推到聚光灯下。但真正难的,是聚光灯退去以后,还能不能继续迭代。

V4至少说明,DeepSeek没有停在R1时刻。它靠低成本奇袭打出过声量,也还在继续迭代旗舰模型。

而且这次V4的重点,已经从“便宜”继续往前走了一步。

根据DeepSeek官方Hugging Face页面,V4系列包括两个MoE模型:V4-Pro为1.6T总参数、49B激活参数;V4-Flash为284B总参数、13B激活参数;二者都支持100万token上下文。

这说明DeepSeek正在把竞争重点,从单纯的性价比,推向更复杂的任务场景。

这些能力都指向同一个方向:更复杂的任务执行。长上下文让模型能处理更长资料和连续任务,Thinking Mode对应复杂推理,Tool Calls和JSON输出则更适合接入外部系统、被应用层稳定调用。这也是为什么V4会被放进Agent语境里讨论。

更进一步看,V4真正重要的地方,还在于DeepSeek仍然围绕“效率”做文章。DeepSeek既想让模型读得更长,也想让模型更便宜地读得更长。

大模型下一阶段的竞争,不会只发生在排行榜上。排行榜回答的是“谁更强”,但真实商业世界还要继续追问:谁能把这种能力稳定、低成本、大规模地交付出去?

一个模型能读100万token是一回事,大量用户、开发者、企业客户能不能以可承受的价格调用,又是另一回事。

如果长上下文只停留在演示阶段,它更像技术秀肌肉;如果长上下文可以被压低成本,进入API、企业应用、Agent工作流,它才会变成基础设施能力。

所以V4延续了DeepSeek最核心的路线:不单纯堆参数,继续压榨系统效率。

V4-Pro更像能力上限版本,用来承担复杂推理、长上下文和更高难度任务;V4-Flash则更像规模化调用版本,用来覆盖速度、成本和高频场景。

这说明DeepSeek已经考虑不同用户、不同场景、不同成本结构下的服务形态。

Web、App、API同时推进;Pro和Flash同时出现;长上下文、推理、工具调用一起被强调。DeepSeek准备走向一个需要承接真实应用、真实调用和真实商业化压力的玩家。

02 为什么DeepSeek要融资?

更准确地说,是旧的资金结构已经不适配新的竞争阶段。

过去DeepSeek的特殊性在于,它背后有幻方量化/High-Flyer的资金、算力和工程积累,所以它可以长时间保持一种“非VC叙事”:不急着融资,不急着商业化,不急着讲增长故事。

有说法称,DeepSeek过去曾拒绝过中国顶级VC和科技巨头的多次融资提议。

但到了V4阶段,情况变了。

训练和推理成本都在上升。

V3时代,DeepSeek最震撼市场的是用极低训练成本做出强模型。V3技术报告称,DeepSeek-V3是671B总参数、37B激活参数的MoE模型,预训练数据为14.8T tokens,完整训练只用了2.788M H800 GPU hours。

但V4已经变成1.6T总参数、32T以上预训练tokens、百万上下文、Agent能力。

这个量级继续往前走,哪怕DeepSeek再擅长工程优化,也不可能完全摆脱资本开支。推理侧更是长期成本黑洞:用户越多,调用越多,API越便宜,亏损压力越明显。

还有一个不能忽略的变量,是国产算力适配。

V4发布前后,围绕DeepSeek与华为昇腾的消息明显增多。基于Ascend 950 AI芯片的昇腾Supernode将全面支持DeepSeek V4。

更深一层看,它关系到中国大模型下一阶段的安全垫:模型公司要继续迭代,就必须考虑国产算力、云服务和软件栈的适配问题。

另外,人才竞争变成硬成本。

《财经》报道里提到,DeepSeek开放融资的原因之一是防止人才流失。2025年之后,中国AI人才市场已经进入“核心研究员天价争夺”阶段。DeepSeek此前最强的是“小团队、高密度、研究导向”,但一旦行业巨头开始用现金、期权、算力、数据、产品落地机会来抢人,很难长期防守。

DeepSeek要保住模型迭代速度,就必须把人才激励从“项目荣誉+研究自由”升级到“长期利益绑定”。

DeepSeek也需要生态入口,而不只是模型能力。

R1让DeepSeek出圈,但真正的问题是:出圈之后,流量、算力、API、开发者、企业客户、Agent应用、办公场景、云市场入口,谁来承接?

OpenAI背后有几乎所有大厂参与其中。Anthropic背后有亚马逊、谷歌。Gemini自身就是上市大厂谷歌旗下。xAI有马斯克系流量和资本。

国内大厂有自己的云、有App、有办公软件、有搜索、有支付、有内容生态、有企业客户。DeepSeek如果继续完全独立,它可以是最强开源模型之一,但很难独自完成从模型到产业基础设施的最后一公里。

DeepSeek需要把“模型优势”换成“生态优势”。

03 为什么是腾讯和阿里?

我在2025年2月分析过:如果DeepSeek必须拿大厂的钱,腾讯和阿里确实是最合理的两家。现在看,这个逻辑更强了。DeepSeek最终会拿谁的钱?

腾讯最适合做“低干预、高分发、高场景”的战略股东。

腾讯对DeepSeek的价值,在于三件事:入口、场景、组织耐心。

腾讯有微信、QQ、腾讯会议、企业微信、腾讯文档、腾讯云、游戏、内容和小程序生态。DeepSeek如果要做Agent,最难的不是模型本身,而是Agent能不能进入真实用户工作流。腾讯的场景是天然的Agent试验田。

更重要的是,腾讯投资的历史口碑确实相对特殊。它不是没有战略诉求,但相比很多大厂,腾讯更习惯做“生态型投资”而不是“吞并型投资”。美团、京东、拼多多这些案例都说明,腾讯过去能接受被投企业保持相当独立性。

对DeepSeek这种极度重视研究文化和控制权的公司来说,这一点非常重要。

DeepSeek不需要和腾讯成为竞争对手。腾讯自己当然也做混元,但腾讯真正的强项是把最好的模型能力接入自己的应用和云生态。

如果DeepSeek拿腾讯的钱,是给自己找一个超级分发股东。

阿里最适合做“云+开源+开发者生态”的战略股东。

阿里对DeepSeek的价值则更偏基础设施。

阿里云是中国最重要的云计算平台之一,通义千问/Qwen又是国内开源模型生态最强的玩家之一。阿里此前在AI赛道是“买赛道”式布局:月之暗面、MiniMax、智谱、百川、零一万物等都曾进入阿里的投资版图。

对阿里来说,DeepSeek如果持续强大,会带来几个价值:

  • 增强阿里云在模型市场的吸引力;
  • 补足阿里在最顶级推理模型上的外部生态;
  • 和Qwen形成“自研+外部最强开源系”的双支点;
  • 避免DeepSeek完全倒向腾讯或其他大厂。

DeepSeek R1发布时有一系列distill模型使用了Qwen和Llama作为底座,例如DeepSeek-R1-Distill-Qwen系列;这说明Qwen在国内开源生态里已经是重要基座。

DeepSeek的蒸馏模型体系曾使用Qwen作为重要底座之一,这让阿里与DeepSeek之间天然存在开源生态交集。

为什么不是字节?

字节当然也有钱、有流量、有模型、有产品。但正因为它都有,反而不一定是DeepSeek最舒服的股东。

字节已经重注豆包,且豆包是非常强的C端AI产品。如果字节投DeepSeek,战略协同很强,但竞争张力也更强。DeepSeek要保持独立研究路线,未必愿意进入一个已有强自研模型和强C端产品的大体系里。

腾讯和阿里相比之下更像“互补型股东”:腾讯给入口和场景,阿里给云和开发者生态。字节则更像“强竞争型股东”:它能给很多,但也可能让DeepSeek的战略独立性变得更敏感。

04 这轮融资真正说明了什么?

过去DeepSeek像一个反常识样本:不融资、不营销、不卷商业化,靠一群年轻研究员和极致工程效率,突然打穿全球AI叙事。

但V4之后,它面对的是另一套规则:

V4之后,DeepSeek面对的是另一套规则:开源模型需要持续投入,低价API需要长期算力支撑,Agent能力需要场景闭环,百万上下文需要推理基础设施,顶级人才也需要资本化激励。更不用说,中国AI公司还要在芯片、云、监管和国际环境之间找平衡。

所以这轮融资如果落地,说明DeepSeek开始接受一个现实:模型能力可以靠天才团队突破一次,但基础设施战争不能只靠天才团队长期单挑。

DeepSeek要融资,也是在给自己补一套更稳的产业底座。模型越往后走,竞争就越不是单纯的算法竞赛,而是模型、芯片、云、框架和应用场景之间的系统协同。

腾讯和阿里能提供入口与云生态,华为昇腾则代表另一条国产算力路线。DeepSeek要成为基础设施级玩家,就不可能绕开这张产业网。

05 DeepSeek是怎么走到今天的?

DeepSeek的底色来自幻方量化。幻方长期把机器学习用于量化交易,这让梁文锋团队在DeepSeek成立之前,就已经习惯了一个高度依赖算法、算力和工程效率的环境。

所以DeepSeek一出来,气质就和很多AI创业公司不同。它不像典型VC驱动的模型公司,更像是从量化系统里长出来的AI研究组织。

这种出身很重要。因为量化交易本身就是一个极度讲究效率的行业:同样的数据,谁处理得更快;同样的算力,谁压榨得更狠;同样的模型,谁能用更低成本跑出更好结果。这些东西,后来几乎都变成了DeepSeek做大模型时的核心方法论。

所以DeepSeek后来反复强调的“低成本”“高效率”“MoE架构”“更低推理成本”,并不是突然想出来的营销标签,而是它从幻方时代就继承下来的工程基因。

2023年DeepSeek正式成立之后,没有先做一个封闭的超级App,也没有先去铺天盖地做市场投放,而是选择了一个当时看起来没那么性感、但后来被证明很关键的方向:开源模型。

DeepSeek LLM、DeepSeek Coder这些早期模型,真正的意义是DeepSeek开始在开发者社区里建立一种标签:这个团队不是只会写论文,也不是只会讲中国版OpenAI故事,它是真的愿意把模型拿出来,让开发者用,让市场测,让同行比较。

代码模型尤其关键。代码能力好不好,开发者很快能试出来。DeepSeek早期通过Coder系列进入开发者视野,也为后来的R1爆发积累了第一批技术口碑。

真正让行业开始警觉的,是2024年的DeepSeek-V2。

V2不是一个大众爆款,但它在行业内部影响很大。因为它把DeepSeek的效率路线第一次打得非常清楚:MoE架构、低训练成本、低推理成本、高吞吐,最后直接引发国内大模型价格战。

这对行业的冲击很大。因为在此之前,大模型竞争基本默认是巨头游戏:谁有更多钱、更多卡、更多数据中心,谁就更接近终局。但DeepSeek-V2证明,工程效率本身也可以是一种战略武器。

到了2024年底,DeepSeek-V3发布,事情开始变得不一样。

V3把DeepSeek从国内技术圈推向全球模型竞争的核心位置。它用相对有限的训练资源,做出了一个足以和全球一线模型放在同一张表里比较的模型。

这就触碰到了全球AI行业最敏感的一根神经:如果一个中国团队可以用更低成本做出接近顶级闭源模型的开源模型,那么过去那套“只有极少数美国巨头才能玩得起大模型”的叙事,就会被动摇。

所以V3是DeepSeek的第一个全球信号。

真正让DeepSeek成为全球事件的,是2025年1月的R1。它让市场意识到,推理模型也可能被开源路线冲击。R1之后,DeepSeek不再只是开发者社区里的技术黑马,而变成了全球AI产业链都会关注的变量。

但爆火之后,DeepSeek遇到的反而是更难的问题。

一个研究型团队最擅长的是突破。可是当它变成全球关注的基础模型公司之后,要面对的就不只是模型能力了。用户会涌进来,API调用会增加,企业客户会提出稳定性要求,开发者会期待生态支持,同行会快速追赶,巨头会加码,人才会被争抢,监管和国际环境也会变得更复杂。

于是,DeepSeek原来那种“低调、独立、研究导向”的模式,开始遇到新的压力。

2025年2月之后,DeepSeek继续强化开源姿态,甚至释放更多代码库,试图巩固自己的技术社区。但从产业角度看,开源越成功,成本压力反而越大。因为开源可以带来声望、开发者、生态和扩散速度,却不能自动解决算力账单、推理成本、人才激励和商业闭环。

这就解释了为什么到了2026年4月,V4发布和融资传闻几乎同时出现。

V4说明DeepSeek还在往前冲,而且冲向的是更重的方向:百万token上下文、Agent能力、更强推理、更复杂的模型结构。这些能力都不是轻资产游戏。它们需要更大的训练投入、更强的推理基础设施,也需要更稳定的云资源和分发场景。

融资传闻的出现,恰恰说明DeepSeek正在从一个“能打仗的研究团队”,进入一个“要长期守城的基础设施公司”。

过去DeepSeek可以靠效率奇袭。

但到了V4阶段,它要面对的是持久战。

持久战不能只靠天才团队,也不能只靠幻方过去积累的资源。它需要资本,需要云,需要入口,需要开发者生态,也需要和中国最重要的科技平台建立某种战略连接。

所以,如果说V2证明了DeepSeek的效率,V3证明了DeepSeek的全球竞争力,R1证明了DeepSeek的破圈能力,那么V4和融资传闻共同说明的是:

DeepSeek正在告别“孤胆英雄”阶段。

它正在变成一个必须处理商业化、生态化、资本化和平台关系的玩家。

这也是DeepSeek故事最有意思的地方。

它一开始像是大模型时代的反叛者:不靠巨头,不靠VC,不靠铺天盖地的营销,而是靠模型本身把牌桌掀了一下。

但现在,它也不得不承认,AI战争越往后,越不是单点突破,而是系统竞争。

DeepSeek V4的发布,说明它仍然有单点突破的能力。

而腾讯、阿里的融资传闻,则说明它开始补上系统竞争的另一半。

所以DeepSeek的发展历程,一边是模型迭代线:LLM、Coder、V2、V3、R1、V4。

另一边是身份变化线:

从幻方量化的AI副线→独立的开源模型团队→

中国大模型价格战的发动机→到全球AI叙事的搅局者→

再到今天可能被华为、腾讯和阿里共同押注的基础设施级公司。

这是DeepSeek走到今天的两条路。

本文由人人都是产品经理作者【吴怼怼】,微信公众号:【吴怼怼】,原创/授权 发布于人人都是产品经理,未经许可,禁止转载。

题图来自作者提供