惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

Martin Fowler
Martin Fowler
V
Visual Studio Blog
有赞技术团队
有赞技术团队
T
Tailwind CSS Blog
B
Blog
I
InfoQ
博客园 - 三生石上(FineUI控件)
阮一峰的网络日志
阮一峰的网络日志
F
Fortinet All Blogs
H
Help Net Security
博客园 - Franky
宝玉的分享
宝玉的分享
博客园 - 司徒正美
C
Check Point Blog
G
Google Developers Blog
Cyber Security Advisories - MS-ISAC
Cyber Security Advisories - MS-ISAC
Jina AI
Jina AI
T
The Blog of Author Tim Ferriss
MongoDB | Blog
MongoDB | Blog
云风的 BLOG
云风的 BLOG
A
About on SuperTechFans
罗磊的独立博客
大猫的无限游戏
大猫的无限游戏
IT之家
IT之家

人人都是产品经理

为什么你的产品找不到差异化?90%的失败都卡在第一步上(下) – 人人都是产品经理, 3年从30万到1300万用户、获2200万美元融资,这个AI教育产品用“抽卡”破解了获客难题 – 人人都是产品经理, 园区招商系统怎么做才能真正帮到去化?我加了这一个功能,推广链接转发400次阅读过万 – 人人都是产品经理, AI大事件:OpenAI发完网络安全模型又搞药物研发,小鹏汽车要抓”DeepSeek时刻” – 人人都是产品经理, 电商不是卖货,是一场更残酷的产品经理实战 – 人人都是产品经理, 没想到,活动营销又回来了! – 人人都是产品经理, 为何All-in海外KOC:一场关于AI时代窗口期的豪赌 – 人人都是产品经理, 重新理解企业的内部协作 – 人人都是产品经理, 苹果的 AI 战略到底是什么? – 人人都是产品经理, 医疗智能体·第2讲——合规护城河:等保、PIPL与HIPAA的架构实战 – 人人都是产品经理, 向量知识库五步法:从“答非所问”到“精准回复” – 人人都是产品经理, 鸿蒙PC三方库构建总指挥HPKBUILD(sha)库为例 – 人人都是产品经理, 何时该用LLM?AI产品经理的LLM设计指南 – 人人都是产品经理, 医疗信息领域的需求方、决策方、准入方以及关注点(二) – 人人都是产品经理, 即梦涨价:一场被误读的「傲慢」 – 人人都是产品经理, 面试AI PM必答题:Hermes和OpenClaw的区别,如何讲清楚业务价值 – 人人都是产品经理, AI的下一张船票:世界模型——AI产品经理必须理解的技术拐点 – 人人都是产品经理, 小红书做GEO,怎么让AI信你?记住这 3 个重要信息 – 人人都是产品经理, 5 家印度 AI 初创公司,看看印度 AI 再做什么 – 人人都是产品经理, AI项目跨团队协作:产品技术业务如何不打架 – 人人都是产品经理, Agentic Workflow(智能体工作流):让AI从”答案生成器”变成”数字员工” – 人人都是产品经理, lycium_plusplus 项目全景解读:OpenHarmony 三方库构建的“大管家” – 人人都是产品经理, 从爆单救火到前置履约:两套预采策略,把生鲜大促履约效率拉满 – 人人都是产品经理, 什么时候该补货?我用一轮数据做了一个决定 – 人人都是产品经理, 从“机械兜底”到“动态分流”:AI客服重复进线治理的4大底层逻辑 – 人人都是产品经理, 抖音拼效率,红书拼洞察 – 人人都是产品经理, 全民狂欢与退潮——为什么龙虾这波热潮冷却得如此之快? – 人人都是产品经理, Stripe押注!MPP重塑全球支付 – 人人都是产品经理, 小红书GEO:AI引用你的内容,不是因为你对,而是因为你看起来可信 – 人人都是产品经理, 前百度副总裁押注办公Agent,日韩付费爆发,Manus迎来强劲对手 – 人人都是产品经理,
DeepSeek V4终于来了!我们知道些什么?
互联网怪盗团 · 2026-04-24 · via 人人都是产品经理

DeepSeek V4预览版终于发布,战略聚焦Agent能力提升,但评测显示与Claude Opus仍有差距。1M上下文窗口与低价Token策略带来生产力潜力,回答风格偏干可能影响C端市场。技术文档隐藏训练硬件细节,引发昇腾适配猜测。开源特性将加速产业验证,腾讯或成最大受益方。

万众期待的DeepSeek V4预览版终于在北京时间4月24日上午发布了。此前,媒体和分析师曾反复预测V4即将发布,并已经多次预测失败,这一次终于成功了。由于模型发布时间还太短,第三方和客户评测还在紧锣密鼓的进行中,现在的有效信息其实很少。不过,通过技术文档和海外AI社区的初步讨论,我们还是能得到一些情报的。

首先,V4的战略方向是提高Agent能力,这与OpenClaw发布以来的世界潮流相符。“全民养龙虾”的浪潮,给MiniMax, Kimi和智谱等国产大模型厂商带来了巨大的Token增量,但最重要、最专业的增量被Claude吃掉了。Agent能力与编程能力是密不可分的,Claude Code至今仍是全球最强大的AI编程工具(没有之一),GPT-Codex也无法撼动其地位。DeepSeek官方公告在开头最显眼的部分宣称“Agent能力大幅提高”,但也承认“(据评测反馈)仍与Opus 4.6思考模式存在一定差距”。

在海外AI社区,一部分用户十分兴奋,期待DeepSeek成为“Claude杀手”——但公允的说,这只是一种美好愿望,毕竟很多人都很痛恨Claude及其开发商Anthropic,“天下苦Anthropic久矣”。从目前的测试数据看,V4的Token性价比很高,但是Agent Benchmark指标并没有超过Claude Opus-4.6和GPT-5.4。需要注意的是,Benchmark分数只有参考意义,关键还是实际用户体验,Claude在许多Benchmark测试当中并不优于GPT和Gemini,但并不妨碍它在Agent领域几乎一枝独秀。因此,我非常关心接下来一段时间,专业用户使用DeepSeek进行Agent操作的实际反馈。

上下文窗口扩展到1M是一个重要提升,与较低的Token定价结合起来,可能创造较高的生产力。不过,我们仍需要等待专业客户执行复杂任务之后的实际反馈,至少还得等两三天。

我猜测:DeepSeek从传说中的“1月/2月发布”一直拖到今天发布,实际原因可能是打磨Agent能力,因为龙虾这波增量超出了所有人的预期。与其发布一个跟不上现实Agentic Workflow需求的大模型,还不如在等几个月,发布一个完全符合现实需求的大模型。当然这只是我的个人猜测,没有实证。

其次,最初一波海外客户使用反馈,在执行“非深度推理、非数学、非代码”任务,例如头脑风暴和文艺创作时,V4给人的感觉“太干”(dry),“过于正式”,落后于Claude和GPT的最新版本,甚至有人认为落后于GPT-5.2。需要强调的是,这些零碎的主观感受代表不了什么,文艺创作任务也并非V4的主要发力方向。不过,这有可能对消费端用户的倾向造成微妙的影响,从而扰动目前互联网大厂对C端AI应用市场的争夺战。

假设V4的回答真的“太干”“太正式”,有可能是对于V3/R1幻觉率较高问题的一种解决,因为自由发挥几乎一定意味着幻觉率提升,而限制幻觉率几乎一定会让回答“更干”。当然这只是猜测,期待更多更广泛的测试结果。

第三,也是很多人最关心的:DeepSeek V4技术文件披露了很多训练细节,但是不包括训练硬件(显卡)。整份技术文件当中,仅仅提到“华为”(Huawei)一次,提到“英伟达”(Nvidia)三次(不含脚注);提到“GPU”十四次(不含脚注),但都没有提到是什么型号的GPU,仅有一次例外——”We validated the fine-grained EP scheme on both NVIDIA GPUs and Huawei NPUs platforms. 但这只是表示测试环境,不代表训练场景(注:这也是唯一一次提到华为昇腾NPU)。

因此,我们仍不知道DeepSeek究竟是在什么硬件上训练出来的。技术文件中有几次提到了CUDA,但也不能据此得出完全基于英伟达架构的结论。是否像某些分析师预期的那样,“基于英伟达和华为昇腾混合架构进行训练”,或者“在后训练环节对昇腾进行了专门优化”?遗憾的是,虽然一切皆有可能,但是DeepSeek官方既无认可、也无否认。相比之下,V3技术文件在一开始就宣布是由英伟达H800和A100训练出来的。

图片由Google Nano Banana Pro制作

有人根据DeepSeek公告中“预计下半年昇腾950超节点批量上市后,Pro的价格会大幅下调”,得出了“V4针对昇腾做了深度优化”,甚至“从1月推迟发布至今就是为了适配昇腾”的结论。虽然不能完全排除这种可能性,但不得不说,这种思维过于跳跃。这只能说明DeepSeek官方会采购或租用一批昇腾算力,并对昇腾推理进行过一些优化(这是很正常的),至于优化程度多深、乃至是否为了适配昇腾而多次推出发布,均还没有任何实证支持。

不过,要间接证明或证伪也不难。V4是开源的,从今天起,会有无数厂商用自己的算力运行推理。假设它确实是基于昇腾训练出来的,或者为昇腾做过深度优化,那么可以推断——它在昇腾硬件上的推理效率,应该高于在英伟达等其他硬件上的推理效率,或至少处于同一量级。又或者,昇腾硬件能够促使V4达到某种独特的性能,而其他硬件做不到。只需要关注一下新闻即可轻松了解实际情况(如果没看到新闻则代表证伪了)。

最后是对产业界的影响。除了DeepSeek自己,最期待V4发布并震惊世界的,大概就是腾讯了。昨天混元3.0大模型预览版刚刚发布,结果其光芒完全被今天的DeepSeek V4遮住了。我还没有机会全面试用混元3.0,但是考虑到此前腾讯在基座大模型方面的落后程度非常大,想用一个版本就达到世界先进水平,似乎不太可能。

因此,腾讯要做好AI生意,不管是做好To B生意(尤其是卖Token的MaaS生意)还是To C生意,恐怕还是要依赖高质量的第三方开源大模型。国内水平最高、使用人数最多的开源大模型是Qwen,那是老对手阿里的,腾讯显然不太愿意用。那就只有依靠DeepSeek,以及几天之前才发过新版本的Kimi了。如果DeepSeek真的开放融资,腾讯一定会不惜代价投进去。V4越成功,就越能让腾讯争取到更多时间,一边争取把自己做成“国产开源生态”的一个集合平台,另一边竭尽全力把自研大模型实力赶上来。

我想,现在最期待V4在用户测试当中传来捷报的,应该是腾讯的投资人和管理层。幸运的是,从最初期的一波反馈看,似乎还不错,海外社区的评价偏向积极一面。但确实还需要更多信息,而且仅仅“偏向积极”是不够的,最好是“十分积极”——我们恐怕还得等上一个星期才能确认。

本文由 @不蓝灯 原创发布于人人都是产品经理。未经作者许可,禁止转载

题图来自Unsplash,基于CC0协议

该文观点仅代表作者本人,人人都是产品经理平台仅提供信息存储空间服务