惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

腾讯CDC
Microsoft Azure Blog
Microsoft Azure Blog
L
LangChain Blog
Y
Y Combinator Blog
Microsoft Security Blog
Microsoft Security Blog
宝玉的分享
宝玉的分享
B
Blog RSS Feed
MongoDB | Blog
MongoDB | Blog
Jina AI
Jina AI
D
Docker
B
Blog
Engineering at Meta
Engineering at Meta
Last Week in AI
Last Week in AI
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
I
InfoQ
G
Google Developers Blog
博客园 - Franky
freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More
让小产品的独立变现更简单 - ezindie.com
让小产品的独立变现更简单 - ezindie.com
The GitHub Blog
The GitHub Blog
T
The Blog of Author Tim Ferriss
大猫的无限游戏
大猫的无限游戏
阮一峰的网络日志
阮一峰的网络日志
U
Unit 42

人人都是产品经理

为什么你的产品找不到差异化?90%的失败都卡在第一步上(下) – 人人都是产品经理, 3年从30万到1300万用户、获2200万美元融资,这个AI教育产品用“抽卡”破解了获客难题 – 人人都是产品经理, 园区招商系统怎么做才能真正帮到去化?我加了这一个功能,推广链接转发400次阅读过万 – 人人都是产品经理, AI大事件:OpenAI发完网络安全模型又搞药物研发,小鹏汽车要抓”DeepSeek时刻” – 人人都是产品经理, 电商不是卖货,是一场更残酷的产品经理实战 – 人人都是产品经理, 没想到,活动营销又回来了! – 人人都是产品经理, 为何All-in海外KOC:一场关于AI时代窗口期的豪赌 – 人人都是产品经理, 重新理解企业的内部协作 – 人人都是产品经理, 苹果的 AI 战略到底是什么? – 人人都是产品经理, 医疗智能体·第2讲——合规护城河:等保、PIPL与HIPAA的架构实战 – 人人都是产品经理, 向量知识库五步法:从“答非所问”到“精准回复” – 人人都是产品经理, 鸿蒙PC三方库构建总指挥HPKBUILD(sha)库为例 – 人人都是产品经理, 何时该用LLM?AI产品经理的LLM设计指南 – 人人都是产品经理, 医疗信息领域的需求方、决策方、准入方以及关注点(二) – 人人都是产品经理, 即梦涨价:一场被误读的「傲慢」 – 人人都是产品经理, 面试AI PM必答题:Hermes和OpenClaw的区别,如何讲清楚业务价值 – 人人都是产品经理, AI的下一张船票:世界模型——AI产品经理必须理解的技术拐点 – 人人都是产品经理, 小红书做GEO,怎么让AI信你?记住这 3 个重要信息 – 人人都是产品经理, 5 家印度 AI 初创公司,看看印度 AI 再做什么 – 人人都是产品经理, AI项目跨团队协作:产品技术业务如何不打架 – 人人都是产品经理, Agentic Workflow(智能体工作流):让AI从”答案生成器”变成”数字员工” – 人人都是产品经理, lycium_plusplus 项目全景解读:OpenHarmony 三方库构建的“大管家” – 人人都是产品经理, 从爆单救火到前置履约:两套预采策略,把生鲜大促履约效率拉满 – 人人都是产品经理, 什么时候该补货?我用一轮数据做了一个决定 – 人人都是产品经理, 从“机械兜底”到“动态分流”:AI客服重复进线治理的4大底层逻辑 – 人人都是产品经理, 抖音拼效率,红书拼洞察 – 人人都是产品经理, 全民狂欢与退潮——为什么龙虾这波热潮冷却得如此之快? – 人人都是产品经理, Stripe押注!MPP重塑全球支付 – 人人都是产品经理, 小红书GEO:AI引用你的内容,不是因为你对,而是因为你看起来可信 – 人人都是产品经理, 前百度副总裁押注办公Agent,日韩付费爆发,Manus迎来强劲对手 – 人人都是产品经理,
DeepSeek R2要来了!大摩率先曝光,参数翻倍、推理成本暴降88%
硅基观察Pro · 2025-06-07 · via 人人都是产品经理

最近,摩根士丹利的一份研报提前曝光了R2的关键信息,引发了业内的广泛关注。本文将为你详细解读DeepSeek R2的核心亮点,供大家参考。

DeepSeek R2模型终于有新消息了!

最近,顶级投行摩根士丹利发布了一则研报,提前曝光了DeepSeek即将发布的全新一代模型——R2。

这个研报篇幅不长,但信息巨大。话不多说!快跟着乌鸦君一起来看看吧。

01 两大核心亮点:参数翻倍,价码暴跌88%

这次R2的核心变化有两个:参数翻倍和成本下降。

先说前者,R2 模型的体量直接飙到1.2万亿参数,是之前 R1 的两倍多,活跃参数也从370亿 涨到了780亿,推理时调用更多“脑细胞”,意味着模型思考得更深,输出质量自然也水涨船高。

这种思路,其实和 Google 的 Gemini、Anthropic 的 Claude 类似——通过增加每次调用中参与运算的参数量来增强推理质量。例如,Gemini 2.5 Pro使用的Token比R1-0528多30%。

虽然这会提升计算成本,但对于终端用户来说,换来的是更聪明、更会“想事”的模型,值了。

另一大变化是,模型成本更便宜了。

根据大摩消息,R2的每百万Token输入成本只有0.07美元,比R1的0.15-0.16美元下降了一半还多;输出成本更厉害,从原先R1模型的其每百万Token2.19美元,大幅下降到0.27美元。

这个价格远远低于OpenAI的GPT-4o等最先进的模型。GPT-4o的API定价为输入每1百万个Token2.50美元,输出每1百万个Token 10.00美元。

也就是说,R2的价格比GPT-4o等最先进的模型便宜了97%。

对创业公司、开发者、企业来说,这无疑是巨大诱惑:不仅推理效果强,还能把使用成本打到地板价,商业化空间大大拓宽。

除了参数和价格,R2还有三大升级亮点:

1)多语言推理和代码生成能力大幅提升。据说,DeepSeek正在优先提升R2的编码能力,以及英语以外语言的能力,以扩大该模型对全球受众的潜在影响和适用性;

2)引入了更高效的 MoE混合专家架构,推理效率更高,激活参数选择更智能。该架构将人工智能模型分成独立的子网,这些子网根据输入选择性地激活。这种方法可以显著降低预训练的计算成本,并实现更快的推理性能;

3)多模态支持更强,视觉能力也比之前更上一个台阶;

简单来说,R2不仅“想得更深”,还能“看得更清楚”。

在性能提升的同时,DeepSeek也正在摆脱对H100的依赖,实现本土算力突破。

据大摩透露,这次 DeepSeek 并没有依赖传统的 NVIDIA H100 芯片,而是用上了华为的昇腾910B芯片集群。虽然生态上华为还追不上英伟达,但这已经是国产芯片参与大模型实战的重要突破了。

DeepSeek正在努力建立一个本地硬件供应链,以减少对美国制造的芯片的依赖。时至今日,R2模型背后已经形成了一个强大的本土供应链体系。

02 版本优化刚刚完成,R2还得等等?

目前,DeepSeek的模型家族主要有三大产品:

  • V系列(V1~V4):通用大模型,全面覆盖推理、效率、Agent能力;
  • R系列(R1 → R2):专注深度推理、数学、工具链整合等能力;
  • Prover-V2:一个为数学生成专门优化的模型;

其中,DeepSeek-Prover-V2于今年4月发布的新模型。Prover-V2并非通用的模型,而是一个高度专业化的数学证明模型,基于DeepSeek V3,采用了改进的MoE架构和压缩的kV缓存以减少内存消耗。

抛开新发布的数学证明模型,DeepSeek的大模型升级路线主要有条:

  • V4:作为通用模型主线的全面迭代,强调推理性能、效率与 Agent 化能力的提升;
  • R2:作为 Reasoner 专线的强化升级,对标 OpenAI的o3后续迭代模型和 Gemini 2.5 Pro 0605&正式版&未来的Gemini 3,进一步提升数理+工具链+多步推理表现;

从过去看,DeepSeek的模型迭代节奏比较固定,基本遵循“2小1大”的规律:即每两个月会有一个小版本更新,接着进行一个大版本换代。

以通用模型V1为例,V1是在2023年11月发布,V2的发布时间则是2024年5月,而V3的发布时间则到了2024年12月。按这个节奏,2025年6、7月份,DeepSeek会有一个比较大的版本更迭。

就在R2发布前不久(同样是5月29日),DeepSeek也发布了一个没改版本号但改得不小的强化版 —— R1-0528。

虽然架构没动,但这版本引入了强化学习训练(RLHF),推理深度明显加强。官方评估显示:用了9900万个token完成评测任务,比原来的R1多了40%,思考更深、过程更复杂,表现当然更好。

成绩单也很漂亮:

  • AIME 2024(数学竞赛):+21分
  • LiveCodeBench(代码生成):+15分
  • GPQA Diamond(科学推理):+10分
  • Humanity’s Last Exam(知识推理):+6分

用户反馈也很正面,特别是在逻辑、编程和交互能力上提升显著。

这次 R1-0528 升级得这么猛,很多人开始怀疑:这是不是就是传说中的R2?不过目前官方并没有正面回应,这个说法还没实锤。

虽然大摩说R2快来了,但按 DeepSeek 一贯的节奏推测,真正的 R2 估计还得再等等。这波升级,更像是“压线偷跑”的大版本优化,而不是正代更新。

文/林白

本文由人人都是产品经理作者【乌鸦智能说】,微信公众号:【乌鸦智能说】,原创/授权 发布于人人都是产品经理,未经许可,禁止转载。

题图来自DeepSeek官网截图