惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

D
DataBreaches.Net
B
Blog
博客园_首页
C
Check Point Blog
Microsoft Security Blog
Microsoft Security Blog
MyScale Blog
MyScale Blog
P
Proofpoint News Feed
Engineering at Meta
Engineering at Meta
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
B
Blog RSS Feed
M
MIT News - Artificial intelligence
freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More
WordPress大学
WordPress大学
宝玉的分享
宝玉的分享
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
The Cloudflare Blog
量子位
V
V2EX
Y
Y Combinator Blog
Hugging Face - Blog
Hugging Face - Blog
Martin Fowler
Martin Fowler
Recent Announcements
Recent Announcements
I
InfoQ
博客园 - 【当耐特】

人人都是产品经理

为什么你的产品找不到差异化?90%的失败都卡在第一步上(下) – 人人都是产品经理, 3年从30万到1300万用户、获2200万美元融资,这个AI教育产品用“抽卡”破解了获客难题 – 人人都是产品经理, 园区招商系统怎么做才能真正帮到去化?我加了这一个功能,推广链接转发400次阅读过万 – 人人都是产品经理, AI大事件:OpenAI发完网络安全模型又搞药物研发,小鹏汽车要抓”DeepSeek时刻” – 人人都是产品经理, 电商不是卖货,是一场更残酷的产品经理实战 – 人人都是产品经理, 没想到,活动营销又回来了! – 人人都是产品经理, 为何All-in海外KOC:一场关于AI时代窗口期的豪赌 – 人人都是产品经理, 重新理解企业的内部协作 – 人人都是产品经理, 苹果的 AI 战略到底是什么? – 人人都是产品经理, 医疗智能体·第2讲——合规护城河:等保、PIPL与HIPAA的架构实战 – 人人都是产品经理, 向量知识库五步法:从“答非所问”到“精准回复” – 人人都是产品经理, 鸿蒙PC三方库构建总指挥HPKBUILD(sha)库为例 – 人人都是产品经理, 何时该用LLM?AI产品经理的LLM设计指南 – 人人都是产品经理, 医疗信息领域的需求方、决策方、准入方以及关注点(二) – 人人都是产品经理, 即梦涨价:一场被误读的「傲慢」 – 人人都是产品经理, 面试AI PM必答题:Hermes和OpenClaw的区别,如何讲清楚业务价值 – 人人都是产品经理, AI的下一张船票:世界模型——AI产品经理必须理解的技术拐点 – 人人都是产品经理, 小红书做GEO,怎么让AI信你?记住这 3 个重要信息 – 人人都是产品经理, 5 家印度 AI 初创公司,看看印度 AI 再做什么 – 人人都是产品经理, AI项目跨团队协作:产品技术业务如何不打架 – 人人都是产品经理, Agentic Workflow(智能体工作流):让AI从”答案生成器”变成”数字员工” – 人人都是产品经理, lycium_plusplus 项目全景解读:OpenHarmony 三方库构建的“大管家” – 人人都是产品经理, 从爆单救火到前置履约:两套预采策略,把生鲜大促履约效率拉满 – 人人都是产品经理, 什么时候该补货?我用一轮数据做了一个决定 – 人人都是产品经理, 从“机械兜底”到“动态分流”:AI客服重复进线治理的4大底层逻辑 – 人人都是产品经理, 抖音拼效率,红书拼洞察 – 人人都是产品经理, 全民狂欢与退潮——为什么龙虾这波热潮冷却得如此之快? – 人人都是产品经理, Stripe押注!MPP重塑全球支付 – 人人都是产品经理, 小红书GEO:AI引用你的内容,不是因为你对,而是因为你看起来可信 – 人人都是产品经理, 前百度副总裁押注办公Agent,日韩付费爆发,Manus迎来强劲对手 – 人人都是产品经理,
Qwen3来了,DeepSeek R2还会远吗?
微果酱 · 2025-04-30 · via 人人都是产品经理

阿里凌晨发布新一代通义千问模型Qwen3,作为全球首个开源的混合推理模型,性能强大且性价比高,支持多种语言和广泛应用场景。而面对Qwen3及百度文心4.5 Turbo的挑战,DeepSeek静默以对,却让外界更加期待其即将发布的R2模型,一场AI模型的激烈竞争即将展开。

阿里开源新一代通义千问模型 Qwen3。

这是全球第一个开源的混合推理模型。

什么叫混合推理模型?简单说就像把DeepSeek的V3与R1糅合在一起,不必手动开关闭推理模式,就能同时进行普通思考和长思考。

Qwen3模型能力号称登顶全球,体现在几个亮点上。

01 大而全

这次共发布八个模型:六个Dense稠密模型:Qwen3-0.6B、1.7B、4B、8B、14B、32B;两个MoE模型:Qwen3-30B-A3B、旗舰版的Qwen3-235B-A22B。

八个模型就像全家桶,小到0.6B,大到235B,满足全方位需求,无论个人日常使用或公司商用都没有任何限制。

02 顶级性能

Qwen3-4B的小模型能和之前的QwQ-32B不分伯仲;而Qwen3-30B-A3B对于QwQ-32B则是全方位的碾压。最强的旗舰版Qwen3-235B-A22B更是直接与世界顶级的OpenAI-o1、DeepSeek-R1对标。

03 性价比高

更重要的是,便宜啊。旗舰版的Qwen3-235B-A22B部署成本只要DeepSeek-R1的三分之一。要知道,DeepSeek是以低成本撬开美国算力铁幕的,“卷”这个字,只有中国企业才能诠释得淋漓尽致。

04 更加开放

与国外的Claude3.7一样,千问3支持MCP协议,也是国内首个原生支持MCP的大模型。可以在Qwen3接入即梦、Gihub等工具,实现一模多用。

05 应用更广

相比上一代Qwen2.5支持29种语言,Qwen3支持多达119种语言,真正走向全世界了。

无论Qwen3,还是前段时间百度发布的文心4.5 Turbo,在性能和性价比上都宣称超过了DeepSeek-R1。不过,面对挑战,DeepSeek依旧静如处子。

沉默,往往是爆发前的状态,以DeepSeek过往开发经验,时候差不多了。

4月27日晚,全球最大AI开源社区Hugging Face的首席执行官,Clément Delangue在社交平台发布了一条耐人寻味的动态——三个眼睛的表情符号,同时附上DeepSeek团队在Hugging Face平台的官方资源库入口。

这则无声的寓言,是否预示着DeepSeek-R2进入了发布倒计时?

进而有网友贴出了所谓DeepSeek-R2大模型的详细技术参数。

1、拥有 1.2万亿参数,活跃参数为 780亿,采用混合 MoE架构。

2、成本比 GPT-4o便宜 97.3%(输入每百万次 0.07美元,输出每百万次 0.27美元)。

3、使用了 5.2PB的训练数据,在 C-Eval2.0测试中取得了 89.7%的得分。

4、视觉能力更强,在 COCO测试集上达到了 92.4%。

对于这些消息,DeepSeek尚未发表任何辟谣声明,不禁让人浮想联翩。

自从2月DeepSeek揭开AI时代大幕后,人工智能就进入以中美为逐鹿场,群雄并起的春秋时代,各路豪杰你方唱罢我登场。即将到来的5月,这场未来之争将进入更加激烈的阶段,DeepSeek R2无疑是那个最值得期待的主角。

雪莱说:冬天来了,春天还会远吗?

本文由人人都是产品经理作者【微果酱】,微信公众号:【AI微果酱】,原创/授权 发布于人人都是产品经理,未经许可,禁止转载。

题图来自Unsplash,基于 CC0 协议。