惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

J
Java Code Geeks
Stack Overflow Blog
Stack Overflow Blog
B
Blog RSS Feed
C
Check Point Blog
D
Docker
Y
Y Combinator Blog
Recent Announcements
Recent Announcements
Google DeepMind News
Google DeepMind News
MongoDB | Blog
MongoDB | Blog
博客园_首页
Apple Machine Learning Research
Apple Machine Learning Research
量子位
有赞技术团队
有赞技术团队
IT之家
IT之家
大猫的无限游戏
大猫的无限游戏
D
DataBreaches.Net
M
MIT News - Artificial intelligence
B
Blog
阮一峰的网络日志
阮一峰的网络日志
freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More
腾讯CDC
让小产品的独立变现更简单 - ezindie.com
让小产品的独立变现更简单 - ezindie.com
V
V2EX
月光博客
月光博客

人人都是产品经理

为什么你的产品找不到差异化?90%的失败都卡在第一步上(下) – 人人都是产品经理, 3年从30万到1300万用户、获2200万美元融资,这个AI教育产品用“抽卡”破解了获客难题 – 人人都是产品经理, 园区招商系统怎么做才能真正帮到去化?我加了这一个功能,推广链接转发400次阅读过万 – 人人都是产品经理, AI大事件:OpenAI发完网络安全模型又搞药物研发,小鹏汽车要抓”DeepSeek时刻” – 人人都是产品经理, 电商不是卖货,是一场更残酷的产品经理实战 – 人人都是产品经理, 没想到,活动营销又回来了! – 人人都是产品经理, 为何All-in海外KOC:一场关于AI时代窗口期的豪赌 – 人人都是产品经理, 重新理解企业的内部协作 – 人人都是产品经理, 苹果的 AI 战略到底是什么? – 人人都是产品经理, 医疗智能体·第2讲——合规护城河:等保、PIPL与HIPAA的架构实战 – 人人都是产品经理, 向量知识库五步法:从“答非所问”到“精准回复” – 人人都是产品经理, 鸿蒙PC三方库构建总指挥HPKBUILD(sha)库为例 – 人人都是产品经理, 何时该用LLM?AI产品经理的LLM设计指南 – 人人都是产品经理, 医疗信息领域的需求方、决策方、准入方以及关注点(二) – 人人都是产品经理, 即梦涨价:一场被误读的「傲慢」 – 人人都是产品经理, 面试AI PM必答题:Hermes和OpenClaw的区别,如何讲清楚业务价值 – 人人都是产品经理, AI的下一张船票:世界模型——AI产品经理必须理解的技术拐点 – 人人都是产品经理, 小红书做GEO,怎么让AI信你?记住这 3 个重要信息 – 人人都是产品经理, 5 家印度 AI 初创公司,看看印度 AI 再做什么 – 人人都是产品经理, AI项目跨团队协作:产品技术业务如何不打架 – 人人都是产品经理, Agentic Workflow(智能体工作流):让AI从”答案生成器”变成”数字员工” – 人人都是产品经理, lycium_plusplus 项目全景解读:OpenHarmony 三方库构建的“大管家” – 人人都是产品经理, 从爆单救火到前置履约:两套预采策略,把生鲜大促履约效率拉满 – 人人都是产品经理, 什么时候该补货?我用一轮数据做了一个决定 – 人人都是产品经理, 从“机械兜底”到“动态分流”:AI客服重复进线治理的4大底层逻辑 – 人人都是产品经理, 抖音拼效率,红书拼洞察 – 人人都是产品经理, 全民狂欢与退潮——为什么龙虾这波热潮冷却得如此之快? – 人人都是产品经理, Stripe押注!MPP重塑全球支付 – 人人都是产品经理, 小红书GEO:AI引用你的内容,不是因为你对,而是因为你看起来可信 – 人人都是产品经理, 前百度副总裁押注办公Agent,日韩付费爆发,Manus迎来强劲对手 – 人人都是产品经理,
抢先DeepSeek R2,阿里通义正式发布国内首个通用推理模型
电厂 · 2025-04-30 · via 人人都是产品经理

在大模型竞争愈发激烈的当下,阿里通义千问团队于4月29日凌晨正式发布了Qwen 3系列模型,这是国内首个通用推理模型。Qwen 3凭借其独特的混合推理模式、强大的性能和显著的成本优势,全面超越了此前备受关注的DeepSeek R1,成为全球开源大模型领域的新标杆。

Qwen 3模型即将发布的消息,已经流传了一个月的时间;特别是最近一周内,坊间对Qwen 3的猜测不断在“憋个大的”与“最终难产”之间反复横跳。直到4月29日凌晨,这款备受关注的模型终于亮相,号称全面超越DeepSeek R1。

杭州一家中厂的算法从业者告诉「电厂」:“近几个月网上不少DeepSeek R2的泄露信息,有人说R2要在5月份发。Qwen 3(这个时间发布)肯定是想抢个先机。”在一家国产大模型开放平台工作的刘露则透露,其所在的团队提前不到12小时获知Qwen3的发布消息,团队成员连夜完成了Qwen 3系列模型在该平台的部署上线。

无论如何,Qwen 3的亮相都意味着开源AI大模型的技术能力再次被刷新;与之相继的,将是产业链下游应用者迎来一次新的生态选择。「电厂」注意到,Qwen 3发布仅10小时,已经有开发者发布了套壳Qwen 3系列模型的ChatBot类产品。

基于Qwen 3的第三方ChatBot类产品,图源/网络‍

01 国内首个混合推理模型,成本/性能超越DeepSeek R1

根据阿里云通义千问团队官宣,Qwen3系列开源了8个模型,其中包含2个MoE(混合专家)大模型和6个Dense(稠密)大模型。本次Qwen3系列模型尤为值得关注的创新是该模型支持思考模式、非思考模式两种运行方式。

在思考模式下,模型会逐步推理,经过深思熟虑后给出最终答案。这种方法适合需要深入思考的复杂问题;在非思考模式中,模型会提供快速、近乎即时的响应,适用于对速度要求高于深度的简单问题。换句话说,Qwen3打破了DeepSeek R1等思维链模型慢思考的单一模式,而是为用户赋予灵活选择的权利。这也是如今全球大模型市场发展的重要方向之一。

不同Benchmark下Qwen3两种思考模式对比,图源/阿里云通义‍

今年2月份,由部分OpenAI前员工创办的Anthropic在全球范围内率先发布了名为Claude 3.7 Sonnet的混合推理模型,被视为融合了DeepSeek V3(适于通用任务)与R1(适于推理任务)模型的各自优势。这种混合模式引起了业界的广泛关注。

OpenAI创始人Sam Altman就曾表示,OpenAI接下来将研发“它能够知道什么时候应该长时间思考,并且通常适用于广泛任务”的模型。而Qwen3是国内首个混合推理模型。性能及成本优化方面,Qwen3系列也表现惊人。

比如本次开源的两个MoE模型,权重分别为Qwen3-235B-A22B,是一个拥有 2350 多亿总参数和220多亿激活参数的大模型;另一个为Qwen3-30B-A3B,一个拥有约300亿总参数和30亿激活参数的小型MoE模型。MoE(混合专家模型)混合包含多个专家网络,每个专家通常是一个子模型、也可以是神经网络的一个子模块,拥有不同的能力或专长,能够处理不同类型的输入数据。

在运行时,不同任务会被进行分类、输送到相应的“专家”处进行解决。DeepSeek V3与R1都属于MoE模型。这种架构的优势是其能够,并且在解决任务时仅调动与之相应的模块、节省计算成本。这也是“AI界拼多多”DeepSeek提升性价比的杀手锏之一。作为与Qwen3的对比,DeepSeek V3与R1总参数规模为6710亿参数,激活参数为370亿。

性能方面,官方信息显示,Qwen旗舰模型 Qwen3-235B-A22B 在代码、数学、通用能力等基准测试中,与 DeepSeek-R1、o1、o3-mini、Grok-3 和 Gemini-2.5-Pro 等顶级模型相比,均展现出优势。小型MoE模型Qwen3-30B-A3B ,相比DeepSeek V3、GPT 4o、谷歌Gemma3-27B-1T等模型同样表现优异。

六个开源的Dense模型均适用于通用任务解决,包括Qwen3-32B、Qwen3-14B、Qwen3-8B、Qwen3-4B、Qwen3-1.7B 和 Qwen3-0.6B。值得一提的是参数量极低的Qwen3-4B模型,也在不少任务中展现出来相比GPT 4o更为优异的成绩。上述模型均在 Apache 2.0 许可下开源。这是一种较为宽松的许可证,允许代码修改和再发布(作为开源或商业软件)。Qwen3模型还支持 119 种语言和方言,并优化了Agent和代码能力、加强了对MCP的支持。

02 开源大模型“城头变换大王旗”

Qwen3的发布,距离DeepSeek R1的亮相已过去了3个多月。1月20日,凭借比肩OpenAI o1的性能、低廉的成本,以及对大模型研发范式的改变,R1一经发布就荣膺开源大模型世界的“无冕之王”至今。

在此期间,包含科大讯飞(星火X1)、百度(文心X1)、OpenAI(o3 mini)、阿里(Qwen-QwQ-32B)、字节(豆包1.5深度思考)在内的玩家纷纷下场推理模型,但至多是接近R1性能或实现部分超越,未能真正挑动后者的位置。在大模型的世界里,数月的时间已足够一代新王换旧王。正是这样的背景下,关注的目光落到了Qwen3身上。与许多国内玩家不同的是,早在2024年8月,阿里就公开站到了开源自研模型的大厂阵营之中。

在这条最终被DeepSeek验证可行的市场之路上,Qwen可以说已经提前拿到了不少牌。至今Qwen系列产品已在不少开源榜单中排名靠前。如据全球最大AI开源社区Huggingface 4月29日显示,在audio-text-to-text任务类目下,Qwen的两款模型热度居前。Huggingface 于2月10日发布的开源大模型榜单“Open LLM Leaderboard”也显示,排名前十的开源大模型全部是基于Qwen开源模型二次训练的衍生模型。

图源/Huggingface‍

在生态活跃度方面,Qwen也处于全球前列。据官方数据显示,从2024年下半年开始至2025年1月底,基于Qwen系列的衍生模型数量超过了美国Llama系列,超过9万个,已是全球最大的AI模型家族,超过了Meta 旗下的Llama家族。

不过对比Llama系列,Qwen系列开源模型在下载量方面与前者仍有差距。据Meta首席执行官Zuck Burg在今年3月份宣布,Llama的下载量已达到10亿次;而Qwen系列的下载量还在千万级别。

在Qwen3发布这一天,周靖人接受了“晚点”的采访,他讲道,判断“开源生态跑出来了”的指标主要有两点“一是看开发者的选择,二是看性能指标”。本次随着Qwen3的发布,这款新模型通过在性能指标和成本方面超越DeepSeek R1,以及创新的混合推理模式,登顶为全球最强大的开源大模型,又为Qwen增添了一张好牌。

但在这之后,还有更多的挑战等待着它。接下来DeepSeek R2的亮相,也将为整个市场增添新的变数。在贯彻“第一通吃(winner-takes-all)”定律的开源市场,竞争远未到达终局、谁能成为最终的“winner”还充满未知,无论是DeepSeek,还是Qwen和Llama,都仍需要为不下牌桌而持续努力。不过值得欣慰的是,虽然战程未半,至少当下的开源大模型“桂冠”仍归属于国产玩家。

记者 董温淑 编辑 高宇雷

本文由人人都是产品经理作者【电厂】,微信公众号:【电厂】,原创/授权 发布于人人都是产品经理,未经许可,禁止转载。

题图来自阿里巴巴官网