惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

让小产品的独立变现更简单 - ezindie.com
让小产品的独立变现更简单 - ezindie.com
爱范儿
爱范儿
H
Help Net Security
V
Visual Studio Blog
J
Java Code Geeks
Stack Overflow Blog
Stack Overflow Blog
Microsoft Security Blog
Microsoft Security Blog
Apple Machine Learning Research
Apple Machine Learning Research
MyScale Blog
MyScale Blog
The Cloudflare Blog
Martin Fowler
Martin Fowler
D
Docker
腾讯CDC
F
Fortinet All Blogs
雷峰网
雷峰网
GbyAI
GbyAI
G
Google Developers Blog
Cyber Security Advisories - MS-ISAC
Cyber Security Advisories - MS-ISAC
Recent Announcements
Recent Announcements
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
Blog — PlanetScale
Blog — PlanetScale
Engineering at Meta
Engineering at Meta
博客园 - 聂微东
博客园 - 叶小钗

人人都是产品经理

为什么你的产品找不到差异化?90%的失败都卡在第一步上(下) – 人人都是产品经理, 3年从30万到1300万用户、获2200万美元融资,这个AI教育产品用“抽卡”破解了获客难题 – 人人都是产品经理, 园区招商系统怎么做才能真正帮到去化?我加了这一个功能,推广链接转发400次阅读过万 – 人人都是产品经理, AI大事件:OpenAI发完网络安全模型又搞药物研发,小鹏汽车要抓”DeepSeek时刻” – 人人都是产品经理, 电商不是卖货,是一场更残酷的产品经理实战 – 人人都是产品经理, 没想到,活动营销又回来了! – 人人都是产品经理, 为何All-in海外KOC:一场关于AI时代窗口期的豪赌 – 人人都是产品经理, 重新理解企业的内部协作 – 人人都是产品经理, 苹果的 AI 战略到底是什么? – 人人都是产品经理, 医疗智能体·第2讲——合规护城河:等保、PIPL与HIPAA的架构实战 – 人人都是产品经理, 向量知识库五步法:从“答非所问”到“精准回复” – 人人都是产品经理, 鸿蒙PC三方库构建总指挥HPKBUILD(sha)库为例 – 人人都是产品经理, 何时该用LLM?AI产品经理的LLM设计指南 – 人人都是产品经理, 医疗信息领域的需求方、决策方、准入方以及关注点(二) – 人人都是产品经理, 即梦涨价:一场被误读的「傲慢」 – 人人都是产品经理, 面试AI PM必答题:Hermes和OpenClaw的区别,如何讲清楚业务价值 – 人人都是产品经理, AI的下一张船票:世界模型——AI产品经理必须理解的技术拐点 – 人人都是产品经理, 小红书做GEO,怎么让AI信你?记住这 3 个重要信息 – 人人都是产品经理, 5 家印度 AI 初创公司,看看印度 AI 再做什么 – 人人都是产品经理, AI项目跨团队协作:产品技术业务如何不打架 – 人人都是产品经理, Agentic Workflow(智能体工作流):让AI从”答案生成器”变成”数字员工” – 人人都是产品经理, lycium_plusplus 项目全景解读:OpenHarmony 三方库构建的“大管家” – 人人都是产品经理, 从爆单救火到前置履约:两套预采策略,把生鲜大促履约效率拉满 – 人人都是产品经理, 什么时候该补货?我用一轮数据做了一个决定 – 人人都是产品经理, 从“机械兜底”到“动态分流”:AI客服重复进线治理的4大底层逻辑 – 人人都是产品经理, 抖音拼效率,红书拼洞察 – 人人都是产品经理, 全民狂欢与退潮——为什么龙虾这波热潮冷却得如此之快? – 人人都是产品经理, Stripe押注!MPP重塑全球支付 – 人人都是产品经理, 小红书GEO:AI引用你的内容,不是因为你对,而是因为你看起来可信 – 人人都是产品经理, 前百度副总裁押注办公Agent,日韩付费爆发,Manus迎来强劲对手 – 人人都是产品经理,
抢先DeepSeek R2,阿里通义正式发布国内首个通用推理模型
电厂 · 2025-04-30 · via 人人都是产品经理

在大模型竞争愈发激烈的当下,阿里通义千问团队于4月29日凌晨正式发布了Qwen 3系列模型,这是国内首个通用推理模型。Qwen 3凭借其独特的混合推理模式、强大的性能和显著的成本优势,全面超越了此前备受关注的DeepSeek R1,成为全球开源大模型领域的新标杆。

Qwen 3模型即将发布的消息,已经流传了一个月的时间;特别是最近一周内,坊间对Qwen 3的猜测不断在“憋个大的”与“最终难产”之间反复横跳。直到4月29日凌晨,这款备受关注的模型终于亮相,号称全面超越DeepSeek R1。

杭州一家中厂的算法从业者告诉「电厂」:“近几个月网上不少DeepSeek R2的泄露信息,有人说R2要在5月份发。Qwen 3(这个时间发布)肯定是想抢个先机。”在一家国产大模型开放平台工作的刘露则透露,其所在的团队提前不到12小时获知Qwen3的发布消息,团队成员连夜完成了Qwen 3系列模型在该平台的部署上线。

无论如何,Qwen 3的亮相都意味着开源AI大模型的技术能力再次被刷新;与之相继的,将是产业链下游应用者迎来一次新的生态选择。「电厂」注意到,Qwen 3发布仅10小时,已经有开发者发布了套壳Qwen 3系列模型的ChatBot类产品。

基于Qwen 3的第三方ChatBot类产品,图源/网络‍

01 国内首个混合推理模型,成本/性能超越DeepSeek R1

根据阿里云通义千问团队官宣,Qwen3系列开源了8个模型,其中包含2个MoE(混合专家)大模型和6个Dense(稠密)大模型。本次Qwen3系列模型尤为值得关注的创新是该模型支持思考模式、非思考模式两种运行方式。

在思考模式下,模型会逐步推理,经过深思熟虑后给出最终答案。这种方法适合需要深入思考的复杂问题;在非思考模式中,模型会提供快速、近乎即时的响应,适用于对速度要求高于深度的简单问题。换句话说,Qwen3打破了DeepSeek R1等思维链模型慢思考的单一模式,而是为用户赋予灵活选择的权利。这也是如今全球大模型市场发展的重要方向之一。

不同Benchmark下Qwen3两种思考模式对比,图源/阿里云通义‍

今年2月份,由部分OpenAI前员工创办的Anthropic在全球范围内率先发布了名为Claude 3.7 Sonnet的混合推理模型,被视为融合了DeepSeek V3(适于通用任务)与R1(适于推理任务)模型的各自优势。这种混合模式引起了业界的广泛关注。

OpenAI创始人Sam Altman就曾表示,OpenAI接下来将研发“它能够知道什么时候应该长时间思考,并且通常适用于广泛任务”的模型。而Qwen3是国内首个混合推理模型。性能及成本优化方面,Qwen3系列也表现惊人。

比如本次开源的两个MoE模型,权重分别为Qwen3-235B-A22B,是一个拥有 2350 多亿总参数和220多亿激活参数的大模型;另一个为Qwen3-30B-A3B,一个拥有约300亿总参数和30亿激活参数的小型MoE模型。MoE(混合专家模型)混合包含多个专家网络,每个专家通常是一个子模型、也可以是神经网络的一个子模块,拥有不同的能力或专长,能够处理不同类型的输入数据。

在运行时,不同任务会被进行分类、输送到相应的“专家”处进行解决。DeepSeek V3与R1都属于MoE模型。这种架构的优势是其能够,并且在解决任务时仅调动与之相应的模块、节省计算成本。这也是“AI界拼多多”DeepSeek提升性价比的杀手锏之一。作为与Qwen3的对比,DeepSeek V3与R1总参数规模为6710亿参数,激活参数为370亿。

性能方面,官方信息显示,Qwen旗舰模型 Qwen3-235B-A22B 在代码、数学、通用能力等基准测试中,与 DeepSeek-R1、o1、o3-mini、Grok-3 和 Gemini-2.5-Pro 等顶级模型相比,均展现出优势。小型MoE模型Qwen3-30B-A3B ,相比DeepSeek V3、GPT 4o、谷歌Gemma3-27B-1T等模型同样表现优异。

六个开源的Dense模型均适用于通用任务解决,包括Qwen3-32B、Qwen3-14B、Qwen3-8B、Qwen3-4B、Qwen3-1.7B 和 Qwen3-0.6B。值得一提的是参数量极低的Qwen3-4B模型,也在不少任务中展现出来相比GPT 4o更为优异的成绩。上述模型均在 Apache 2.0 许可下开源。这是一种较为宽松的许可证,允许代码修改和再发布(作为开源或商业软件)。Qwen3模型还支持 119 种语言和方言,并优化了Agent和代码能力、加强了对MCP的支持。

02 开源大模型“城头变换大王旗”

Qwen3的发布,距离DeepSeek R1的亮相已过去了3个多月。1月20日,凭借比肩OpenAI o1的性能、低廉的成本,以及对大模型研发范式的改变,R1一经发布就荣膺开源大模型世界的“无冕之王”至今。

在此期间,包含科大讯飞(星火X1)、百度(文心X1)、OpenAI(o3 mini)、阿里(Qwen-QwQ-32B)、字节(豆包1.5深度思考)在内的玩家纷纷下场推理模型,但至多是接近R1性能或实现部分超越,未能真正挑动后者的位置。在大模型的世界里,数月的时间已足够一代新王换旧王。正是这样的背景下,关注的目光落到了Qwen3身上。与许多国内玩家不同的是,早在2024年8月,阿里就公开站到了开源自研模型的大厂阵营之中。

在这条最终被DeepSeek验证可行的市场之路上,Qwen可以说已经提前拿到了不少牌。至今Qwen系列产品已在不少开源榜单中排名靠前。如据全球最大AI开源社区Huggingface 4月29日显示,在audio-text-to-text任务类目下,Qwen的两款模型热度居前。Huggingface 于2月10日发布的开源大模型榜单“Open LLM Leaderboard”也显示,排名前十的开源大模型全部是基于Qwen开源模型二次训练的衍生模型。

图源/Huggingface‍

在生态活跃度方面,Qwen也处于全球前列。据官方数据显示,从2024年下半年开始至2025年1月底,基于Qwen系列的衍生模型数量超过了美国Llama系列,超过9万个,已是全球最大的AI模型家族,超过了Meta 旗下的Llama家族。

不过对比Llama系列,Qwen系列开源模型在下载量方面与前者仍有差距。据Meta首席执行官Zuck Burg在今年3月份宣布,Llama的下载量已达到10亿次;而Qwen系列的下载量还在千万级别。

在Qwen3发布这一天,周靖人接受了“晚点”的采访,他讲道,判断“开源生态跑出来了”的指标主要有两点“一是看开发者的选择,二是看性能指标”。本次随着Qwen3的发布,这款新模型通过在性能指标和成本方面超越DeepSeek R1,以及创新的混合推理模式,登顶为全球最强大的开源大模型,又为Qwen增添了一张好牌。

但在这之后,还有更多的挑战等待着它。接下来DeepSeek R2的亮相,也将为整个市场增添新的变数。在贯彻“第一通吃(winner-takes-all)”定律的开源市场,竞争远未到达终局、谁能成为最终的“winner”还充满未知,无论是DeepSeek,还是Qwen和Llama,都仍需要为不下牌桌而持续努力。不过值得欣慰的是,虽然战程未半,至少当下的开源大模型“桂冠”仍归属于国产玩家。

记者 董温淑 编辑 高宇雷

本文由人人都是产品经理作者【电厂】,微信公众号:【电厂】,原创/授权 发布于人人都是产品经理,未经许可,禁止转载。

题图来自阿里巴巴官网