惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

Google DeepMind News
Google DeepMind News
MongoDB | Blog
MongoDB | Blog
有赞技术团队
有赞技术团队
让小产品的独立变现更简单 - ezindie.com
让小产品的独立变现更简单 - ezindie.com
人人都是产品经理
人人都是产品经理
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
B
Blog RSS Feed
T
Tor Project blog
T
Threat Research - Cisco Blogs
Microsoft Azure Blog
Microsoft Azure Blog
M
MIT News - Artificial intelligence
V
Vulnerabilities – Threatpost
Project Zero
Project Zero
C
CXSECURITY Database RSS Feed - CXSecurity.com
The Register - Security
The Register - Security
Latest news
Latest news
cs.CL updates on arXiv.org
cs.CL updates on arXiv.org
The Hacker News
The Hacker News
Google DeepMind News
Google DeepMind News
L
LINUX DO - 最新话题
U
Unit 42
Cyber Security Advisories - MS-ISAC
Cyber Security Advisories - MS-ISAC
博客园 - 司徒正美
T
Tenable Blog
H
Hacker News: Front Page
B
Blog
宝玉的分享
宝玉的分享
C
Check Point Blog
美团技术团队
cs.CV updates on arXiv.org
cs.CV updates on arXiv.org
C
CERT Recently Published Vulnerability Notes
P
Proofpoint News Feed
The GitHub Blog
The GitHub Blog
G
GRAHAM CLULEY
Google Online Security Blog
Google Online Security Blog
Security Archives - TechRepublic
Security Archives - TechRepublic
P
Proofpoint News Feed
GbyAI
GbyAI
酷 壳 – CoolShell
酷 壳 – CoolShell
Hugging Face - Blog
Hugging Face - Blog
Y
Y Combinator Blog
D
Darknet – Hacking Tools, Hacker News & Cyber Security
Hacker News - Newest:
Hacker News - Newest: "LLM"
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
Scott Helme
Scott Helme
L
Lohrmann on Cybersecurity
量子位
A
About on SuperTechFans
V2EX - 技术
V2EX - 技术
T
The Exploit Database - CXSecurity.com

人人都是产品经理

为什么你的产品找不到差异化?90%的失败都卡在第一步上(下) – 人人都是产品经理, 3年从30万到1300万用户、获2200万美元融资,这个AI教育产品用“抽卡”破解了获客难题 – 人人都是产品经理, 园区招商系统怎么做才能真正帮到去化?我加了这一个功能,推广链接转发400次阅读过万 – 人人都是产品经理, AI大事件:OpenAI发完网络安全模型又搞药物研发,小鹏汽车要抓”DeepSeek时刻” – 人人都是产品经理, 电商不是卖货,是一场更残酷的产品经理实战 – 人人都是产品经理, 没想到,活动营销又回来了! – 人人都是产品经理, 为何All-in海外KOC:一场关于AI时代窗口期的豪赌 – 人人都是产品经理, 重新理解企业的内部协作 – 人人都是产品经理, 苹果的 AI 战略到底是什么? – 人人都是产品经理, 医疗智能体·第2讲——合规护城河:等保、PIPL与HIPAA的架构实战 – 人人都是产品经理, 向量知识库五步法:从“答非所问”到“精准回复” – 人人都是产品经理, 鸿蒙PC三方库构建总指挥HPKBUILD(sha)库为例 – 人人都是产品经理, 何时该用LLM?AI产品经理的LLM设计指南 – 人人都是产品经理, 医疗信息领域的需求方、决策方、准入方以及关注点(二) – 人人都是产品经理, 即梦涨价:一场被误读的「傲慢」 – 人人都是产品经理, 面试AI PM必答题:Hermes和OpenClaw的区别,如何讲清楚业务价值 – 人人都是产品经理, AI的下一张船票:世界模型——AI产品经理必须理解的技术拐点 – 人人都是产品经理, 小红书做GEO,怎么让AI信你?记住这 3 个重要信息 – 人人都是产品经理, 5 家印度 AI 初创公司,看看印度 AI 再做什么 – 人人都是产品经理, AI项目跨团队协作:产品技术业务如何不打架 – 人人都是产品经理, Agentic Workflow(智能体工作流):让AI从”答案生成器”变成”数字员工” – 人人都是产品经理, lycium_plusplus 项目全景解读:OpenHarmony 三方库构建的“大管家” – 人人都是产品经理, 从爆单救火到前置履约:两套预采策略,把生鲜大促履约效率拉满 – 人人都是产品经理, 什么时候该补货?我用一轮数据做了一个决定 – 人人都是产品经理, 从“机械兜底”到“动态分流”:AI客服重复进线治理的4大底层逻辑 – 人人都是产品经理, 抖音拼效率,红书拼洞察 – 人人都是产品经理, 全民狂欢与退潮——为什么龙虾这波热潮冷却得如此之快? – 人人都是产品经理, Stripe押注!MPP重塑全球支付 – 人人都是产品经理, 小红书GEO:AI引用你的内容,不是因为你对,而是因为你看起来可信 – 人人都是产品经理, 前百度副总裁押注办公Agent,日韩付费爆发,Manus迎来强劲对手 – 人人都是产品经理, 企事业单位数字化的业务供需本质 – 人人都是产品经理, 医疗智能体·第1讲——医疗信息化重构:从“辅助软件”到“自主智能体”的范式转移 – 人人都是产品经理, 粉丝量就是空气!!! – 人人都是产品经理, 用户说“薯片碎了”,机器回“要买吗?”:意图识别的翻车与破局 – 人人都是产品经理, RAG召回准确率从75到90 我做对了这三件事 – 人人都是产品经理, AI大事件:Anthropic改收费、OpenAI发安全版、手术机器人纳入医保、阿里发布”秒悟” – 人人都是产品经理, Chrome 推出 Skills 新功能,Agent 重塑上网方式 – 人人都是产品经理, GitHub前创始人拿了a16z的1700万美元,做Agent时代的Git – 人人都是产品经理 拷贝或克隆其他 Flutter OH 项目到本地后无法运行 – 人人都是产品经理, 优惠券设计:优惠券创建 – 人人都是产品经理, 不用死磕文档!AI 助手 1 小时搞定飞书 CLI 安装 + 配置 + 知识库 – 人人都是产品经理, 用小龙虾做竞品分析报告:从2天到20分钟,我是怎么做到的 – 人人都是产品经理 用小龙虾做市场分析报告:搞懂这3个公式,市场规模不再靠猜 – 人人都是产品经理, 你早就在做 Harness 工程,只是不知道它叫这个名字 – 人人都是产品经理, Think Long就够?你可能想多了! – 人人都是产品经理, 货代SRM实战:供应商准入怎么做,才能让资源池不是通讯录而是可交付网络? – 人人都是产品经理, 如何做好用户调研?详解基本技巧 – 人人都是产品经理, 木鸟、途家、美团对打,平台春天行动开“卷” – 人人都是产品经理, 入职才发现公司不靠谱?小红书从业者求职避坑指南 – 人人都是产品经理, 美国 AI 三巨头联手封堵,中国 AI 突围之路在何方 – 人人都是产品经理, 小红书,放在需求对面的镜子 – 人人都是产品经理, AI 会带来大规模失业吗? – 人人都是产品经理, 从出单到补货前,我第一次犹豫:该不该放大? – 人人都是产品经理, Flutter 三方库鸿蒙化适配:5 种高效检查方式,快速判断是否需要适配 – 人人都是产品经理, 从做产品进阶拿结果:医美机构产品经理转岗科室运营经理 – 人人都是产品经理, 阿里HappyHorse,一场关于“Token经济”的阳谋 – 人人都是产品经理, To B AI:客户留存落地的观察与思考 – 人人都是产品经理, AI产品的“生命线”——数据采集、标注、清洗的产品化设计 – 人人都是产品经理, 谈谈AI Agent(二):当“孩子”能自己“体验世界”时,你该学什么? – 人人都是产品经理, UI/UX设计师的3层能力进阶,前两层让你活下来,第三层…才是真正的分水岭 – 人人都是产品经理, 2分钟 → 30秒,效率提升75%:B端产品经理如何用「规则枷锁」驯服AI幻觉? – 人人都是产品经理, 还没来得及学OpenClaw,来了个更猛的:Hermes Agent – 人人都是产品经理, AI日报:宇树机器人跑出10m/s刷新世界纪录 – 人人都是产品经理, 一文说透基金互金如何用情绪价值引导用户决策做转化 – 人人都是产品经理, 当浏览器开始替你”看”网页:AI 浏览器正在亲手拆掉它脚下的那张网 – 人人都是产品经理, 0代码,一天时间我Vibe Coding了个网站 – 人人都是产品经理, Hermes 和 OpenClaw 之争,Agent 的能力应该“装上去”还是“长出来”? – 人人都是产品经理 视频生成的“桌子”,字节Seedance 2掀完,阿里快乐马掀 – 人人都是产品经理, 从听不懂到完全信任:我的 Codex 深度产品体验 – 人人都是产品经理, 当虚拟偶像有了北京户口,与真人偶像还有什么区别? – 人人都是产品经理, 会说,远远比会做更重要 —— 对 SBTI 爆火现象的五层观察 – 人人都是产品经理, AI产品经理必看:当“搭环境”比“选模型”更重要,你的认知还在2024年吗? – 人人都是产品经理, 2026年AI产品商业化核心逻辑:从功能demo到规模化营收的3个必破卡点 – 人人都是产品经理, 京东围绕供应链,卷起裤腿下场的那些事儿 – 人人都是产品经理, SBTI一夜刷屏:它赢在了“太会说人话” – 人人都是产品经理, 折扣零售的真相:不是便宜,而是价值感! – 人人都是产品经理, 和甲方吵了一架,最后加钱做了——我学到的ToB产品经理生存法则 – 人人都是产品经理, 和几位小红书操盘手聊了8小时,干货全在这 – 人人都是产品经理, 智谱GLM-5.1登场,开源模型首超Opus4.6!!! – 人人都是产品经理 Anthropic收入凭什么反超OpenAI,终于有人把这事说清楚了 – 人人都是产品经理, 史上最有故事感的技术报告——Claude最强模型Mythos 7个极其精彩的细节 – 人人都是产品经理, 模型不是壁垒,Harness 也不是 – 人人都是产品经理, 抖音本地生活业务思考21 – 人人都是产品经理, Superpowers:145k Star的AI编码框架,到底是什么来头? Superpowers:145k Star的AI编码框架,到底是什么来头? – 人人都是产品经理, OpenAI 的路走错了,Anthropic Harness 解法启示:模型需要实践专科生 – 人人都是产品经理, 画原型图的前一步:设计站点地图 – 人人都是产品经理, 给 DeepSeek 的最后一封催更信 – 人人都是产品经理, 手把手教你用 Claude Code 搭建 AI 营销团队:5 个 Agent、12 项技能,独立完成研究、写作、设计全流程 – 人人都是产品经理, 你以为大模型在学语言?不,它在重新发明语言学 – 人人都是产品经理 所谓Skill,不过是AI时代的工业垃圾 – 人人都是产品经理, 聊一聊内容传播的几个方法 – 人人都是产品经理, 当平台开始吃掉生态:从 OpenClaw 被封杀,读懂 Anthropic 的这盘棋 – 人人都是产品经理, 你装了 10 个 AI 插件,Obsidian 还是一个文件夹 – 人人都是产品经理 关于AI智能体架构演进的系统性思考:从单体试水到多体协同的重构 – 人人都是产品经理, 当“人”变成Skill,我们又该何去何从? – 人人都是产品经理 Mythos 事件:前沿 AI 治理的意外实验 – 人人都是产品经理, 货代CRM:信用与风险管理怎么做,才能把坏账风险拦在放货之前? – 人人都是产品经理, 从HR收集自拍照到员工自助录入——我见证了园区人脸识别从”不可用”到”真好用”的全过程 – 人人都是产品经理 千问闯关AI混沌期:阿里画靶,吴嘉张弓,马云射箭? – 人人都是产品经理,
别骂国产大模型了,老外们正用得不亦乐乎
硅星人 · 2026-06-24 · via 人人都是产品经理

当里约市政府发布的Rio 3.5开源模型被证实六成权重来自中国Nex-AGI、四成来自阿里Qwen时,全球AI圈再次见证了中国开源模型的渗透力。从日本乐天到Airbnb,从OpenCode到Notion,中国开源模型正以性价比和确定性改写开发者的工具链选择。本文通过套壳事件、商业应用与榜单评测的对比,揭示国产模型在海外崛起与国内争议的割裂现状。

前几天,海外 AI 圈被一个叫 Rio 3.5 的开源模型刷了屏。它来头不小,号称冲进全球开源第一梯队。可发布方却有点奇怪,是巴西里约热内卢市政府下属的一家 IT 公司。一个市政机构下场做大模型,本身就够反常。

可它偏偏栽在开源上。权重是公开的,谁都能下载下来比一比。国内一支叫 Nex-AGI 的团队比完就发现,Rio 根本不是新训出来的,六成权重就是 Nex-AGI 自己的开源模型 Nex-N2-Pro,另外四成来自阿里 Qwen,两个模型按固定比例合在一起,连重新训练都省了。最直接的证据是,把 Rio 出厂时写死的“你是 Rio”那句提示删掉,再问它“你是谁”,它有近八成的概率说自己叫 Nex,认领“Rio”这个名字的次数是零。里约随后致歉,说传错了版本。

Rio 不是头一个。今年早些时候,日本乐天那个拿了政府补贴、号称日本最强的 Rakuten AI,也被扒出底子是 DeepSeek。

这几件事性质并不完全一样。Rio 几乎没自己训练,是彻头彻尾的套壳冒充,乐天则在开源底座上确实做了不少自己的活,只是一开始没提来源,被扒出来才承认。连起来看就明白了,一个团队想用最低的成本、最快的速度做出一个能打的模型,今天第一个想到的底座,已经是中国的开源模型。

套壳被抓只是最扎眼的一种,更多时候,海外开发者是在大大方方地选用中国开源模型。比如 GLM 5.2 最近在海外讨论不少,类似的还有很多。可同样这批模型,回到国内是另一番光景,哪怕点开一个跟国模毫不相干的帖子,也常蹦出一句没头没尾的差评,“国模 coding plan 吃相难看,国产模型四大罪”,几乎是张口就来,这才是奇怪的地方。

01 不是所有产品都需要 SOTA

谈论模型的人,大致分两类,两者大多数时候不在一个语境。

一种盯着榜单。他们看的是能力上限,谁又在某个基准上多了一两分,谁是新的 SOTA。媒体的标题、发布会上的成绩对比图,都是冲这群人来的。

另一种把模型拿去做东西。他们算的是另一套账,手头这个任务到底需不需要最强的模型,多出来的那点能力值不值多花几倍的成本,模型能不能下载下来自己跑、或者换个便宜的托管商,万一供应商哪天涨价、限流,甚至自己下场做了同款产品,我手里还剩什么。

最近一份评测正好能说明这件事。Artificial Analysis 把自己的智能指数改了版,砍掉一些偏简单的题目,加进了模拟客服对话这类要模型自己规划、调用工具才能完成的复杂任务,还第一次把完成单个任务要花多少钱、需要多久,作为独立指标列了出来。

榜单最高分给了 Claude Fable 5,但它已被美国政府管制下线,买都买不到。市面上能买到的最强是 Claude Opus 4.8,56 分。开源模型里,MiniMax 的 M3 排到第一,44 分;DeepSeek V4 Pro 同样 44 分。可跑同一个任务,Opus 要花 1.78 美元,M3 只要 0.18 美元,差不多是它的十分之一。

对盯榜单的人,差这十几分,就是第一梯队和第二梯队的区别。对做产品的人,问题变成了,这十几分,值不值几十倍的成本。

很多任务的答案是不值。客服、分类、信息抽取、搜索改写自不必说,连写代码、跑 agent 这种硬场景,差距也常常没大到非最强不可。有开发者在 OpenCode 上实测后就说,M3 做代码审查又快又好,还挑出了连 GPT 都没报的问题,写出来的代码也够用,只是遇上大型代码库,比别的模型更得有人盯着引导。把全部身家押在“最强比次强多那一点”上的产品,很可能在模型下一次升级、把那点能力白送出去之后,立刻没了存在的理由。

02 把模型握在自己手里

性价比是第一眼就能看到的好处,但光便宜还留不住人。留人的是确定性:模型在自己手里,能部署、能改、能换,明年还是这个样子。

闭源 API 则不然。供应商随时可能涨价、限流,甚至自己下场做同款、回头跟你抢生意。Windsurf 就吃过这个亏,Anthropic 一边自己做 Claude Code,又限制了它对 Claude 模型的直连访问,这是命门握在别人手里。把核心能力架在别人的接口上,主动权从来不在自己手上。开源模型你能自己部署自己跑,也能挑个便宜的托管商,不必被某一家 API 的定价和脸色绑死。便宜、开放、够用,这对闭源模型来说几乎是不可能三角。

开源模型能被真正用起来,靠的也不只是便宜。Airbnb 的 CEO 就公开讲过,公司大量用中国开源模型 跑客服 Agent,图的就是又好又快又便宜。类似的选择也开始出现在更多产品和开发者工具里,从 Notion 的 Custom Agents,到开源编程平台 OpenCode,开源模型的热度没有只停在发布当天,很快转化成了调用量。OpenCode 的模型调用量排前二的分别是 DeepSeek 和 Minimax。平台还专门给 M3 延了限时三倍额度,OpenCode 联合创始人 Jay V 也发帖说它“涨得出奇地好”。

03 开源模型主要来自中国

开发者越来越多地用中国开源,还有一个常被忽略的原因,能挑的开源模型本来就在变少。

美国不是没有开源模型。OpenAI 去年发过一次 gpt-oss,是它六年来第一次开放权重,口碑也不错;Google 的 Gemma 一路更新,多个尺寸、单卡能跑,但几家最前沿的实验室,重心都在闭源那头。Anthropic 根本不做开放权重,OpenAI 那次之后再没下文,曾被寄予厚望的法国 Mistral 也渐渐掉出了第一梯队。

Meta 一度是开源大模型的旗手,一个 Llama 撑起过大半个开源生态;可如今它号称两万亿参数的旗舰 Behemoth 迟迟没公开,反手发布了自己第一个闭源前沿模型。连曾经最大的开源玩家都掉头做闭源了。

数下来,美国还在持续做开放权重的,主要就剩 Google 的 Gemma。但 Gemma 最大也就 270 亿参数,胜在小、能单卡跑,真正前沿规模、在写代码和 agent 上拿得出手的开源模型,还得看中国这几家。Qwen、DeepSeek、GLM、MiniMax 一年到头密集更新,从小到大的尺寸、各种任务和模态都铺得很满,不久前还出现过三周内四家中国实验室连发四个开放编程模型的名场面。

追踪开源模型动向的 ATOM 项目算过,从 23 年年末开始的两年时间里,全球新增的开源衍生模型中基于 Qwen 的占了约七成,Llama 则从两年前四成多的高点跌到了一成。项目发起人、AI 研究者 Nathan Lambert 在报告里说,美国在开源模型上已经丢了领先,性能和采用率都落了后。换句话说,美国还握着最强的那几个模型,只是都锁在闭源里;开放、能随便拿来用的那一大批,如今主要来自中国。

除了高频发布,使用量也在增长。在 OpenRouter 这类第三方调用平台上,周用量榜的前几名几乎被中国模型包揽,DeepSeek、MiniMax M3、腾讯混元等排在最前面,靠前的美国模型反倒多是闭源的 Claude。调用平台之外,中国开源模型也越来越多地进入海外开发者的工具链,DeepSeek 已经是 Fireworks、Together、Ollama 这些海外推理平台的常驻选项,M3 上线后也很快铺了上去,还被 Nous Research 的开源 agent 框架 Hermes Agent 接入。后者还专门做了 MiniMax 的官方适配,并公开称会和 MiniMax 在产品和模型上合作,让后续发布更适合 Hermes Agent 用户。

04 国内开发者到底在骂什么

回到国内,其实用得一点不少,不少团队就拿 Qwen、DeepSeek、MiniMax 当底座做产品。可一到公开讨论,吐槽的声音往往更响。

这个月初发布的 MiniMax M3,就是最典型的一例。海外这边的成绩前面提过,它在 AA 的那份榜单上排到了开源模型第一;Vercel 的 CEO 还在 X 上公开发帖,说在自家 agent 评测里 M3 紧随 Opus、GPT-5,却便宜十倍。Vercel 是 Next.js 背后、全球最大的前端部署平台之一。

MiniMax 是国产模型里全球化走得比较早的一个,去年七成以上的收入来自海外,海外开发者买账不新鲜。但差不多同一时间,国内社区吵翻的全是套餐怎么算,几乎没人在谈 M3 强不强。MiniMax 改了计费方式,老用户嫌权益缩水闹着退款,最后道歉、补偿了事。关于价格的争执,几乎盖过了对模型本身的讨论。

GLM 此前也经历过类似风波。新套餐上线后,用户抱怨模型放量慢、规则不透明、老用户升级机制不合理,智谱最后公开致歉并提供退款和补偿。模型能力、产品体验和收费方式原本是三个层面,到了用户那里,往往会合并成对同一个品牌的整体评价。

而国内讨论国产模型,还有两层海外没有的额外要求。一层是把它当成中国 AI 有没有原创突破的标尺,好不好用之外,还要追问它是不是蒸馏、有没有跟着别人跑;另一层是动不动拿它跟 Claude、GPT 的上限直接比,问它为什么还不是最强。两种预期加在一起,模型有多少人在用、好不好用反倒不是重点了。

国内对国产模型的关注,也常常慢一拍。DeepSeek 就是这样,真正让它彻底出圈的,是它先在美国冲上 App Store 榜首,并引发全球资本市场对 AI 成本的重新估算。海外先用起来、先讨论起来,国内才回头重新打量,这样的情况并不少见。

国产模型撑起了全球大半个开源生态,被海外公司拿去做底座,被第三方评测给到开放权重的最高分;可回到国内,被念叨最多的却是套餐价格。同样一份成绩单,贴上硅谷的牌子,待遇大概是另一个样子。DeepSeek 已经证明过一次,可以先在海外被认真使用,再倒逼国内重新看见它,类似的事情会在更多中国开源模型身上重演。

作者|周一笑

本文由人人都是产品经理作者【硅星人】,微信公众号:【硅星人Pro】,原创/授权 发布于人人都是产品经理,未经许可,禁止转载。

题图来自Unsplash,基于 CC0 协议。