惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

月光博客
月光博客
IT之家
IT之家
Hugging Face - Blog
Hugging Face - Blog
J
Java Code Geeks
让小产品的独立变现更简单 - ezindie.com
让小产品的独立变现更简单 - ezindie.com
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
博客园 - 叶小钗
MyScale Blog
MyScale Blog
G
Google Developers Blog
Microsoft Azure Blog
Microsoft Azure Blog
freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More
大猫的无限游戏
大猫的无限游戏
博客园 - 三生石上(FineUI控件)
Google DeepMind News
Google DeepMind News
Engineering at Meta
Engineering at Meta
The Cloudflare Blog
Martin Fowler
Martin Fowler
酷 壳 – CoolShell
酷 壳 – CoolShell
N
Netflix TechBlog - Medium
MongoDB | Blog
MongoDB | Blog
I
InfoQ
WordPress大学
WordPress大学
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
H
Help Net Security

人人都是产品经理

为什么你的产品找不到差异化?90%的失败都卡在第一步上(下) – 人人都是产品经理, 3年从30万到1300万用户、获2200万美元融资,这个AI教育产品用“抽卡”破解了获客难题 – 人人都是产品经理, 园区招商系统怎么做才能真正帮到去化?我加了这一个功能,推广链接转发400次阅读过万 – 人人都是产品经理, AI大事件:OpenAI发完网络安全模型又搞药物研发,小鹏汽车要抓”DeepSeek时刻” – 人人都是产品经理, 电商不是卖货,是一场更残酷的产品经理实战 – 人人都是产品经理, 没想到,活动营销又回来了! – 人人都是产品经理, 为何All-in海外KOC:一场关于AI时代窗口期的豪赌 – 人人都是产品经理, 重新理解企业的内部协作 – 人人都是产品经理, 苹果的 AI 战略到底是什么? – 人人都是产品经理, 医疗智能体·第2讲——合规护城河:等保、PIPL与HIPAA的架构实战 – 人人都是产品经理, 向量知识库五步法:从“答非所问”到“精准回复” – 人人都是产品经理, 鸿蒙PC三方库构建总指挥HPKBUILD(sha)库为例 – 人人都是产品经理, 何时该用LLM?AI产品经理的LLM设计指南 – 人人都是产品经理, 医疗信息领域的需求方、决策方、准入方以及关注点(二) – 人人都是产品经理, 即梦涨价:一场被误读的「傲慢」 – 人人都是产品经理, 面试AI PM必答题:Hermes和OpenClaw的区别,如何讲清楚业务价值 – 人人都是产品经理, AI的下一张船票:世界模型——AI产品经理必须理解的技术拐点 – 人人都是产品经理, 小红书做GEO,怎么让AI信你?记住这 3 个重要信息 – 人人都是产品经理, 5 家印度 AI 初创公司,看看印度 AI 再做什么 – 人人都是产品经理, AI项目跨团队协作:产品技术业务如何不打架 – 人人都是产品经理, Agentic Workflow(智能体工作流):让AI从”答案生成器”变成”数字员工” – 人人都是产品经理, lycium_plusplus 项目全景解读:OpenHarmony 三方库构建的“大管家” – 人人都是产品经理, 从爆单救火到前置履约:两套预采策略,把生鲜大促履约效率拉满 – 人人都是产品经理, 什么时候该补货?我用一轮数据做了一个决定 – 人人都是产品经理, 从“机械兜底”到“动态分流”:AI客服重复进线治理的4大底层逻辑 – 人人都是产品经理, 抖音拼效率,红书拼洞察 – 人人都是产品经理, 全民狂欢与退潮——为什么龙虾这波热潮冷却得如此之快? – 人人都是产品经理, Stripe押注!MPP重塑全球支付 – 人人都是产品经理, 小红书GEO:AI引用你的内容,不是因为你对,而是因为你看起来可信 – 人人都是产品经理, 前百度副总裁押注办公Agent,日韩付费爆发,Manus迎来强劲对手 – 人人都是产品经理,
Qwen3.7-Max来了:一个拼命干活的AI – 人人都是产品经理,
小蝶的 AI 笔记 · 2026-05-22 · via 人人都是产品经理

昨天阿里在云峰会上发布了Qwen3.7-Max,国产模型盲测第一,编程和推理评测超过了Claude Opus 4.6。我从B端做了6年产品,最近这1年转做AI方向,一直在跟各种模型打交道。这次我看得比较仔细——不是因为名次,而是它让我想清楚了一件一直没说透的事:Qwen和Claude其实是两种完全不同的人,你得分开用。

一、让我多看几眼的不是名次

5月20日阿里云峰会,Qwen3.7-Max正式发布。

Arena全球大模型盲测总榜,它拿了国产第一,把Kimi、DeepSeek、GLM这些都压下去了。全球来看,Claude、GPT、Gemini这些还排在前面,但差距已经在肉眼可见地缩小。

但这个名次不是让我停下来多读两遍的原因,让我停下来的是这件事:他们让Qwen3.7-Max在一块它训练时从没见过的全新芯片上,从空白工作区开始,自己写代码、自己调试、自己跑性能分析。没有任何文档,没有任何示例,没有人插手。他自己就跑了35小时。调用工具超过1000次。最终把推理速度提升了10倍。

我第一反应是:天呐,这太牛了!

二、官方说了三件事,我翻译一下

发布会上给了一堆评测数字,看完很容易脑子发懵。我挑几个跟日常用得上的说说。

最值得关注的是长任务能力。

以前用AI做稍微复杂一点的事,走着走着它就散了——要么开始说废话,要么绕回头重复之前说过的。这次Qwen3.7-Max专门在这里下了功夫。那个35小时、1000次工具调用的实验,就是在证明它能保持连贯,不会跑着跑着就垮。

打个不严谨的比方:以前的AI像外卖小哥,接一单跑一单,叫它做两步以上的事就容易出错。现在更像能独立跟进整个项目的人——你交代完,它自己跑完。

推理方面也有提升,会先把问题拆开再给答案,而且还会自己不断复盘,幻觉少了一些。在几个高难度推理测试上已经超过了Claude Opus 4.6,用过的人应该能感觉到差别。

编程据说很强,SWE-Pro这些评测排第一。但我不是技术背景,这块没法帮你验证,有经验的朋友们可以自己跑一遍再判断。

(顺便一提——每次大模型发布都会附上一堆评测截图,数字好看不代表用起来好用。后面我会说这个)

三、从Qwen之前的版本用下来,感觉它们是两种人

Qwen3.7-Max像个执行力很强的项目经理

你给它一个目标,它自己拆、自己规划、自己调工具、最后交付结果。你说”帮我做完这件事”,它就去做了,中间不需要你太多干预。如果你知道要什么结果的时候,交给它最省事。让它联网查资料、整理成报告、生成带结构的文档,扔进去基本能出来。

但它有个小毛病:爱自作主张。你没说清楚某个细节,它不问你,自己判断了就往前走。走偏了你得回头改,有时候比自己做还费事。

Claude更像个严谨的分析师,但有时候有点啰嗦

它不急着交付,更像在陪你把问题本身想清楚。你越跟它来回推,它给的东西越准。

遇到模糊的需求或者还没想透的问题,我基本先跟Claude对话。不是问它答案,是跟它一起把问题理清楚。但你要它快速出东西,等起来真的有点急。

两个我都在用,但用的场合不一样。要我选的话:想清楚问题找Claude,想把事情做完找Qwen。

四、最近身边用得最多的场景:面试前搞懂一个新行业

我认识几个最近在跳槽的朋友,面试前最头疼的一件事:要去一家完全不熟悉的公司,行业不懂、业务不懂,怎么在两三天内准备出来?

以前的办法是搜文章、找研报、拼凑个大概印象,费时间还零散。但是现在可以直接让Qwen3.7-Max来做这件事。

比如你要去一家做人形机器人的公司面试,直接告诉它:”我要去机器人公司面试,帮我搞懂这个赛道,市场规模、主要玩家、各家技术路线差在哪、近半年有什么重要动态,最后出一份带图表的分析报告。”

它自己去联网搜,自己读研报,自己整理,最后给你一份至少有框架在那的东西。你不用盯着,交给它跑就行。我认识一个做猎头的朋友就在这么用。她说以前帮候选人做行业速览要花半天,现在两三小时能出一份能用的东西。

但这份报告只是起点,拿到之后建议第二步换Claude:把报告粘进去,问它”这里面哪些判断站不住脚”、”我是B端产品经理背景,面试这家公司应该重点准备什么”。跟Claude来回推几轮,比单纯看报告理解深很多。

推荐大家两个配合着用,比只用一个强。

五、说一句可能不讨喜的话

国产第一这个标签很好看,但我自己每次看到这种新闻都会多想一步。

在编程和推理评测上超过Claude Opus 4.6,不代表你拿它做所有事都比Claude强。评测是特定任务、特定条件下跑出来的,和你每天实际用的场景差着一段距离。

还有一件事我观察了一段时间:模型排名一两个月就换一次,你刚熟悉一个工具,新的又出来了。但真正拉开差距的,不是你用的是哪个模型,是你有没有把需求说清楚,有没有一套自己用顺了的习惯。

追新模型这件事我现在做得越来越少了。

六、几个我还没想清楚的问题

昨天看完发布会,我一直在想一件事:Qwen这次不只是评测分更高,是它能干的活变了——以前AI是回答问题的,现在开始变成执行任务的。

我不知道这对做产品的人来说算好事还是坏事。

所以把几个问题扔给你:

  • 你工作里有哪些每次都在重复的事,但从来没想过能交给AI?
  • 你现在用AI,是更多在让它帮你”想清楚”,还是”做出来”?
  • 如果一个AI能帮你扛35小时的连续任务,你最想让它干什么?

我也不一定对,欢迎评论区沟通。

本文由人人都是产品经理作者【小蝶】原创/授权 发布于人人都是产品经理,未经许可,禁止转载。

题图来自Unsplash,基于 CC0 协议。