惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

D
Docker
小众软件
小众软件
让小产品的独立变现更简单 - ezindie.com
让小产品的独立变现更简单 - ezindie.com
freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
酷 壳 – CoolShell
酷 壳 – CoolShell
Apple Machine Learning Research
Apple Machine Learning Research
月光博客
月光博客
人人都是产品经理
人人都是产品经理
大猫的无限游戏
大猫的无限游戏
V
V2EX
阮一峰的网络日志
阮一峰的网络日志
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
博客园 - Franky
WordPress大学
WordPress大学
有赞技术团队
有赞技术团队
Hugging Face - Blog
Hugging Face - Blog
Jina AI
Jina AI
博客园 - 聂微东
S
SegmentFault 最新的问题
量子位
宝玉的分享
宝玉的分享
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
博客园_首页

量子位

AI自主监测宠物健康,陪狗都不用自己来了!涂鸦Hey Tuya打造全屋智能“超级入口” 燃油SUV车主熬出头了!华为乾崑智驾加持,全新奥迪Q5L率先实现智能化 华人再破硅谷天花板!AI黑马新任CTO,中科大80后 0博士组合拿下ICLR时间检验奖!两个GPT天才本科生+二本逆袭LeCun弟子,十年论文终封神 DeepSeek V4报告太详尽了!484天换代之路全公开 优必选发布Thinker cosmos:加码开发者生态,推动人形机器人走向规模化 DeepSeek-V4发布,华为云首发适配 Mobileye 2026财年一季度营收增长27%,自动驾驶商业化进程持续推进 100%主流车企的共同选择:一个AI“通用底座”正在汽车行业成型 真有人做AI小猫啊?!生产力和情绪价值都拉满了 Coordination Engineering关键一环,JiuwenClaw再发布Team Skills技能新范式 DeepSeek V4终于发布!打破最强闭源垄断,明确携手华为芯片 荣耀WIN游戏本等多款新品正式发布,荣耀PC家族全面爆发 刚刚,GPT-5.5发布!内测英伟达工程师:失去它像被截肢 河南师傅,左手扳手,右手飞书,竟然能搞数据分析! 国内首家百亿估值纯推理GPU独角兽诞生!专访曦望联席CEO王湛:谁的推理成本更低谁就是赢家 印奇站上AI+车浪潮之巅:7个月,千里科技和华为「五五开」 飞书项目开放平台焕新升级,全面迈向“AI Friendly” 半壁华人!GPT Image 2团队曝光:无锡才俊带队,13人4个月封神 Nature封面:机器人乒乓球干翻人类职业选手 特斯拉开源硬件,中国公司回应来了:直接把机器人大脑开源了 挖漏洞何必Mythos,国产智能体早跑通了 “不造车的特斯拉”亮出“舱驾一体”全家桶,汽车长出“主动理解力”,奇瑞比亚迪等10+巨头力挺 科大讯飞发布燎原N30m笔记本,重塑全栈国产AIPC新标杆 神秘模型「大象」:仅100B拿下SOTA,Token效率超高! 香港科创标杆奖项!商汤首席科学家林达华荣获中银香港科创奖 国产多模态Agent拿下医学分割SOTA!不用改模型、不加token 这些人读个博一年能挣几十万?2026苹果学者名单公布了 大厂AI抢人大战,从实习生开始 全球首个世界统一模型发布,机器人家庭成员来了!
林俊旸果然创业了!一个“Qwen负责人”头衔值135亿
梦晨 · 2026-05-13 · via 量子位

< img id="wx_img" src="https://www.qbitai.com/wp-content/uploads/imgs/qbitai-logo-1.png" width="400" height="400">

2026-05-13 16:44:16 来源:量子位

对于一家还没发产品的中国AI初创公司而言,这一估值,几乎没有先例。但相比林俊旸之前同台竞速的硅谷同行,不算贵。

梦晨 发自 凹非寺
量子位 | 公众号 QbitAI

离职阿里后,千问大模型前负责人林俊旸的最新动态曝光了。

他的下一步,是创业

具体公司还不知道名字,但据说种子轮目标估值已经高达20亿美元(约135亿元人民币)。

根据The Information消息,高榕资本与红杉中国被曝就投资事宜与该实验室进行深入洽谈。

对于一家还没发产品的中国AI初创公司而言,这一估值,几乎没有先例。但相比林俊旸之前同台竞速的硅谷同行,不算贵

Qwen负责人,还是太有含金量了。

Qwen前负责人创业

林俊旸2019年加入阿里,早期研究方向集中在搜索、推荐场景下的自然语言处理和多模态建模。

2020年起,他开始投身大规模预训练模型研究与部署

此后,他深度参与M6等超大规模预训练模型工作。M6是阿里早期最有代表性的多模态大模型项目之一。

2022年以后,他转向通用大模型方向。

Qwen项目成立后,林俊旸成为技术负责人,带队打造Qwen系列大语言与多模态模型,并主导开源工作。

Qwen后来变成了阿里AI对外最清晰的技术名片之一。

它有不同尺寸的模型,有面向开发者的开源路线,也有持续更新的多模态、代码和轻量化模型版本。对开发者来说,Qwen是真正能下载、能微调、能部署、能二次开发的实用模型。

这也是他创业备受关注的底层原因。

那么,林俊旸下一步到底想做什么?

在有具体消息之前,还可以从他离职后发的一篇长文寻找线索。

首篇长文给出线索:Agentic Thinking

林俊旸离职后的首篇长文,标题为《From “Reasoning” Thinking to “Agentic” Thinking》。

这是他对过去一年模型竞争的复盘,也像是下一阶段创业方向的技术宣言。

他的判断可以压缩成一句话:

上一阶段的AI竞争,是让模型更会思考;下一阶段的竞争,是让模型为了行动而思考。

思考模型花更多推理算力,强化学习得到更稳定的反馈,数学、代码、逻辑等可验证任务成为核心训练场景。

但林俊旸认为,问题已经开始变了。

尤其是在代码和智能体工作流里,真正重要的是代码库导航、计划拆解、错误恢复、工具编排,以及长时间执行任务的质量。

这就引出全文核心概念:Agentic Thinking

林俊旸把它定义为一种“为了行动而思考”的能力。它不只是让模型在回答前想更久,而是让模型在环境里行动、观察反馈、修正计划,再继续推进。

推理浪潮的第一阶段确立了一件重要的事:

当反馈信号可靠且基础设施能够支撑时,语言模型之上的RL可以产出质的飞跃式的认知能力。

更深层的转变是从推理式思考到智能体式思考:

从想得更久,到为了行动而想。训练的核心对象已经改变了——它变成了模型+环境的系统,或者更具体地说,是智能体和围绕它的编排框架。

这改变了哪些研究要素最重要:

模型架构和训练数据当然仍然重要,但环境设计、轨迹采样基础设施、评估器鲁棒性、以及多智能体之间的协调接口同样关键。

这也改变了“好的思考”的定义:

最有用的轨迹,是能在真实世界约束下维持有效行动的那个——而非最长或最醒目的那个。

这也改变了竞争优势的来源:

在推理时代,优势来自更好的RL算法、更强的反馈信号和更可扩展的训练流水线。

在智能体时代,优势将来自更好的环境、更紧密的训练-推理耦合、更强的编排工程,以及在模型的决策与这些决策产生的后果之间实现闭环的能力。

One More Thing

自林俊旸发长文探讨Agentic Thinking后,个人社交媒体账号就没在发声。

不过转发了一条持续学习基准测试的消息。

难道与创业方向相关?

参考链接:
[1]
https://x.com/jingyanghk/status/2054450088400093359

版权所有,未经授权不得以任何形式转载及使用,违者必究。