惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

Blog — PlanetScale
Blog — PlanetScale
Vercel News
Vercel News
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
量子位
Y
Y Combinator Blog
IT之家
IT之家
博客园 - 聂微东
L
LangChain Blog
爱范儿
爱范儿
H
Help Net Security
GbyAI
GbyAI
F
Fortinet All Blogs
B
Blog
Microsoft Security Blog
Microsoft Security Blog
罗磊的独立博客
C
Check Point Blog
博客园 - 三生石上(FineUI控件)
小众软件
小众软件
D
DataBreaches.Net
Last Week in AI
Last Week in AI
WordPress大学
WordPress大学
B
Blog RSS Feed
酷 壳 – CoolShell
酷 壳 – CoolShell
宝玉的分享
宝玉的分享

人人都是产品经理

为什么你的产品找不到差异化?90%的失败都卡在第一步上(下) – 人人都是产品经理, 3年从30万到1300万用户、获2200万美元融资,这个AI教育产品用“抽卡”破解了获客难题 – 人人都是产品经理, 园区招商系统怎么做才能真正帮到去化?我加了这一个功能,推广链接转发400次阅读过万 – 人人都是产品经理, AI大事件:OpenAI发完网络安全模型又搞药物研发,小鹏汽车要抓”DeepSeek时刻” – 人人都是产品经理, 电商不是卖货,是一场更残酷的产品经理实战 – 人人都是产品经理, 没想到,活动营销又回来了! – 人人都是产品经理, 为何All-in海外KOC:一场关于AI时代窗口期的豪赌 – 人人都是产品经理, 重新理解企业的内部协作 – 人人都是产品经理, 苹果的 AI 战略到底是什么? – 人人都是产品经理, 医疗智能体·第2讲——合规护城河:等保、PIPL与HIPAA的架构实战 – 人人都是产品经理, 向量知识库五步法:从“答非所问”到“精准回复” – 人人都是产品经理, 鸿蒙PC三方库构建总指挥HPKBUILD(sha)库为例 – 人人都是产品经理, 何时该用LLM?AI产品经理的LLM设计指南 – 人人都是产品经理, 医疗信息领域的需求方、决策方、准入方以及关注点(二) – 人人都是产品经理, 即梦涨价:一场被误读的「傲慢」 – 人人都是产品经理, 面试AI PM必答题:Hermes和OpenClaw的区别,如何讲清楚业务价值 – 人人都是产品经理, AI的下一张船票:世界模型——AI产品经理必须理解的技术拐点 – 人人都是产品经理, 小红书做GEO,怎么让AI信你?记住这 3 个重要信息 – 人人都是产品经理, 5 家印度 AI 初创公司,看看印度 AI 再做什么 – 人人都是产品经理, AI项目跨团队协作:产品技术业务如何不打架 – 人人都是产品经理, Agentic Workflow(智能体工作流):让AI从”答案生成器”变成”数字员工” – 人人都是产品经理, lycium_plusplus 项目全景解读:OpenHarmony 三方库构建的“大管家” – 人人都是产品经理, 从爆单救火到前置履约:两套预采策略,把生鲜大促履约效率拉满 – 人人都是产品经理, 什么时候该补货?我用一轮数据做了一个决定 – 人人都是产品经理, 从“机械兜底”到“动态分流”:AI客服重复进线治理的4大底层逻辑 – 人人都是产品经理, 抖音拼效率,红书拼洞察 – 人人都是产品经理, 全民狂欢与退潮——为什么龙虾这波热潮冷却得如此之快? – 人人都是产品经理, Stripe押注!MPP重塑全球支付 – 人人都是产品经理, 小红书GEO:AI引用你的内容,不是因为你对,而是因为你看起来可信 – 人人都是产品经理, 前百度副总裁押注办公Agent,日韩付费爆发,Manus迎来强劲对手 – 人人都是产品经理,
8 个月建起的 AGI 实验室:蚂蚁集团旗下的 Inclusion AI
张艾拉 · 2025-12-09 · via 人人都是产品经理

从DeepSeek时刻到快速崛起,Inclusion AI团队在短短八个月内成功打造了三代先进模型。他们不仅注重模型的性能提升,更重视构建长期的技术能力和开源生态。深入了解这个团队的创新之路,探寻AI未来的无限可能。

最近看了一个对Inclusion AI团队的访谈播客,很多人并不了解这支团队,所以有了这篇文章,简单介绍下。

值得一提的是,这个团队从决定做到真正发布高质量模型,只用了八个月

这篇文章的内容主要来自播客。

01 实验室成立的初衷:“DeepSeek 时刻”是一条真正的起跑线

Inclusion AI团队把他们的起点,明确指向了一个时间点:2025年2月。

几乎所有团队成员都承认,真正促使中国大模型行业集体加速的事件,是DeepSeek 的出现

团队负责人用“航海时代”打比方非常生动:

2024 年的全球 AI 世界,就像 14 世纪的欧洲,第一批船队试探着驶入未知的海域。

当 DeepSeek 这艘中国船成功返航时,国内的工程师深刻的意识到,这场航行不再是别人的故事。

Inclusion AI 就是在这个节点上,被蚂蚁集团正式拉到台前。

不是一个项目,而是一个实验室。

不是小范围试水,而是集团 CTO 牵头的重点方向。

不是“看看能不能做”,而是“必须把这件事做好”。

02 Inclusion AI 的定位,不是“做一个模型”,而是“建一个长期能力”

蚂蚁集团的业务横跨支付、保险、医疗、技术服务,未来所有业务都会依赖 AI。

所以 Inclusion AI 做的,不是配合业务的工具模型,而是构建整个集团未来十年的底层能力:

  • 自研基础语言模型
  • 多模态能力
  • 推理与强化学习能力
  • 自己的缩放定律(Scaling Law)
  • 完整的训练与系统优化能力
  • 自主可控的开源生态

换句话说,他们不是在训练一个模型,而是在训练“写模型的能力”。

03 8 个月升级三代模型:不是堆资源,而是体系化生产

访谈把他们的模型体系讲得很清晰。八个月内,他们完成了:

  • Ling:基础语言模型(从 1.0 → 1.5 → 2.0)
  • Ming:多模态模型
  • Ring:强化学习与推理方向
  • Diffusion Language Model:探索长序列与低成本生成

这个节奏看起来几乎不可能。但团队负责人表示:他们不是在“赶进度”,而是按计划在“造体系”。

模型不是孤立制作,而是串联的:

Ling → 打基础 Ming → 视觉能力升级 Ring → 推理能力拔高 Diffusion LM → 探索新的训练范式

这和现在很多公司“一窝蜂堆大模型,堆完再想用途”非常不同。

Inclusion AI 是在按“模型家族”建设,而不是用一个模型撑全局。

04 Inclusion AI 实验室的技术成熟度

1. 他们有自己的 scaling law,而不是复刻别人

他们确实参考了 OpenAI、DeepSeek 的 scaling law,但又做了自己的体系:

  • 大模型关键超参与 MOE 结构并不强耦合
  • 激活比例对模型效果影响极大
  • 在不同架构下保持训练稳定性

简单来说,他们不是“用别人提供的配方做饭”,而是“自己已经能写配方”。

2. FP8 训练的问题,他们不是绕过去,而是解决它

他们直接说:

  • 直接用别人的 FP8 方案,性能不提高,甚至更慢
  • 最大瓶颈是 quantize/dequantize(量化/去量化)
  • 于是他们重新改写了 MoE 层,把 gating 和量化操作融合,才真正提速

这是典型的系统工程能力:问题来了不是换路线,而是把问题拆开、测量、解决。

3. 训练不是一次性拉满,而是有“能力节奏”的爬升

从小规模 → 中规模 → 数百亿 → 数千亿参数,按阶梯推进,每一阶段验证:

稳定性、训练流量、系统瓶颈、内部工具链、数据处理方式等。

最后,未来竞争的关键不再是谁模型更大,而是谁能更快训练、更稳迭代、更强工程能力、更清晰方向、更持久投入。

以上,祝你今天开心。

作者:张艾拉 公众号:Fun AI Everyday

本文由 @张艾拉 原创发布于人人都是产品经理。未经作者许可,禁止转载

题图来自作者提供