惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

Google DeepMind News
Google DeepMind News
I
InfoQ
Engineering at Meta
Engineering at Meta
D
DataBreaches.Net
L
LangChain Blog
Cyber Security Advisories - MS-ISAC
Cyber Security Advisories - MS-ISAC
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
Recent Announcements
Recent Announcements
GbyAI
GbyAI
爱范儿
爱范儿
Microsoft Security Blog
Microsoft Security Blog
腾讯CDC
美团技术团队
罗磊的独立博客
Microsoft Azure Blog
Microsoft Azure Blog
WordPress大学
WordPress大学
T
The Blog of Author Tim Ferriss
freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More
雷峰网
雷峰网
M
MIT News - Artificial intelligence
D
Docker
MongoDB | Blog
MongoDB | Blog
F
Fortinet All Blogs
博客园 - 叶小钗

人人都是产品经理

为什么你的产品找不到差异化?90%的失败都卡在第一步上(下) – 人人都是产品经理, 3年从30万到1300万用户、获2200万美元融资,这个AI教育产品用“抽卡”破解了获客难题 – 人人都是产品经理, 园区招商系统怎么做才能真正帮到去化?我加了这一个功能,推广链接转发400次阅读过万 – 人人都是产品经理, AI大事件:OpenAI发完网络安全模型又搞药物研发,小鹏汽车要抓”DeepSeek时刻” – 人人都是产品经理, 电商不是卖货,是一场更残酷的产品经理实战 – 人人都是产品经理, 没想到,活动营销又回来了! – 人人都是产品经理, 为何All-in海外KOC:一场关于AI时代窗口期的豪赌 – 人人都是产品经理, 重新理解企业的内部协作 – 人人都是产品经理, 苹果的 AI 战略到底是什么? – 人人都是产品经理, 医疗智能体·第2讲——合规护城河:等保、PIPL与HIPAA的架构实战 – 人人都是产品经理, 向量知识库五步法:从“答非所问”到“精准回复” – 人人都是产品经理, 鸿蒙PC三方库构建总指挥HPKBUILD(sha)库为例 – 人人都是产品经理, 何时该用LLM?AI产品经理的LLM设计指南 – 人人都是产品经理, 医疗信息领域的需求方、决策方、准入方以及关注点(二) – 人人都是产品经理, 即梦涨价:一场被误读的「傲慢」 – 人人都是产品经理, 面试AI PM必答题:Hermes和OpenClaw的区别,如何讲清楚业务价值 – 人人都是产品经理, AI的下一张船票:世界模型——AI产品经理必须理解的技术拐点 – 人人都是产品经理, 小红书做GEO,怎么让AI信你?记住这 3 个重要信息 – 人人都是产品经理, 5 家印度 AI 初创公司,看看印度 AI 再做什么 – 人人都是产品经理, AI项目跨团队协作:产品技术业务如何不打架 – 人人都是产品经理, Agentic Workflow(智能体工作流):让AI从”答案生成器”变成”数字员工” – 人人都是产品经理, lycium_plusplus 项目全景解读:OpenHarmony 三方库构建的“大管家” – 人人都是产品经理, 从爆单救火到前置履约:两套预采策略,把生鲜大促履约效率拉满 – 人人都是产品经理, 什么时候该补货?我用一轮数据做了一个决定 – 人人都是产品经理, 从“机械兜底”到“动态分流”:AI客服重复进线治理的4大底层逻辑 – 人人都是产品经理, 抖音拼效率,红书拼洞察 – 人人都是产品经理, 全民狂欢与退潮——为什么龙虾这波热潮冷却得如此之快? – 人人都是产品经理, Stripe押注!MPP重塑全球支付 – 人人都是产品经理, 小红书GEO:AI引用你的内容,不是因为你对,而是因为你看起来可信 – 人人都是产品经理, 前百度副总裁押注办公Agent,日韩付费爆发,Manus迎来强劲对手 – 人人都是产品经理,
Kimi 2.5 震撼发布!万亿参数“大圣集群”现世,多项指标超越 G...
像素呼吸 · 2026-01-30 · via 人人都是产品经理

Moonshot AI的Kimi 2.5发布震撼全球AI圈,1万亿参数规模、原生INT4量化、100个分身并行协作的Agent Swarm等技术突破,不仅在HLE测试中超越GPT-5,更在普通电脑上实现高效运行。这款国产大模型通过MoE架构和量化感知训练,展示了前所未有的工程美学和思维深度,彻底改写了AI竞争的格局。

月之暗面(Moonshot AI)突然投下重磅炸弹:Kimi 2.5 正式发布并开源!

这不是一次简单的版本迭代。1万亿参数规模、原生 INT4 量化、支持 100 个分身并行协作的Agent Swarm(智能体集群)……当这一串硬核参数甩出来时,全球 AI 圈都被震动了。苹果大牛 Awni Hannun 惊叹:万亿模型竟然在两台 Mac 上就能跑起来 。更恐怖的是,在衡量模型“聪明极限”的 HLE 测试中,Kimi 2.5 直接干翻了尚未完全露面的 GPT-5。

国产模型,这次真的在“思维深度”上完成了对硅谷巨头的超越。

1. 万亿参数的“精算师”:MoE 架构的暴力美学

Kimi 2.5 采用了混合专家架构(MoE),总参数量达到了惊人的1 万亿(1T)。

但它并不是一个空有体量的“笨重巨兽”。通过精密的专家选择机制,Kimi 2.5 在推理时仅激活其中的 320 亿(32B)参数。这意味着它拥有万亿级的知识储备,却只需要轻量级模型的响应速度。

更让开发者兴奋的是,月之暗面在工程上实现了一个奇迹:原生 INT4 权重位量化。 通常万亿模型量化后会“变笨”,但 Kimi 2.5 通过量化感知训练,在性能几乎无损的前提下,将生成速度提升了2 倍。这也就是为什么,即便没有昂贵的 H100 集群,个人开发者用两台 M3 Ultra 芯片的 Mac 电脑也能流畅运行这个万亿巨无霸 。

2. 杀手级能力:Agent Swarm,从“单兵”到“集群”

如果说之前的 AI 是一个帮你写代码的“助手”,那 Kimi 2.5 就是一个能自主管理的“技术总监”。

Kimi 2.5 引入了全新的Agent Swarm(智能体集群)模式。 面对复杂任务,它不再单线思考,而是会根据需求自主创建最多100 个专项子智能体(分身)并行工作。

  • 分工明确:它可以同时派出“AI 研究员”搜资料、“代码专家”写程序、“事实核查员”纠错。
  • 效率爆炸:相比传统单线程模式,任务完成速度提升了约4.5 倍。
  • 超强耐力:它能稳定执行 200 到 300 次工具调用而不“断片”,甚至能处理多达 1,500 次并行调用。

3. 视觉编程:给它一张截图,还你一个网站

Kimi 2.5 此次强化了原生多模态能力,尤其是“视觉编程”表现堪称惊艳。

你可以直接给它发一张精美的网页 UI 截图,甚至是一段视频。Kimi 2.5 能精准理解其中的布局、动态效果和交互逻辑,并直接输出生产级别的代码。 在测试中,它不仅复刻了复杂的 3D 效果,甚至能自主通过查看渲染结果进行“视觉 Debug”,直到代码运行效果与草图完全一致。

4. 榜单“屠夫”:全线 SOTA 的硬核实力

数据不会骗人。在最新的各项权威基准测试中,Kimi 2.5 展现了极强的统治力:

特别是在HLE测试中,这被公认为目前最难、最不容易被“刷榜”的逻辑测试,Kimi 2.5 的表现标志着它已经触及了目前 AI 推理能力的“天花板”。

5. API 价格:让大模型进入“一毛钱时代”

性能暴涨的同时,价格却在暴跌。Kimi 2.5 API 的定价极具攻击性:

  • 缓存命中价格:仅需$0.10/MTok。
  • 输入价格:$0.60/MTok,远低于同级别闭源模型。

这种低价策略配合其 SoTA 级的性能,意图非常明显:月之暗面要让 Kimi 2.5 成为 2026 年全球开发者构建智能体应用的“第一底座”。

结语:国产 AI 的下半场,是思维的较量

长期以来,国产大模型一直被贴着“追随者”的标签。但 Kimi 2.5 的出现改变了叙事逻辑。 它不再单纯比拼参数,而是通过MoE + Agent Swarm + 原生量化,在工程美学和思维深度上走出了一条独特的路。

当 AI 能够自主调度百人团队、能够对着一张草图思考编程、能够在普通电脑上跑出万亿参数的智慧时,我们知道,AI 的下半场竞争已经不再关乎“谁能说得更好”,而在于“谁能想得更深”。

本文由 @像素呼吸 原创发布于人人都是产品经理。未经作者许可,禁止转载

题图来自作者提供