惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

Cyberwarzone
Cyberwarzone
Help Net Security
Help Net Security
L
LINUX DO - 最新话题
Security Archives - TechRepublic
Security Archives - TechRepublic
A
About on SuperTechFans
www.infosecurity-magazine.com
www.infosecurity-magazine.com
Attack and Defense Labs
Attack and Defense Labs
K
KPMG report finds enterprise disconnect between AI and its ROI | CIO
The GitHub Blog
The GitHub Blog
CTFtime.org: upcoming CTF events
CTFtime.org: upcoming CTF events
Webroot Blog
Webroot Blog
T
Tenable Blog
C
Cyber Attacks, Cyber Crime and Cyber Security
Microsoft Security Blog
Microsoft Security Blog
人人都是产品经理
人人都是产品经理
Simon Willison's Weblog
Simon Willison's Weblog
D
Docker
爱范儿
爱范儿
AI
AI
宝玉的分享
宝玉的分享
PCI Perspectives
PCI Perspectives
The Register - Security
The Register - Security
Project Zero
Project Zero
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
IT之家
IT之家
S
Securelist
Scott Helme
Scott Helme
B
Blog
Forbes - Security
Forbes - Security
Google DeepMind News
Google DeepMind News
T
The Blog of Author Tim Ferriss
月光博客
月光博客
P
Proofpoint News Feed
让小产品的独立变现更简单 - ezindie.com
让小产品的独立变现更简单 - ezindie.com
F
Fortinet All Blogs
H
Help Net Security
Last Week in AI
Last Week in AI
N
News and Events Feed by Topic
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
MyScale Blog
MyScale Blog
I
InfoQ
P
Privacy International News Feed
V
V2EX
有赞技术团队
有赞技术团队
G
Google Developers Blog
阮一峰的网络日志
阮一峰的网络日志
腾讯CDC
freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More
S
Schneier on Security
T
Tailwind CSS Blog

InfoQ - 促进软件开发领域知识与创新的传播

Meta 收购 Manus 这事儿泡汤了 5.5万 Star 开源项目 Ghostty 被迫出走,GitHub 正在终结一代技术人的乌托邦 谷歌开源“Agent Skill 超级工具箱”,云、库、引擎、AI全线打通,开发者狂喜 Slack 长时运行多智能体系统的上下文管理方案 从 T+1 到分钟级:金城银行基于 Apache Doris 构建高可靠、强一致的实时数据平台 谷歌云推出 Agents CLI,简化 AI 智能体开发全流程 Claude官方击穿高薪、高学历的安全防线!Anthropic点名10大高危职业,但有群人暂时稳了 亚马逊云科技终止 WorkMail 服务,并将 App Runner 转入维护模式 OPPO小布记忆:全模态碎片化内容的理解与智能整理实践|AICon上海 模力工场038周AI应用周榜:工具在消失,工作流在出现 Akamai CEO Tom Leighton:Agent 时代来临,云基础设施正从“中心化”转向“分布式边缘” 日均数百亿入库背后:从“人肉调度”到K8s弹性架构,度小满金融基于OceanBase重构入库架构实践 百度文库网盘发布GenFlow 4.0:月活用户超1亿,要把网盘变成全端AI工作台 Altman 投的 Agent 终端 Warp 开源了!斩获3.5万star 哪些客户需要拒, 敢让龙虾决定吗?_AI&大模型_InfoQ 中文站_InfoQ精选视频 从开发到生产:为什么越来越多的机器学习团队纷纷迁移到 Snowflake | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 探索多智能体工作流:LangGraph Snowflake Cortex AI | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 腾讯云分布式缓存数据库:AI Agent - 从提示词工程到 Harness 工程 | 腾讯云数据库 DBTalk_腾讯_凌敏_InfoQ精选视频 基于 Streamlit 为 CSV 数据构建分析智能体 | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 AI 智能体:告别文档缺漏 | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 构建 AI 驱动的数据管道:深度探讨 Snowflake Openflow 与非结构化数据 | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 云端太贵、本地不够聪明,英特尔押注“端云混合AI”:智能体PC会替人完成工作 不到10%的存储投入,可能拖垮90%的GPU投资!IBM把AI Agent塞进存储系统,算清企业最容易忽略的一笔账 Snowpark 上手实战 | BUILD 2025_大数据_王玮_InfoQ精选视频 ClickHouse + Langfuse,构建 Agent 可观测基石 腾讯云分布式缓存数据库:Cluster Proxy 共享连接架构深度解析 | 腾讯云数据库 DBTalk_腾讯_凌敏_InfoQ精选视频 AI 写代码太烧钱了:Copilot、Claude 一起涨价,不如把程序员请回来? 英特尔发布至强600系列工作站处理器与锐炫Pro B70 GPU,全新AI工作站来了 腾讯云分布式缓存数据库:从 Redis 到 Valkey - 开源社区如何快速创新 | 腾讯云数据库 DBTalk_腾讯_凌敏_InfoQ精选视频 印奇这次要“从0重做”智驾模型!首谈阶跃和千里双公司布局:中国AI商业闭环要靠车跑出来 从Cursor返聘归来,90后华裔女高管带Claude开启日更模式:token成本比工程师工资低多了! 从 Coding 到 Agent:QCon 北京 2026 全景复盘,优秀出品人 & 明星讲师名单揭晓 全链路支撑大模型国产化“Day 0适配”,商汤大装置构建全栈能力底座 凌晨,OpenAI 与亚马逊云科技史上最大联合发布来了 HashiCorp Vault 2.0 发布:引入新身份联邦机制,迈入 IBM 生命周期体系 Yelp 实现超 1,000 个 Cassandra 节点零停机升级 写了 17 年开源代码,我为什么认为 Coding Agents 堆功能是在瞎折腾? 基于 Apache Camel 编排智能体与多模态 AI 管道 面向智能体与人类用户的AI记忆系统:架构设计与核心场景实践|AICon上海 Anthropic 推出 Managed Agents,简化 AI 代理部署流程 阿里HappyHorse开启灰测,720P视频生成低至0.44元/秒 讯飞联合清华团队押注量子AI:不看营收、不设KPI,一群“无人区”科学家,抢夺下代AI算力入口 小米万亿模型全面开源:MIT 协议、1M 上下文,但还是打不过 DeepSeek Cortex Code 入门指南:面向数据工程师的实践路径 | 技术实践 openJiuwen社区首发Team Skills,定义Coordination Engineering新范式 用 Snowflake Cortex Agents 释放结构化数据的最大价值 | 技术实践 Grafana 利用 Kafka 对 Loki 进行了架构重构,并发布了一款命令行工具,旨在将可观测性引入编码代理 ClickHouse重构全文索引:对象存储上跑出高性能 Full-Text Search 可观测性和遥测技术如何提升软件工程实践 Dropbox 与 GitHub 合作,将单体库大小从 87GB 缩减至 20GB Agent 的下一站:基于长期记忆系统 EverOS 的自我演进|AICon上海 同一赛道,四种收费:Agent 控制层(Harness)开始分裂 Cloudflare Sandboxes 正式发布,为 AI 代理提供持久化隔离环境 Agent 的“记忆断片”困局,该怎么破?_AI&大模型_AICon 全球人工智能开发与应用大会_InfoQ精选视频 数据分析师如何快速建立在 AI 时代最值钱的能力:一份可落地的行动路线图 摩尔线程最新财报:研发占比超86%,万卡级大规模智算集群落地 当云区域失效:地缘动荡环境下的高可用重构 Slack 重构通知系统,设置参与度提升 5 倍 智能体工程的隐性技术债务 “我把所有模型都换成了DeepSeek V4”:月账单将降 90%,效果还更好 阿里云智能集团高级技术专家刘少伟已确认出席AICon上海站,并分享如何构建企业 Agent 的自动化行动架构 构建生产就绪的 tRPC API:Apollo Federation 的 TypeScript 替代方案 Anthropic推出面向Claude Code的基于智能体的代码审查功能 北京车展直击:斑马智能甩出车载Agent短剧,比亚迪率先落地,AI让智能座舱又热起来了 Snowflake 作为智能体运行时:从静态管道迈向自主数据系统 | 技术实践 Snowflake 上的本体体系:基于 Cortex Code 能力实现从架构到部署 | 技术实践 Cloudflare 公布 MCP 架构方案,应对企业面临的安全与治理风险 复杂的项目管理怎么做到「AI 友好」?飞书项目用「开放」给出答案 Snowflake Cortex Code 的规范驱动开发:将 SDLC 方法论引入 AI 辅助工作流 | 技术实践 Copilot 不让注册了:从“随便用”到“全面限”,agent 把原有订价模型顶穿了 当互联网用AI卷效率时,这家公司先问了一连串“能不能” Meta 开始记录员工每一次点击:AI 要接管工作,先监控会工作的人 智源FlagOS完成DeepSeek-V4-Flash在八款芯片Day0适配,实现三重技术突破 DeepSeek V4 重磅开源!首次打通华为Ascend,也没丢掉英伟达,百万上下文夺回国产模型话语权 李志飞的“新实验”:当超级个体撞上真实组织 GPT-5.5 登顶时刻,Anthropic 亲口承认 Claude 变笨了!网友群嘲:太敷衍 那些没空写的小需求,龙虾真能做吗?_AI&大模型_InfoQ 中文站_InfoQ精选视频 从 Pandas 到生产:使用任意 IDE 进行可扩展的 ML 数据管道与分布式处理 | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 pnpm 11 候选版本发布,带来 ESM 分发、供应链默认设置以及新的存储格式 银行业PDF表格提取方案重构:基于Java的分层方案 GPT-5.5 赢了 Opus 4.7 和 Mythos?奥特曼晒黄仁勋内部信:英伟达全员用上 Codex! Cloudflare 推出 Think:一款面向 AI 代理的持久化运行时 1850亿美元天价支出、75%代码由AI生成!谷歌正式宣告:全面转向智能体工作流 xAI落后太多,马斯克“开大”重金求购Cursor,100亿美金“分手费”都敢签! Pulumi 新增对 Bun 运行时的全面支持 姚顺雨腾讯模型首秀!不卷参数只做 “听话打工人”,Hy3 preview登场 | 附实测 老板让你“忽悠”投资人,你敢发给龙虾吗?_AI&大模型_InfoQ 中文站_InfoQ精选视频 Gemini CLI 引入子代理机制,实现任务委派与并行代理工作流 清华系团队星工聚将完成数千万天使轮融资,轮式机器人拿下头部制造企业亿级大单 Pretext.js 绕过 DOM 布局重排,实现 120 FPS 的高级交互体验 靠“AI 云”爆红的 Vercel,栽在一个第三方AI工具手里!IPO前夕遭黑,200万美元赎金谈崩? 高能研讨会|端侧 AI 正在重写实时感知效率上限_AI&大模型_王玮_InfoQ精选视频 2050大会看这篇就够了|报名、交通食宿指引大全 Java 近期资讯:OpenJDK JEP、Jakarta EE 12、Spring Framework、Micrometer、Camel、JBang 金融智能的架构编排:基于 Snowflake Cortex Agents 实现结构化与非结构化数据统一分析 | 技术实践 在AK大神爆火的任务里,摸清国产AI真实水平 百灵Ling-2.6-flash 正式发布:高 Token 效率,以 1/10 消耗实现 SOTA 级 Agent 能力 当 PM 懂AI,当技术懂产品:AI 时代产品力的双向进化|PM x AI产品力领航者大会即将开幕 为 AI 智能体设计记忆机制:揭秘 LinkedIn 的认知记忆智能体 获奖名单公布|2026主题征文第一期|分享你最有价值的龙虾场景与核心 Skill_热门活动_InfoQ写作社区官方_InfoQ写作社区
Meta“Token榜”逼疯打工人,一夜烧掉公司几万刀!AI时代Token焦虑越来越离谱
李冬梅 · 2026-04-25 · via InfoQ - 促进软件开发领域知识与创新的传播

Meta 内部把烧 token 当成 KPI

近日,据 The Information 报道,Meta 公司内部出现了一个名为“Claudeonomics”(这一名称源自 Anthropic 旗舰产品 Claude)的 AI token 消费排行榜,该排行榜由员工自愿在公司内网创建,追踪超过 8.5 万名员工的 token 使用情况。

根据该榜单,Meta 内部过去 30 天的消耗掉 token 总量超过 60 万亿。按照 Anthropic 最新公布的定价,其 Claude Opus 4.6 模型中输入和输出 token 的平均成本约为每百万 token 15 美元。以此估算,60 万亿 token 的成本约为 9 亿美元。不过 Meta 实际采用的是哪种模型以及其采购价格,我们尚不清楚。

据悉,Meta 内部个人 token 数消耗最多的达到了 2810 亿,根据模型类型的不同,这笔金额可能价值数百万美元。

在 Meta 内部,消耗最多的 AI 计算能力,正在成为一种新的身份象征。

这种现象反映了硅谷“Token 最大化”文化的兴起——将 token 消耗量作为衡量生产力的基准,并作为评估员工是否“精通人工智能”的竞争指标。

科技公司高管们对这一趋势表示赞同。

英伟达 CEO 黄仁勋上个月表示,如果一名年收入 50 万美元的工程师每年在 AI token 上的花费少于 25 万美元,他会“深感担忧”。

Meta CTO  Andrew Bosworth 在二月份的一次科技会议上表示,据《福布斯》报道,一位顶尖工程师如果将相当于自己年薪的金额用于购买 token,其生产力可以提升至多十倍。Bosworth 坦率地说道:“这笔交易的成果显而易见;应该持续投入,而且没有上限。”

特斯拉和 OpenAI 的前顶级 AI 科学家、现任 AI 教育初创公司负责人 Andrej Karpathy 不久前也在播客中也表示:“如果 token 用不完,我会很焦虑。”

如果说 Meta 的 token 排行榜代表的是一种“更多调用等于更高生产力”的工程文化,那么 OpenClaw 的流行则揭示了另一件事:在 Agent 时代,token 的消耗方式正在发生结构性变化。

这只被开发者们反复调教的“数字龙虾”,不再只是一个能聊天、能写代码的模型外壳,而是一个可以持续执行任务、主动调用工具、甚至自行拆解目标的 Agent 系统。它不像传统对话式 AI 那样“问一句答一句”,而更接近一个不下班的执行单元:任务一旦启动,就可能在后台长时间运转,反复推理、调用、修正。

问题正是从这里开始变得微妙。

表面上,OpenClaw 降低了“用 AI 做事”的门槛——你不再需要频繁与模型去交互,系统会替你跑完整个流程;但在更深一层,它也改变了成本的发生方式:越来越多的用户开始意识到,自己消耗的已经不只是“几次对话”的成本,而是一整条任务链条背后的计算开销。

一次看似简单的自动化流程,可能拆分成数十甚至上百次模型调用;一次“让 AI 自己去完成”的指令,背后对应的是长时间的推理轨迹和连续的 Token 流水。

问题也随之浮现:当 Token 的主要消耗来自模型内部推理过程,而不是用户直接需求,把 Token 当作生产力指标本身就可能是一种误判。而这些不可见的 Token 消耗是否真的带来了等价的价值,也需要打个问号。

Token 消耗等同于生产力吗?

Meta 的 Token 消耗排行榜其实引发了不少争议。

彭博社旗下知名媒体人 Joe Weisenthal 在 X 平台上直接质问道:“用 token 总消耗量来衡量生产力究竟有什么意义?”

他还嘲讽道:“这真让人感觉像‘后院炼钢炉’一样”,暗示这种一味追求数字指标而忽视实际质量的做法,就像不计成本地肆意浪费资源一样。

图片

这背后的根本性问题是:token 消耗量是一个投入指标,而非产出指标。就像用打印页数来衡量员工生产力一样,消耗更多 token 并不等同于取得更多成果。一些员工为了提升排名而让 AI 代理闲置数小时的行为,恰恰表明这个指标可以通过“人工数据膨胀”来操纵。

当我们试图厘清“Token 消耗越多,生产力提升就越明显”这一命题是否成立时,必须先将目光投向这些被消耗的 Token 究竟流向了何处

想象这样一个场景:你让 AI 助手帮你拍张照片——听起来是个再简单不过的任务。但在后台,这个“简单”的指令可能触发 20~50 次模型调用。每一次调用都在消耗算力、吞噬 token,而账单最终会精确到小数点后几位送到你面前。

YuanLab.ai 团队专家在接受 InfoQ 采访时表示,“token 由模型生成,对于同一任务,不同模型生成的 token 数量差异较大,其中一些模型的 token 效率较低,大量 token 被消耗在无效内容上——模型在已得出正确结论后仍持续生成反思、自我验证等内容,在一些模型中,这部分无效 token 占比高达 70% 以上,是最核心的浪费来源。

Latency 问题本质上是 token 冗余的外在表现。推理链条越长,单步响应时间越难压缩,在 Agent 多步骤任务中,每一步的延迟叠加会让整体任务响应时间远超预期,进而触发超时重试,反而产生更多 token 消耗,形成恶性循环。

所以真正的 token 成本黑洞,藏在系统的“内耗”中。这种“内耗”的根源不仅在于硬件利用率,更在于系统架构本身。

当用户提出一个任务请求时,AI Agent 系统会进行复杂的调度:任务分解、子任务分配、模型选择、结果整合……这个过程中的每一次调度,都会带来额外的开销。系统调度会把基础模型成本放大 3-5 倍,在极端情况下甚至达到 10 倍。

在复杂多模态文档解析与长链路业务决策中,以企业级财报分析 Agent 任务为例,涉及跨页图文解析、数据抽取、多源对比、结论生成等多个子任务,每个子任务都需要独立的模型调用,且上一步的输出会成为下一步的上下文输入。

在没有推理效率优化的情况下,单任务的 token 消耗可以轻松达到数十万甚至上百万 token,综合算力成本远超人工完成同等工作的成本,从商业逻辑上就已经站不住脚。

更关键的是,这类任务的成本不是静态的。随着业务规模扩大、并发任务增多,成本会以任务数量为系数快速膨胀,而任务成功率和质量却未必同步提升。当单任务的综合算力成本与其创造的实际商业价值做对比时,很多看起来很有潜力的场景,在规模化落地时会发现根本无法实现正向 ROI。

举个例子:用户说“帮我分析这份财报”。

  • 第一步:理解用户意图(调用模型)

  • 第二步:识别需要提取的关键信息(调用模型)

  • 第三步:从文档中提取数据(调用模型)

  • 第四步:验证提取的准确性(调用模型)

  • 第五步:生成分析报告(调用模型)

  • 第六步:检查报告的完整性(调用模型)

  • ……

如果中间某个环节出现偏差,系统还会进行“反思”和“回滚”,重新规划路径。一个看似简单的任务,可能在后台经历了数十次调用。

所以这个问题的结论应该是——在很多场景下,Token 消耗的增长,优先反映的不是生产力提升,而是系统复杂度的上升。甚至可以说:Token 越多,越有可能说明系统越“不会做减法”。

事实上,“Token 消耗不等于生产力提升”这一现象,并不是个别案例,而正在成为行业中的普遍共识。

Token 增长的本质:

系统在为不确定性买单

包括 OpenAI、Anthropic 以及 Google DeepMind 在内的多家机构,在对复杂任务链路(如工具调用、代码生成、长文档推理)的评估中都发现:随着任务复杂度提升,系统往往通过增加中间推理步骤和调用次数来维持成功率,而不是通过单次推理能力的提升来实现效率跃迁

换句话说,当前大量 Agent 系统所呈现出的“高 Token 消耗”,本质上是一种工程层面的补偿机制——它用更多计算去覆盖模型能力的边界。

这也正是问题的关键转折点:如果 Token 的增加主要用于对冲不确定性,而不是直接创造价值,那么优化方向就不应该是“继续增加调用”,而是“减少不确定性本身”

也正是在这样的背景下,行业开始从“如何多做几步”转向一个更本质的问题:如何让模型在更少步骤内,把每一步做对

答案正在变得清晰——决定效果上限的,并不是调用次数,而是每一次调用的质量,以及系统在长链路中的决策稳定性。

YuanLab.ai 团队认为前大量 Agent 系统依赖“多轮调用”来完成复杂任务,本质上是一种技术妥协。当单步推理无法稳定完成意图理解、工具选择与逻辑推演时,系统只能通过增加调用次数,引入反思、验证等机制,用冗余计算来对冲不确定性。这种路径确实可以提升任务成功率,但代价是显而易见的:Token 消耗被成倍放大,延迟不断累积,系统复杂度迅速上升。

换句话说,行业今天普遍采用的“多调用换效果”,并不是因为任务本身必须如此复杂,而是因为底层模型尚不具备在单步内高质量完成决策的能力。当模型能够在一次推理中完成精准的意图识别、合理的路径规划以及可靠的执行决策时,大量中间步骤本身就是可以被压缩甚至消除的。真正高效的 Agent,不应该依赖“多做几次来纠错”,而是依赖“第一次就做对”。

这一点在长链路任务中尤为明显。Agent 系统的核心挑战,从来不只是单步推理,而是跨步骤的一致性与全局规划能力。当模型缺乏对整体目标的把控能力时,系统不得不将任务拆解为大量细碎的子任务,并在每一个环节增加校验机制,以防止误差累积。但这种设计也直接导致了调用次数的指数级增长,使得原本可以在少数步骤内完成的任务,被拉长为一个高冗余的执行流程。

最终结果是,Token 消耗的增长,更多反映的是系统控制能力的不足,而非智能水平的提升。

这种现象,与人类工作方式有着相似的映射。一个经验不足的执行者,往往需要反复确认、多次修正,依赖流程和检查来保证结果;而一个成熟的专家,则可以在更少步骤内完成同样甚至更复杂的任务。两者之间的差异,并不在于“做了多少步”,而在于每一步决策的质量与确定性。当前很多 Agent,更像前者,而非后者。

但有意思的是,在过去几年形成的技术路径中,行业逐渐建立了一种近乎默认的假设:更强的智能,必须建立在更高的算力消耗之上。

从 GPT-3 到 GPT-4,这一逻辑被反复验证,并进一步演化为一种路径依赖——通过更大的模型、更长的上下文、更复杂的推理链,来换取能力提升。当这套思路被延伸到 Agent 系统时,就演变为“用更多调用换更高成功率”的实践惯性,进而推动整个行业走向一场隐性的算力竞赛。

但问题在于,这种以规模驱动的增长方式,正在逼近边界。一方面,Token 成本的持续上升,使得大规模 Agent 部署在经济上变得难以承受;另一方面,调用链条的不断拉长,也让系统延迟和不稳定性问题更加突出。在这种背景下,单纯依赖“多用算力”来换取效果,已经不再具备可持续性。

OpenClaw 所引发的讨论,恰恰指向了另一种可能性:智能的提升,不在于“用得多”,而在于“用得准”。这意味着,下一阶段 Agent 的优化重点,将不再是扩大调用规模,而是提升 Token 的使用效率——减少无效推理、压缩冗余链路、提高单步决策的信息密度,并通过更合理的系统设计降低调度与回滚带来的额外开销。

从这个角度来看,当前 Agent 面临的核心瓶颈,并不是算力不足,而是算力利用效率过低。继续堆叠调用次数,只会带来更高成本和更复杂系统,却未必带来等比例的能力提升。真正决定 Agent 能否走向规模化落地的关键,在于能否用更少的 Token,稳定完成更复杂的任务。

无问芯穹 CEO 夏立雪在 3 月 27 日的中关村论坛年会的一场 AI 主题论坛上,阐明了相似的观点。

夏立雪认为,当前阶段,与其单纯扩张算力规模,不如把已有资源用到极致。围绕这个目标,他提出,应加快构建更高效、标准化的“Token 工厂”,提供持续稳定、规模化的 Token 服务,使顶尖模型能力高效赋能海量下游场景,尽可能提升每一个 Token 的转化效率,让算力“花得值”。

这也意味着,Agent 的竞争,正在从“谁消耗更多资源”,转向“谁更高效地使用资源”。

而这,或许才是 Token 经济真正进入成熟阶段的起点。

OpenClaw 引发 AI 成本结构重塑:不拼算力,拼效率

当我们将目光投向未来,OpenClaw 带来的启示是深远的。

首先,AI 的成本曲线不必是线性的。行业一直假设更强的模型必然更贵,但 OpenClaw 证明了效率优化可以打破这个魔咒。一个高效训练的模型,可能比一个参数更大但训练低效的模型更强、更省。

其次,算力不是 AI 发展的唯一瓶颈。当 GPU 利用率只有 15%-30% 时,问题不在于算力不够,而在于算力没被好好利用。通过系统优化,我们可以在现有硬件条件下释放数倍的潜力。

最后,AI 的民主化需要效率革命。只有当成本降到足够低,AI 才能从少数科技巨头的专利,变成每个开发者、每个企业都能使用的工具。OpenClaw 的 token 经济学,正在为这个未来铺路。

在这个新时代里,智能不再是昂贵的奢侈品,而是触手可及的基础设施。每一分算力都被珍视,每一次调用都有价值。OpenClaw 这类智能体引发的狂烧 token 的解决办法不应只是简单地省钱,而是让 AI 真正走向高效、可持续的未来。

而这个未来,已经不远了。