惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

Hacker News: Ask HN
Hacker News: Ask HN
H
Help Net Security
Microsoft Azure Blog
Microsoft Azure Blog
B
Blog RSS Feed
Jina AI
Jina AI
Stack Overflow Blog
Stack Overflow Blog
量子位
博客园_首页
Vercel News
Vercel News
CTFtime.org: upcoming CTF events
CTFtime.org: upcoming CTF events
Forbes - Security
Forbes - Security
IT之家
IT之家
N
News and Events Feed by Topic
S
Security Affairs
Recent Commits to openclaw:main
Recent Commits to openclaw:main
Webroot Blog
Webroot Blog
Recorded Future
Recorded Future
L
LangChain Blog
Y
Y Combinator Blog
AI
AI
MyScale Blog
MyScale Blog
大猫的无限游戏
大猫的无限游戏
小众软件
小众软件
Know Your Adversary
Know Your Adversary
AWS News Blog
AWS News Blog
Help Net Security
Help Net Security
Cyberwarzone
Cyberwarzone
L
Lohrmann on Cybersecurity
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
Google Online Security Blog
Google Online Security Blog
V2EX - 技术
V2EX - 技术
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
PCI Perspectives
PCI Perspectives
I
Intezer
T
Tenable Blog
G
Google Developers Blog
Application and Cybersecurity Blog
Application and Cybersecurity Blog
T
Troy Hunt's Blog
L
LINUX DO - 最新话题
云风的 BLOG
云风的 BLOG
C
CXSECURITY Database RSS Feed - CXSecurity.com
有赞技术团队
有赞技术团队
O
OpenAI News
P
Proofpoint News Feed
TaoSecurity Blog
TaoSecurity Blog
C
Check Point Blog
Last Week in AI
Last Week in AI
S
Schneier on Security
Simon Willison's Weblog
Simon Willison's Weblog
Blog — PlanetScale
Blog — PlanetScale

InfoQ - 促进软件开发领域知识与创新的传播

Meta 收购 Manus 这事儿泡汤了 5.5万 Star 开源项目 Ghostty 被迫出走,GitHub 正在终结一代技术人的乌托邦 谷歌开源“Agent Skill 超级工具箱”,云、库、引擎、AI全线打通,开发者狂喜 Slack 长时运行多智能体系统的上下文管理方案 从 T+1 到分钟级:金城银行基于 Apache Doris 构建高可靠、强一致的实时数据平台 谷歌云推出 Agents CLI,简化 AI 智能体开发全流程 Claude官方击穿高薪、高学历的安全防线!Anthropic点名10大高危职业,但有群人暂时稳了 亚马逊云科技终止 WorkMail 服务,并将 App Runner 转入维护模式 OPPO小布记忆:全模态碎片化内容的理解与智能整理实践|AICon上海 模力工场038周AI应用周榜:工具在消失,工作流在出现 Akamai CEO Tom Leighton:Agent 时代来临,云基础设施正从“中心化”转向“分布式边缘” 日均数百亿入库背后:从“人肉调度”到K8s弹性架构,度小满金融基于OceanBase重构入库架构实践 百度文库网盘发布GenFlow 4.0:月活用户超1亿,要把网盘变成全端AI工作台 Altman 投的 Agent 终端 Warp 开源了!斩获3.5万star 哪些客户需要拒, 敢让龙虾决定吗?_AI&大模型_InfoQ 中文站_InfoQ精选视频 从开发到生产:为什么越来越多的机器学习团队纷纷迁移到 Snowflake | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 探索多智能体工作流:LangGraph Snowflake Cortex AI | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 腾讯云分布式缓存数据库:AI Agent - 从提示词工程到 Harness 工程 | 腾讯云数据库 DBTalk_腾讯_凌敏_InfoQ精选视频 基于 Streamlit 为 CSV 数据构建分析智能体 | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 AI 智能体:告别文档缺漏 | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 构建 AI 驱动的数据管道:深度探讨 Snowflake Openflow 与非结构化数据 | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 云端太贵、本地不够聪明,英特尔押注“端云混合AI”:智能体PC会替人完成工作 不到10%的存储投入,可能拖垮90%的GPU投资!IBM把AI Agent塞进存储系统,算清企业最容易忽略的一笔账 Snowpark 上手实战 | BUILD 2025_大数据_王玮_InfoQ精选视频 ClickHouse + Langfuse,构建 Agent 可观测基石 腾讯云分布式缓存数据库:Cluster Proxy 共享连接架构深度解析 | 腾讯云数据库 DBTalk_腾讯_凌敏_InfoQ精选视频 英特尔发布至强600系列工作站处理器与锐炫Pro B70 GPU,全新AI工作站来了 腾讯云分布式缓存数据库:从 Redis 到 Valkey - 开源社区如何快速创新 | 腾讯云数据库 DBTalk_腾讯_凌敏_InfoQ精选视频 印奇这次要“从0重做”智驾模型!首谈阶跃和千里双公司布局:中国AI商业闭环要靠车跑出来 从Cursor返聘归来,90后华裔女高管带Claude开启日更模式:token成本比工程师工资低多了! 从 Coding 到 Agent:QCon 北京 2026 全景复盘,优秀出品人 & 明星讲师名单揭晓 全链路支撑大模型国产化“Day 0适配”,商汤大装置构建全栈能力底座 凌晨,OpenAI 与亚马逊云科技史上最大联合发布来了 HashiCorp Vault 2.0 发布:引入新身份联邦机制,迈入 IBM 生命周期体系 Yelp 实现超 1,000 个 Cassandra 节点零停机升级 写了 17 年开源代码,我为什么认为 Coding Agents 堆功能是在瞎折腾? 基于 Apache Camel 编排智能体与多模态 AI 管道 面向智能体与人类用户的AI记忆系统:架构设计与核心场景实践|AICon上海 Anthropic 推出 Managed Agents,简化 AI 代理部署流程 阿里HappyHorse开启灰测,720P视频生成低至0.44元/秒 讯飞联合清华团队押注量子AI:不看营收、不设KPI,一群“无人区”科学家,抢夺下代AI算力入口 小米万亿模型全面开源:MIT 协议、1M 上下文,但还是打不过 DeepSeek Cortex Code 入门指南:面向数据工程师的实践路径 | 技术实践 openJiuwen社区首发Team Skills,定义Coordination Engineering新范式 用 Snowflake Cortex Agents 释放结构化数据的最大价值 | 技术实践 Grafana 利用 Kafka 对 Loki 进行了架构重构,并发布了一款命令行工具,旨在将可观测性引入编码代理 ClickHouse重构全文索引:对象存储上跑出高性能 Full-Text Search 可观测性和遥测技术如何提升软件工程实践 Dropbox 与 GitHub 合作,将单体库大小从 87GB 缩减至 20GB Agent 的下一站:基于长期记忆系统 EverOS 的自我演进|AICon上海 同一赛道,四种收费:Agent 控制层(Harness)开始分裂 Cloudflare Sandboxes 正式发布,为 AI 代理提供持久化隔离环境 Agent 的“记忆断片”困局,该怎么破?_AI&大模型_AICon 全球人工智能开发与应用大会_InfoQ精选视频 数据分析师如何快速建立在 AI 时代最值钱的能力:一份可落地的行动路线图 摩尔线程最新财报:研发占比超86%,万卡级大规模智算集群落地 当云区域失效:地缘动荡环境下的高可用重构 Slack 重构通知系统,设置参与度提升 5 倍 智能体工程的隐性技术债务 “我把所有模型都换成了DeepSeek V4”:月账单将降 90%,效果还更好 阿里云智能集团高级技术专家刘少伟已确认出席AICon上海站,并分享如何构建企业 Agent 的自动化行动架构 构建生产就绪的 tRPC API:Apollo Federation 的 TypeScript 替代方案 Anthropic推出面向Claude Code的基于智能体的代码审查功能 北京车展直击:斑马智能甩出车载Agent短剧,比亚迪率先落地,AI让智能座舱又热起来了 Snowflake 作为智能体运行时:从静态管道迈向自主数据系统 | 技术实践 Snowflake 上的本体体系:基于 Cortex Code 能力实现从架构到部署 | 技术实践 Cloudflare 公布 MCP 架构方案,应对企业面临的安全与治理风险 复杂的项目管理怎么做到「AI 友好」?飞书项目用「开放」给出答案 Snowflake Cortex Code 的规范驱动开发:将 SDLC 方法论引入 AI 辅助工作流 | 技术实践 Copilot 不让注册了:从“随便用”到“全面限”,agent 把原有订价模型顶穿了 当互联网用AI卷效率时,这家公司先问了一连串“能不能” Meta 开始记录员工每一次点击:AI 要接管工作,先监控会工作的人 Meta“Token榜”逼疯打工人,一夜烧掉公司几万刀!AI时代Token焦虑越来越离谱 智源FlagOS完成DeepSeek-V4-Flash在八款芯片Day0适配,实现三重技术突破 DeepSeek V4 重磅开源!首次打通华为Ascend,也没丢掉英伟达,百万上下文夺回国产模型话语权 李志飞的“新实验”:当超级个体撞上真实组织 GPT-5.5 登顶时刻,Anthropic 亲口承认 Claude 变笨了!网友群嘲:太敷衍 那些没空写的小需求,龙虾真能做吗?_AI&大模型_InfoQ 中文站_InfoQ精选视频 从 Pandas 到生产:使用任意 IDE 进行可扩展的 ML 数据管道与分布式处理 | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 pnpm 11 候选版本发布,带来 ESM 分发、供应链默认设置以及新的存储格式 银行业PDF表格提取方案重构:基于Java的分层方案 GPT-5.5 赢了 Opus 4.7 和 Mythos?奥特曼晒黄仁勋内部信:英伟达全员用上 Codex! Cloudflare 推出 Think:一款面向 AI 代理的持久化运行时 1850亿美元天价支出、75%代码由AI生成!谷歌正式宣告:全面转向智能体工作流 xAI落后太多,马斯克“开大”重金求购Cursor,100亿美金“分手费”都敢签! Pulumi 新增对 Bun 运行时的全面支持 姚顺雨腾讯模型首秀!不卷参数只做 “听话打工人”,Hy3 preview登场 | 附实测 老板让你“忽悠”投资人,你敢发给龙虾吗?_AI&大模型_InfoQ 中文站_InfoQ精选视频 Gemini CLI 引入子代理机制,实现任务委派与并行代理工作流 清华系团队星工聚将完成数千万天使轮融资,轮式机器人拿下头部制造企业亿级大单 Pretext.js 绕过 DOM 布局重排,实现 120 FPS 的高级交互体验 靠“AI 云”爆红的 Vercel,栽在一个第三方AI工具手里!IPO前夕遭黑,200万美元赎金谈崩? 高能研讨会|端侧 AI 正在重写实时感知效率上限_AI&大模型_王玮_InfoQ精选视频 2050大会看这篇就够了|报名、交通食宿指引大全 Java 近期资讯:OpenJDK JEP、Jakarta EE 12、Spring Framework、Micrometer、Camel、JBang 金融智能的架构编排:基于 Snowflake Cortex Agents 实现结构化与非结构化数据统一分析 | 技术实践 在AK大神爆火的任务里,摸清国产AI真实水平 百灵Ling-2.6-flash 正式发布:高 Token 效率,以 1/10 消耗实现 SOTA 级 Agent 能力 当 PM 懂AI,当技术懂产品:AI 时代产品力的双向进化|PM x AI产品力领航者大会即将开幕 为 AI 智能体设计记忆机制:揭秘 LinkedIn 的认知记忆智能体 获奖名单公布|2026主题征文第一期|分享你最有价值的龙虾场景与核心 Skill_热门活动_InfoQ写作社区官方_InfoQ写作社区
AI 写代码太烧钱了:Copilot、Claude 一起涨价,不如把程序员请回来?
Tina · 2026-04-30 · via InfoQ - 促进软件开发领域知识与创新的传播

程序员们,先别忙着焦虑 AI 会抢走你的饭碗。现在更该焦虑的,可能是你们的 CTO 和 CFO 了:因为让 AI 写代码,实在太烧钱了。

Copilot 和 Claude Code,几乎在同一时间,给行业踩了一脚刹车。

今天(4 月 28 日),GitHub 宣布从 2026 年 6 月 1 日起,GitHub Copilot 将告别“无限畅饮”模式,将 Copilot 从“按请求计费”转为“按使用量计费”。

几乎同一时间,Anthropic 限制了 Claude Code 中 Opus 模型的访问,每月 20 美元的 Pro 用户想继续用?请额外付费。

这就引出了一个绕不开的问题:用 AI 写代码花的钱,哪天会比直接雇一个程序员还贵?如今这个转折点,已经不远了。

从“自助餐”到“按粒收费”

先看看 GitHub Copilot 涨价的程度。

GitHub Copilot 原来的模式是按“请求次数”计费,你问一句“怎么写快排”和让 AI 替你跑一个小时的自主编码会话,消耗的额度是一样的。因此,需要大量“思考”的复杂提示往往会使 GitHub 的成本超过其获得的订阅费收入。GitHub 产品团队首席产品官 Mario Rodriguez 在今天的博客中坦言:“GitHub 已经吸收了太多推理成本,当前模式不可持续。”

这种压力,其实已经开始体现在更早的动作里。GitHub 上周已经释放出一个信号:为了止住持续扩大的亏损,公司暂停了 Copilot、Pro、Pro+ 以及 Student 套餐的新用户注册。

在这样的背景下,计费逻辑开始彻底重写。从 6 月 1 日起,新模式下一切以 token 为单位。GitHub 推出了自己的虚拟计费单位, “GitHub AI Credits”,每个 Credit 价值 0.01 美元。Copilot 用户在使用过程中会消耗输入 token、输出 token 以及缓存 token,这些都会根据所使用的模型分别计价,最终统一折算为 AI Credits。

订阅价格表面上没变:Copilot Pro 仍是每月 10 美元,每月 1000 Credits。Pro+ 是 39 美元,每月 3900 Credits。用完之后,要么设置超额预算继续付费,要么等下个月额度重置。

真正麻烦的是,token 账单很难提前算清。一次请求会“想”多久、调用多少工具、读多少上下文、生成多少内容,用户事前并不知道。GitHub 也意识到这一点,只能先给一点“模糊的可见性”。Rodriguez 透露,公司将在 5 月初推出“费用预览”功能,让用户和管理员在 6 月 1 日正式切换前,能够看到预估成本。

对于按年订阅的用户,可以选择提前取消并按比例退款,或者在订阅到期后降级为 Copilot Free——这些年费套餐将不再支持续订。而且那些坚持用完年费订阅的用户,将会明显感受到高端模型价格的上涨。例如,Anthropic 的 Opus 4.7,在原有按请求计费模式下的倍率为 7.5 倍,未来将提升至 27 倍;OpenAI 的 GPT-5.4,也将从 1 倍上涨到 6 倍。

所以 GitHub 的调整,相当于承认了:之前是在亏本让开发者“薅羊毛”,现在要把高阶模型真正的推理成本转嫁回去。

Anthropic 也一样。 本月初,数百万 OpenClaw 用户发现这款爆火的 AI 代理工具被 Anthropic 严重限制了。现在 Claude Code 也一并改了规则:每月 20 美元的 Pro 用户想继续用 Opus 模型?得额外付费。(虽然后来有 Claude 工程师说这是之前的文件,但综合各方看法,很可能是因为之前的 ab 测试激起了用户情绪,Anthropic 被迫收回收费策略,而且 20 美元套餐极易触发时长限制。)负责人 Boris Cherny 也曾直言:“订阅模式本就不是为这种使用强度设计的。”翻译成人话:OpenClaw 这些工具 7×24 小时跑 Agent,我们扛不住了。

轮到用户填这个“无底洞”了

过去几年,AI 公司一直用接近“自助餐”的方式扩张:低价,甚至免费,让更多人先用起来,把规模做大。

在这个阶段,主流做法是按人头收费,本质上是一种“平均成本”的模式。也就是说,不管一个人每天跑几个 agent,还是一周只问两次问题,平台都按同一档订阅费来收。高频用户多出来的成本,会被低频用户摊掉,也会被平台自己吸收。订阅制本质上是在用“平均成本”覆盖这种极不均衡的使用。

可一旦 agent 普及,这个模型就会迅速失效。所以 Copilot 和 Claude Code 现在做的,其实是把过去被平均掉、被平台吸收掉的成本,重新按 token 拆回到每一次真实使用上。

某种程度上,这并不新鲜。 它像是 2010 年代科技繁荣的重演:当年风险投资推动网约车、电商、外卖、即时配送,用补贴换增长。一旦公司站稳脚跟,就开始提价、拓展收入、为投资人兑现回报——当然,也有不少没撑住直接崩盘的。

但 AI 烧钱的速度,比近几十年任何一个行业都快。 AI 公司在全球砸下数据中心,投入数万亿美元,承诺更强的模型、更低的成本、以及“人人可用的 AI”。可现实是,哪怕只是止住亏损都很难,更别说实现投资人期待的回报了。

有外媒在分析这一轮 AI 资本热潮时,援引了 Gartner 的一组数据。分析师 Will Sommer 估算,2024 到 2029 年,全球 AI 数据中心的资本投入将达到 6.3 万亿美元——差不多是美国一年 GDP 的四分之一。为了避免资产减值,厂商需要大约 25% 的投资回报率(像亚马逊、微软那种水平)。如果回报低于 7%,就是“对所有投资者的灾难”。

要达到那根最低 7% 的红线,大型 AI 公司到 2029 年需要累计赚出接近 7 万亿美元的 AI 收入,相当于平均每年 2 万亿美元。如果想实现“历史性回报”,这个数字要提高到 8.2 万亿美元。

那这些钱要从哪来?只能靠卖 token。

Token 是 AI 理解和处理数据的最小单位,可以是文字、图片或声音。通常来说,一个 token 大约对应英文中的 3 到 4 个字符,一篇 1500 字的文章大约 2050 个 token。问题是,要赚到每年 2 万亿美元,需要处理的 token 数量大到荒谬。作为对比,谷歌曾透露它每月处理约 1.3 千万亿(quadrillion,也就是 1 后面 15 个零)个 token。把所有厂商加一起,每年大概处理 100 到 200 千万亿个 token。

但 Gartner 算了一下:要实现年入 2 万亿美元,算上每个 token 大约 10% 的利润率,token 的消耗量需要在未来几年增长 5 万到 10 万倍——也就是从现在的每年百万亿级,跳到每年 1 后面 21 个零 那个级别(sextillion,简单说,比现在多五位数)。

问题是,现在的公司根本没有能力处理这么多 token。它们正在拼命建设数据中心,但算力依然紧张。即便有能力处理,它们也面临另一个问题:这些 token 很可能是亏钱的。

Sommer 估算,如果只计算基础设施和电力成本,“每个 token 的利润看起来还算合理”。但随着模型越来越复杂、token 消耗越来越大,这个利润空间正在迅速收窄,甚至消失。而一旦把间接成本算进去——例如扩建算力以及不断训练下一代模型的“天文级”开销——这些利润几乎被完全吞噬。

“当你把下一代模型所需的基础设施成本也算进去,这个模式就越来越站不住脚。”Sommer 预测,市场整合几乎不可避免,每个区域最终可能只剩不超过两家大模型厂商。

所以,慷慨的免费额度时代,也该结束了。对那些免费用户很多的 AI 实验室来说,问题从来不是“要不要变现”,而是“什么时候开始、下手多重”。它们希望 token 用量继续增长,但成本要么自己扛,要么转嫁给用户。这也是为什么如今 GitHub Copilot 和 Anthropic 必须放弃订阅制的原因。

浪费不可避免,成本逼近临界点

AI 公司不得不把成本转嫁给用户,但问题是,很多 token 本来就是被“白烧”掉的:一部分来自技术机制,一部分来自员工内卷。

在 AI 发展的早期,大部分算力成本都花在模型训练上,而推理相对便宜。但随着模型能力提升、系统功能不断叠加,推理阶段的资源消耗已经显著上升。尤其是 AI agent——那些希望能够替用户完成复杂、多步骤任务、而不需要持续人工干预的工具——相比几年前的基础聊天模型,会消耗成倍增长的 token。

你输入一句话,Agent 就在后台工作中消耗大量 token:推演不同路径、启动子 agent 去完成子任务,或者对每一步结果进行验证。这些你根本看不见,但每一笔都算在账单上。更麻烦的是,Agent 一定会产生“无效 token”:走错路退回来、反复检查却不改东西、甚至停下来“给自己写首诗”。整个行业都在努力减少这种浪费,但短时间内没戏。

那这些 token 到底烧在哪了?

首先是最基础的输入 token 和输出 token。输出往往比输入贵 2 到 6 倍——因为生成是串行的,输入可以并行。这个价差不是随便定的,是物理层面的差异,即生成比读取更难。

真正烧钱的是推理 token。当你使用带“深度思考”的模型时,它不会直接给答案,而是先“思考”,生成成千上万 token。一个简单数学问题,最终答案可能只有 200 个 token,甚至只输出一个“42”,但模型内部可能生成了上千甚至几千个推理 token。你的账单是“推理 token + 输出 token”的总和。推理 token 已经成为一个新的市场分层,高级推理,就是更高价格。

还有一类正在拖垮很多 Agent 系统的,是工具调用 token 和系统 token。给模型接入工具时,你必须把工具的 JSON schema 一起发过去。10 个工具,加上完整描述,每次调用就多出 3000~4000 个 token,而且无论是否真用到,成本都会发生。更致命的是 Agent 的循环调用:思考→调工具→读结果→再思考……可能跑 6 到 15 轮。一个 50 token 的用户问题,最终可能消耗超过 10 万 token。不建模的话,最终账单会亲自“教育你”。

除此之外,还有视觉 token(一张截图比发一整页文字还贵)、音频视频 token(一小时会议录音 18 万 token)、结构性 token(这是“看不见的脚手架”:序列开始/结束标记、区分 system/user/assistant 的角色 token、batch 处理时的 padding token、以及各种模式触发 token)。

技术上的浪费已经够头疼了,更糟糕的是,一些企业还在主动放大这种浪费。

tokenmaxxing 这个概念最早在硅谷流行起来,但传播速度很快。员工拼命消耗更多 token,以此证明自己“深度拥抱 AI”。Visa 自豪地宣布,它的 token 使用量从 2 月的 1 万亿翻到了 3 月的 2 万亿。摩根大通和迪士尼内部甚至设有仪表盘,专门追踪员工用了多少 AI 代币。谁消耗得多,谁就显得更“前沿”。

今年 4 月,Meta 内部出现了一个叫 Claudeonomics 的排行榜,追踪全公司 8.5 万人的 AI token 消耗,只展示前 250 名。为了冲榜,有人让 Agent 跑几个小时,有人一次性跑几十个用例,还有人直接写无限循环脚本——让 AI 不断调用自己,一晚上刷出几十亿 token。30 天内,全公司烧掉了 60 万亿 token,按公开定价估算相当于 9 亿美元。排名最高的个人,一个月账单接近 200 万美元。

这些数字放在一起,会逼出一个更直接的问题:人和 AI,到底哪个更贵?

过去大家默认 AI 便宜,是因为真实成本被补贴和平均掉了。Copilot 每月十几美元、Claude Code 每月几十美元,看起来当然比一个工程师便宜。现在 token 开始逐笔计价,这个账就变了。假设一个工程师年综合成本是 25 万美元,折到每月大约 2 万美元。如果一个 AI 工具每月花 1000 美元,但能稳定替代 5% 以上的工程产出,那就是划算的;如果一个团队每月 token 账单烧到几万、几十万美元,却只换来一些重复尝试和无效产出,那 AI 反而比人贵。

所以真正的问题不是“AI 要不要用”,而是“AI 账单什么时候会超过一个程序员的工资”。

在今年2月的一期播客里,硅谷知名天使投资人、All-In Podcast 联合主持人 Jason Calacanis(曾早期投资 Uber、Robinhood 等公司)提出这个问题:token 成本什么时候会超过员工工资?他说,“这个临界点,不是未来,是马上就会发生。”

那些重度使用 AI、长时间跑 agent 的开发者,其实早已到了这个点。

同场的 Chamath Palihapitiya 也提到,他的公司已经开始给开发者设定 token 预算。按他的说法,单个 agent 通过 Claude API 跑起来,一天就可能花掉 300 美元,一年就是 10 万美元。团队必须至少提升 2 倍生产力,才能覆盖“工资 + AI 账单”的总成本。

否则,AI 不是降本工具,而是新的成本黑洞。

参考链接:

https://github.blog/news-insights/company-news/github-copilot-is-moving-to-usage-based-billing/

https://docs.github.com/en/copilot/reference/copilot-billing/models-and-pricing#model-multipliers-for-annual-copilot-pro-and-copilot-pro-subscribers

https://x.com/i/trending/2048906922825519314

https://www.theverge.com/ai-artificial-intelligence/917380/ai-monetization-anthropic-openai-token-economics-revenue

https://www.youtube.com/watch?v=JK6QnFKv080

https://www.youtube.com/watch?v=CnaegIpkenA