惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

Hacker News - Newest:
Hacker News - Newest: "LLM"
Google DeepMind News
Google DeepMind News
N
News and Events Feed by Topic
N
News and Events Feed by Topic
T
Troy Hunt's Blog
PCI Perspectives
PCI Perspectives
W
WeLiveSecurity
N
News | PayPal Newsroom
Recent Commits to openclaw:main
Recent Commits to openclaw:main
V2EX - 技术
V2EX - 技术
D
Darknet – Hacking Tools, Hacker News & Cyber Security
T
Threat Research - Cisco Blogs
L
LINUX DO - 热门话题
Cloudbric
Cloudbric
S
Secure Thoughts
Microsoft Azure Blog
Microsoft Azure Blog
H
Help Net Security
Y
Y Combinator Blog
L
LangChain Blog
Recorded Future
Recorded Future
cs.CV updates on arXiv.org
cs.CV updates on arXiv.org
博客园 - 聂微东
Attack and Defense Labs
Attack and Defense Labs
Blog — PlanetScale
Blog — PlanetScale
WordPress大学
WordPress大学
Microsoft Security Blog
Microsoft Security Blog
P
Proofpoint News Feed
小众软件
小众软件
H
Hacker News: Front Page
The Hacker News
The Hacker News
T
Tailwind CSS Blog
The Register - Security
The Register - Security
Hacker News: Ask HN
Hacker News: Ask HN
P
Privacy & Cybersecurity Law Blog
P
Palo Alto Networks Blog
S
Securelist
腾讯CDC
雷峰网
雷峰网
G
Google Developers Blog
The Cloudflare Blog
Google DeepMind News
Google DeepMind News
P
Privacy International News Feed
H
Hackread – Cybersecurity News, Data Breaches, AI and More
A
Arctic Wolf
www.infosecurity-magazine.com
www.infosecurity-magazine.com
freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More
量子位
cs.AI updates on arXiv.org
cs.AI updates on arXiv.org
阮一峰的网络日志
阮一峰的网络日志
AI
AI

InfoQ - 促进软件开发领域知识与创新的传播

Meta 收购 Manus 这事儿泡汤了 5.5万 Star 开源项目 Ghostty 被迫出走,GitHub 正在终结一代技术人的乌托邦 Slack 长时运行多智能体系统的上下文管理方案 从 T+1 到分钟级:金城银行基于 Apache Doris 构建高可靠、强一致的实时数据平台 谷歌云推出 Agents CLI,简化 AI 智能体开发全流程 Claude官方击穿高薪、高学历的安全防线!Anthropic点名10大高危职业,但有群人暂时稳了 亚马逊云科技终止 WorkMail 服务,并将 App Runner 转入维护模式 OPPO小布记忆:全模态碎片化内容的理解与智能整理实践|AICon上海 模力工场038周AI应用周榜:工具在消失,工作流在出现 Akamai CEO Tom Leighton:Agent 时代来临,云基础设施正从“中心化”转向“分布式边缘” 日均数百亿入库背后:从“人肉调度”到K8s弹性架构,度小满金融基于OceanBase重构入库架构实践 百度文库网盘发布GenFlow 4.0:月活用户超1亿,要把网盘变成全端AI工作台 Altman 投的 Agent 终端 Warp 开源了!斩获3.5万star 哪些客户需要拒, 敢让龙虾决定吗?_AI&大模型_InfoQ 中文站_InfoQ精选视频 从开发到生产:为什么越来越多的机器学习团队纷纷迁移到 Snowflake | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 探索多智能体工作流:LangGraph Snowflake Cortex AI | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 腾讯云分布式缓存数据库:AI Agent - 从提示词工程到 Harness 工程 | 腾讯云数据库 DBTalk_腾讯_凌敏_InfoQ精选视频 基于 Streamlit 为 CSV 数据构建分析智能体 | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 AI 智能体:告别文档缺漏 | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 构建 AI 驱动的数据管道:深度探讨 Snowflake Openflow 与非结构化数据 | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 云端太贵、本地不够聪明,英特尔押注“端云混合AI”:智能体PC会替人完成工作 不到10%的存储投入,可能拖垮90%的GPU投资!IBM把AI Agent塞进存储系统,算清企业最容易忽略的一笔账 Snowpark 上手实战 | BUILD 2025_大数据_王玮_InfoQ精选视频 ClickHouse + Langfuse,构建 Agent 可观测基石 腾讯云分布式缓存数据库:Cluster Proxy 共享连接架构深度解析 | 腾讯云数据库 DBTalk_腾讯_凌敏_InfoQ精选视频 AI 写代码太烧钱了:Copilot、Claude 一起涨价,不如把程序员请回来? 英特尔发布至强600系列工作站处理器与锐炫Pro B70 GPU,全新AI工作站来了 腾讯云分布式缓存数据库:从 Redis 到 Valkey - 开源社区如何快速创新 | 腾讯云数据库 DBTalk_腾讯_凌敏_InfoQ精选视频 印奇这次要“从0重做”智驾模型!首谈阶跃和千里双公司布局:中国AI商业闭环要靠车跑出来 从Cursor返聘归来,90后华裔女高管带Claude开启日更模式:token成本比工程师工资低多了! 从 Coding 到 Agent:QCon 北京 2026 全景复盘,优秀出品人 & 明星讲师名单揭晓 全链路支撑大模型国产化“Day 0适配”,商汤大装置构建全栈能力底座 凌晨,OpenAI 与亚马逊云科技史上最大联合发布来了 HashiCorp Vault 2.0 发布:引入新身份联邦机制,迈入 IBM 生命周期体系 Yelp 实现超 1,000 个 Cassandra 节点零停机升级 写了 17 年开源代码,我为什么认为 Coding Agents 堆功能是在瞎折腾? 基于 Apache Camel 编排智能体与多模态 AI 管道 面向智能体与人类用户的AI记忆系统:架构设计与核心场景实践|AICon上海 Anthropic 推出 Managed Agents,简化 AI 代理部署流程 阿里HappyHorse开启灰测,720P视频生成低至0.44元/秒 讯飞联合清华团队押注量子AI:不看营收、不设KPI,一群“无人区”科学家,抢夺下代AI算力入口 小米万亿模型全面开源:MIT 协议、1M 上下文,但还是打不过 DeepSeek Cortex Code 入门指南:面向数据工程师的实践路径 | 技术实践 openJiuwen社区首发Team Skills,定义Coordination Engineering新范式 用 Snowflake Cortex Agents 释放结构化数据的最大价值 | 技术实践 Grafana 利用 Kafka 对 Loki 进行了架构重构,并发布了一款命令行工具,旨在将可观测性引入编码代理 ClickHouse重构全文索引:对象存储上跑出高性能 Full-Text Search 可观测性和遥测技术如何提升软件工程实践 Dropbox 与 GitHub 合作,将单体库大小从 87GB 缩减至 20GB Agent 的下一站:基于长期记忆系统 EverOS 的自我演进|AICon上海 同一赛道,四种收费:Agent 控制层(Harness)开始分裂 Cloudflare Sandboxes 正式发布,为 AI 代理提供持久化隔离环境 Agent 的“记忆断片”困局,该怎么破?_AI&大模型_AICon 全球人工智能开发与应用大会_InfoQ精选视频 数据分析师如何快速建立在 AI 时代最值钱的能力:一份可落地的行动路线图 摩尔线程最新财报:研发占比超86%,万卡级大规模智算集群落地 当云区域失效:地缘动荡环境下的高可用重构 Slack 重构通知系统,设置参与度提升 5 倍 智能体工程的隐性技术债务 “我把所有模型都换成了DeepSeek V4”:月账单将降 90%,效果还更好 阿里云智能集团高级技术专家刘少伟已确认出席AICon上海站,并分享如何构建企业 Agent 的自动化行动架构 构建生产就绪的 tRPC API:Apollo Federation 的 TypeScript 替代方案 Anthropic推出面向Claude Code的基于智能体的代码审查功能 北京车展直击:斑马智能甩出车载Agent短剧,比亚迪率先落地,AI让智能座舱又热起来了 Snowflake 作为智能体运行时:从静态管道迈向自主数据系统 | 技术实践 Snowflake 上的本体体系:基于 Cortex Code 能力实现从架构到部署 | 技术实践 Cloudflare 公布 MCP 架构方案,应对企业面临的安全与治理风险 复杂的项目管理怎么做到「AI 友好」?飞书项目用「开放」给出答案 Snowflake Cortex Code 的规范驱动开发:将 SDLC 方法论引入 AI 辅助工作流 | 技术实践 Copilot 不让注册了:从“随便用”到“全面限”,agent 把原有订价模型顶穿了 当互联网用AI卷效率时,这家公司先问了一连串“能不能” Meta 开始记录员工每一次点击:AI 要接管工作,先监控会工作的人 Meta“Token榜”逼疯打工人,一夜烧掉公司几万刀!AI时代Token焦虑越来越离谱 智源FlagOS完成DeepSeek-V4-Flash在八款芯片Day0适配,实现三重技术突破 DeepSeek V4 重磅开源!首次打通华为Ascend,也没丢掉英伟达,百万上下文夺回国产模型话语权 李志飞的“新实验”:当超级个体撞上真实组织 GPT-5.5 登顶时刻,Anthropic 亲口承认 Claude 变笨了!网友群嘲:太敷衍 那些没空写的小需求,龙虾真能做吗?_AI&大模型_InfoQ 中文站_InfoQ精选视频 从 Pandas 到生产:使用任意 IDE 进行可扩展的 ML 数据管道与分布式处理 | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 pnpm 11 候选版本发布,带来 ESM 分发、供应链默认设置以及新的存储格式 银行业PDF表格提取方案重构:基于Java的分层方案 GPT-5.5 赢了 Opus 4.7 和 Mythos?奥特曼晒黄仁勋内部信:英伟达全员用上 Codex! Cloudflare 推出 Think:一款面向 AI 代理的持久化运行时 1850亿美元天价支出、75%代码由AI生成!谷歌正式宣告:全面转向智能体工作流 xAI落后太多,马斯克“开大”重金求购Cursor,100亿美金“分手费”都敢签! Pulumi 新增对 Bun 运行时的全面支持 姚顺雨腾讯模型首秀!不卷参数只做 “听话打工人”,Hy3 preview登场 | 附实测 老板让你“忽悠”投资人,你敢发给龙虾吗?_AI&大模型_InfoQ 中文站_InfoQ精选视频 Gemini CLI 引入子代理机制,实现任务委派与并行代理工作流 清华系团队星工聚将完成数千万天使轮融资,轮式机器人拿下头部制造企业亿级大单 Pretext.js 绕过 DOM 布局重排,实现 120 FPS 的高级交互体验 靠“AI 云”爆红的 Vercel,栽在一个第三方AI工具手里!IPO前夕遭黑,200万美元赎金谈崩? 高能研讨会|端侧 AI 正在重写实时感知效率上限_AI&大模型_王玮_InfoQ精选视频 2050大会看这篇就够了|报名、交通食宿指引大全 Java 近期资讯:OpenJDK JEP、Jakarta EE 12、Spring Framework、Micrometer、Camel、JBang 金融智能的架构编排:基于 Snowflake Cortex Agents 实现结构化与非结构化数据统一分析 | 技术实践 在AK大神爆火的任务里,摸清国产AI真实水平 百灵Ling-2.6-flash 正式发布:高 Token 效率,以 1/10 消耗实现 SOTA 级 Agent 能力 当 PM 懂AI,当技术懂产品:AI 时代产品力的双向进化|PM x AI产品力领航者大会即将开幕 为 AI 智能体设计记忆机制:揭秘 LinkedIn 的认知记忆智能体 获奖名单公布|2026主题征文第一期|分享你最有价值的龙虾场景与核心 Skill_热门活动_InfoQ写作社区官方_InfoQ写作社区
Codex 500万用户福利被怼“作秀”!Claude Code 吃掉近九成 Token,OpenAI 抢用户败在“小气”上?
褚杏娟 · 2026-06-03 · via InfoQ - 促进软件开发领域知识与创新的传播

“所有付费版 ChatGPT 订阅用户的 Codex 使用额度已完成重置。你的每周额度和每小时额度都应该已经恢复到 100%。今天就让 token 去创造些了不起的东西吧,玩得开心。”OpenAI Codex 负责人 Tibo 发帖称。

据悉,这一举措是为了庆祝 Codex 用户突破 500 万大关。这意味着,近期因达到 Codex 使用上限而受限的 ChatGPT 付费用户,可以重新获得完整额度,继续使用 Codex。已有用户确认,自己的周额度已从约 60% 恢复到 99%,表明本次重置已经在部分用户账户中生效。 此前,ChatGPT Plus、Pro 等用户达到使用限制后,需要购买额外 credits 以继续使用。

不过,用户们对此次 OpenAI 的重置“福利”的反应并不相同。

一部分用户对额度恢复表示欢迎,“我当时真的很努力得想用掉我的 token,哈哈”还有用户表示,“你额度重置的帖子,正好推了我一把,让我终于去试了试 fast 模式。我之前一直没用,是担心使用额度烧得太快。但这次额度重置之后,我就很容易拿它来跑真正的 eval 和 review-agent 工作了。现在,新鲜出炉的 token 已经给我带来过量多巴胺了。”

但更多人的态度是:“实际上,它并没有给大多数人带来任何真正的好处,只是表面上的重置而已。”

对许多人来说,新一周刚开始不到一天,额度还没来得及消耗多少,突然重置反而浪费。不少用户表示,自己的常规周重置刚刚发生不久,因此这次额外重置几乎没有带来实际收益。 

有用户询问当前是否按 5 倍计算,也有人问 100 美元订阅档是否不再拥有双倍使用量。帖子下方回复称,按太平洋时间计算,双倍额度仍会持续到当天结束。 

还有用户表示自己在这次本是“福利”的活动中反而亏了。“我的每周额度原本应该在 6 号重置,而且我除了打开应用查看重置日期之外,并没有实际使用额度。结果现在我的每周重置日期变成了 7 号。如果用户的额度本来还是 100%,这次统一重置就不应该把他的重置日期往后推。”Jimmni 说道。

对此,有网友回复解释称,“在小于 7 天的窗口期内,你不可能真正处于 100% 额度状态。你需要至少发送一条 prompt / 消息来启动这一周的计量周期,而这会让你的额度低于 100%(不过四舍五入后,界面上可能仍然显示为 100%)。”

Jimmni 回复称,他之前的经验是,只要打开应用,Codex 就会把 5 小时额度设成 99%、每周额度设成 100%,这样就足以“锁定”用户的重置日了,并不需要真的至少发送一条 prompt。其最后直接道,“对我来说,少了一天。这次重置对我完全是负面的。”

统一重置,确实能缓解部分高频用户的使用压力,但重置时机、双倍额度持续时间、不同订阅档位的权益差异,以及周额度窗口如何计算,仍是用户最关心、但也很难统一解决的问题。

Claude Code 8 倍于 Codex token 消耗

“美国人还没醒的时候先用 Claude;等美国用户上线、Claude 变慢之后,再切到 Codex。”Anthropic 一直拿用户来调整工具和定价策略,Codex 借此用户 500 万了,但 Claude Code 依然是开发者们首选。

AI 成本管理平台 CostHawk 发布“匿名人工智能工具排行榜”,试图用 Token 消耗量衡量开发者对 AI 编程工具的使用强度。该榜单覆盖 Claude Code、OpenAI Codex、Cursor 等 AI 开发工具,并以匿名别名展示用户排名,只公开 Token 数量、模型名称、时间戳和哈希后的项目 ID,不展示真实姓名、账号、邮箱,也不收集或存储提示词、模型回复和源代码。 

页面显示,CostHawk 榜单共追踪了 100 名 operator,总 Token 消耗达到 4159 亿。其中,榜首用户 LunarCircuit 使用量约为 525 亿 Token;榜单 Top 1% 用户贡献了 12.6% 的 Token 消耗,显示高强度 AI 编程用户对总体使用量具有明显拉动作用。 

从工具占比看,Claude Code 仍是当前榜单中的绝对主力。页面显示,Claude Code 消耗约 3697 亿 Token,占比 88.9%;Codex 消耗约 462 亿 Token,占比 11.1%;Cursor 消耗约 77 万 Token,占比接近 0%。榜单还显示,100 名 operator 中,有 96 名使用 Claude Code,43 名使用 Codex,2 名使用 Cursor。 

不过,值得关注的是,Codex 和 Claude Code 的设计不同,也会导致同一个任务的 token 消耗量有很大差异。有开发者在一次标准 Figma 集成任务中,在相同提示词、相同代码仓库、相同目标输出下,Codex 和 Claude Code 的 Token 消耗了现可显著差异:Codex 完成一项基准任务约消耗 7.2 万个 Token,而 Claude Code 约消耗 23.5 万个 Token,后者消耗量约为前者 3 倍。

另外,榜单进一步区分了用户类型:仅使用 Claude Code 的用户占 56%,多工具用户占 40%,仅使用 Codex 的用户占 3%,仅使用 Cursor 的用户占 1%。这意味着,在高强度 AI 编程用户中,Claude Code 仍是主入口,但相当一部分用户已经开始同时使用多款 AI 编程工具。 

在增长趋势上,Cursor 本月增长速度比 Codex 快 1.3 倍。其中,Cursor 本月增长 100%,Codex 增长 79.1%,Claude Code 增长 0.1%。不过,由于 Cursor 当前基数较小,其高速增长更多体现为早期扩张信号,尚未改变整体 Token 份额格局。 

“从 Claude Code 切换到 OpenAI Codex”这不是最近才兴起的话题。

月前,Reddit 上就有开发者询问,从 Claude Code 迁移到 Codex 的用户体验如何。发帖者称,自己过去数月一直使用 Claude Code Max x20,同时结合 Serena、MCP、GSD1 等工具,并在多个项目中并行使用,但经常遇到会话额度耗尽的问题。 

帖子下,部分开发者已经开始把 Codex 作为主力工具。一名拥有 30 多年开发经验的用户表示,Codex 对自己来说“能完成工作”,并认为 Codex 在编写更具未来可维护性的代码方面表现更好;相比之下,Claude 有时需要反复要求修正,尤其在前端任务上表现较弱。不过他也提醒,AI 工具不会对代码库承担长期责任,最终负责的人仍然是开发者自己。 

另一名有 20 年经验、在 FAANG 工作的工程师则表示,他通常会在 Claude Code 和 Codex 之间切换,尤其是在额度受限时。他认为,Codex 在最新版本中已经成为自己的首选,原因是反馈更快、推理更好,但他仍然倾向于同时保留两者,并在复杂设计和规划阶段让两个工具互相“对抗式”审查:先让一个工具形成方案,再让另一个工具提出批评。也有用户明确表示准备取消 Claude 订阅,完全依赖 Codex。

不过,不少用户认为,Claude Code 在规划模式和多智能体工作流上仍有优势。有开发者的工作流是:用 Claude Opus 进行规划,用 Codex 执行,再回到 Claude 做清理和优化。他认为,GPT 5.5 仍然会遗漏不少东西,Claude 在理解意图和整体设计上仍有不可替代之处。

额度和价格,是推动用户迁移的重要因素。一名此前几乎只使用 Claude Code 的开发者表示,自己转向 Codex 的主要原因就是使用限制。即便在每月 100 美元方案下,也可能几天内耗尽每周 token。他认为 Claude 更擅长理解目标,但 Codex 更擅长严格遵循指令。与此同时,他也指出 Codex 应用体验并不理想,自己主要使用 Codex CLI,且过去为 Claude 构建的插件和技能无法一键迁移,需要重写。 

该用户还提到,OpenAI 的核心聊天界面不计入同样的五小时窗口限制,因此可以用网页端进行初步规划或小型编码任务;而 Claude 网页聊天也会消耗同一订阅窗口,这使得 Claude 在重度开发场景中更容易受到限制。评论区也有人认为,这正是 Claude 难以与 OpenAI 竞争的原因之一。 

与此同时,也有用户提醒,频繁耗尽额度未必只与工具有关,可能也和工作流管理不当有关。有开发者指出,如果同时在 3 到 5 个项目中使用 Claude Code,首先要改进的是会话纪律,而不是简单更换工具。过长的历史记录、无目的浏览代码库以及插件过度堆叠,都会烧掉大量 token。即便换成 Codex,如果仍然不控制项目会话和任务切片,也可能只是“从一个供应商那里买到了同样的泥潭”。 

AI 编程:个人与团队间的 10 倍价差

随着 AI 编程工具的快速发展,其商业模式也正在收敛。

无论 Claude Code 还是 Codex,都采用了低门槛入门、高强度使用单独收费的模式,并形成了几乎相同的订阅分层:个人用户入门价格约为每月 20 美元,而面向高频专业开发者的高级档位则跳至每月 200 美元。

根据相关公开讨论和产品信息,80%-90%的用户通常远低于入门档限制,而前 5%-10%的高频用户贡献了绝大多数推理负载。对于厂商而言,如果继续采用过于宽松的固定价格模式,轻度用户将长期补贴重度用户,最终导致推理成本失控。因此,200 美元档位的作用,是将高消耗开发者单独分层,使真正高频、专业、依赖 AI 编程工具的人为更高算力消耗付费,同时避免普通用户为自己用不到的资源买单。

速率限制也进一步强化了这一分层。AI 编程工具通常会设置一定时间窗口内的使用上限,例如每隔数小时重置一次。当开发者在项目进行过程中频繁触及额度限制时,往往更倾向于升级到高阶订阅,而不是切换到其他工具。对于已经将 Claude Code 或 Codex 嵌入日常开发流程的用户来说,使用习惯和工作流本身也会提高迁移成本。

推理成本是这套价格结构形成的另一关键原因。前沿模型运行成本高昂,尤其是在涉及复杂推理、工具调用和代码执行时,重度用户的实际算力消耗可能远超订阅价格。有分析称,Claude Code Max 每月 200 美元订阅所提供的使用量,如果按随用随付的 API Token 价格计算,成本可能超过 1000 美元。

对厂商而言,200 美元固定订阅费既可以带来更稳定的高价值用户收入,也能在一定程度上对冲推理负载波动带来的成本风险。OpenAI 的 ChatGPT Pro 订阅推出后,曾被报道称在数月内带来显著年化收入增长;Anthropic 推出 Max 档位,也被视为对高频开发者需求和成本结构的直接回应。

这种定价方式对 AI 公司具有明显吸引力。20 美元档负责降低试用门槛、扩大用户基数和收集使用数据;200 美元档则承接那些从工具中获得更高商业价值、也更愿意由个人或公司报销费用的专业用户。相比难以预测的按 Token 计费,订阅收入也更便于厂商规划 GPU 集群、推理资源和研发预算。

这一趋势并不局限于 Anthropic 和 OpenAI。Cursor、Replit 等 AI IDE 和编程平台也已显示出类似阶梯式定价迹象。其底层逻辑基本相同:AI 编程工具的使用量差异极大,重度用户带来的推理成本远高于普通用户,厂商必须通过分层定价维持可持续商业模式。

不过,大趋势下的一些细节可能存在差异:Codex 正试图把 AI 编程能力做成一套可计量、可审计的 Token 经济系统,Claude Code 则更强调通过 Claude 统一工作台锁定开发者日常使用。

从产品定位看,Codex 正在从“ChatGPT 订阅附赠能力”转向“订阅额度 + Token 化计费”。OpenAI 先将 Codex 纳入 ChatGPT Plus、Pro、Business、Enterprise、Edu 等多个订阅方案,通过 ChatGPT 现有用户入口扩大覆盖面;随后再通过 Codex credits 和 token 费率,对高强度开发者使用进行货币化。

OpenAI 在 4 月初,将 Codex 定价从过去“按消息 / PR 平均扣点”,改为与 API token 用量对齐,即按每百万输入 Token、缓存输入 Token、输出 Token 消耗 credits。不同模型对应不同费率,输出 Token 通常明显更贵。这意味着,开发者的长上下文、多轮修复、长输出、代码审查等行为,都会被拆解回更细颗粒度的 Token 成本。

更值得关注的是 OpenAI 的促销策略。当前,OpenAI 为 Pro 100 美元档提供 2 倍 Codex 使用量,直到 2026 年 5 月 31 日,相当于将标准 5x 临时提升至 10x;Pro 200 美元档则在 20x Plus 的基础上,将 5 小时 Codex 限额临时维持在 25x Plus。这一设计,一方面是在用 100 美元档位正面卡位 Claude Max 5x,另一方面也是通过 200 美元档稳住真正的重度用户,降低其因额度焦虑转向 Claude Code 的可能性。

Anthropic 消耗不够透明,也更“企业定制”

相比之下,Anthropic 将 Claude、Claude Code、Claude Desktop 等入口统一纳入同一套订阅预算。Claude Code 的策略更像是在把 Claude 打造成开发者全天候工作台,而不是单独售卖一个 coding 产品。

这使得 Claude Code 的商业价值不仅来自代码工具本身,更来自对开发者日常工作流的锁定。一旦用户把 Claude Code 当作主力工具,Claude 在聊天、文档、代码、分析等场景中的整体订阅粘性都会增强。

不过,相比 Codex 将本地消息、云端任务、代码审查、模型窗口和 credits 拆得更清楚,Claude Code 的额度消耗对用户来说更难精确判断。

近日,Claude Mythos 25 美元/每百万输入 token 、125 美元/每百万输出 token 的定价,也引发了社区讨论。

“按这个价格,Mythos 上一次深度推理会话的成本,可能就相当于过去 Claude Sonnet 一整个月的使用费用。这个价位也会从根本上改变所有依赖长上下文推理的创业公司的经济模型。”有网友说道。

不少网友认为,这种高价策略正在进一步拉开个人用户与企业级用户之间的使用门槛,也显示出 Anthropic 正将高端能力更多瞄准基础设施层和生产环境,而非个人开发者。

有用户将其称为“给有钱技术宅准备的新档位”,甚至调侃可能会出现“1000 美元套餐”。类似“不适合穷人”的评论,也反映出社区对高端模型定价门槛的直观感受。有开发者调侃称,自己凌晨两点进行轻量级代码修改时,入门级模型已经足够使用,“他们想收多少钱就收多少”。另一位用户也表示,价格确实高,自己夜间写代码仍会使用预算型模型,把钱省下来用于周末出行,同时该开发者也好奇高端模型是否真的能提供与价格匹配的能力。

不过,部分用户认为价格并非完全不可接受。有网友提到,此前部分高端模型的 API 调用价格更高,因此当前价格在高端推理模型市场中并不算极端。也有人表示,如果已有最高订阅档位,或许能够承受这类模型的使用成本。

“若输出价格达到每百万 Token 125 美元,这一定价架构瞄准的并不是个人用户,而是基础设施层客户。”有开发者指出。

这场讨论也再次展现了模型的定价模式:低成本轻量模型可能继续承担日常使用和个人开发场景,而高价前沿模型则更多服务于高价值工作流、企业生产环境和基础设施层调用。而上面的订阅套餐列表项目可能还只是开始,未来或许有更多的可选项,同时开发者对各种收费花样可能也会越来越蒙圈。

AI 编程工具的路线分野

除了定价策略,AI 编程工具的路线也逐渐走出了差异。

开发者“Theo - t3․gg”认为,Claude Code 重体验与情绪,Codex 强调效率与验证,Cursor 押注云端工作流,这三个产品代表了三条不同的路线,三者真正的差异不在于“谁更聪明”,而在于背后团队对“未来如何构建软件”的理解完全不同。

Claude Code 的最大特点是选择从终端切入,而不是要求开发者切换 IDE、安装新应用或迁移到云端环境。它的优势在于“站在开发者已经所在的位置”,通过 CLI 直接接入现有工作流。

这种路径让 Claude Code 快速获得开发者接受。过去 Cursor 在 AI 编程工具中拥有很强的心智占位,但如今 Claude Code 已经接过这一位置。在一些创业者和开发者群体中,原本大量使用 Cursor 的人,已经明显转向 Claude Code。

不过,Theo - t3․gg 也指出,Claude Code 的另一面是强烈的“体验设计”和“营销属性”。他认为,Claude Code 不只是开发工具,也是 Anthropic 展示“用 Anthropic 模型构建 AI 应用”能力的窗口。其 sub-agent、pet mode、终端动画、token 计数、加载状态等设计,都在强化一种“事情正在大量发生”的生产力感,也非常适合在 X/Twitter 上截图传播。

在其看来,Claude Code 的底层哲学可以概括为:如果更多 token 能解决问题,那就使用更多 token。比如通过 sub-agent 并行检查项目、用大量 agent 审计代码、让模型在终端里执行更多操作。这种方式往往确实能让用户感觉“非常高产”,但也可能带来更高的 token 消耗和成本压力。

与 Claude Code 相比, Codex 的产品气质完全不同。Codex 的界面更克制,任务运行时没有大量动画、计数器或多 agent 展示,更多是一个简单的工作状态、计时器和任务输出。Theo - t3․gg 称,Codex “没有试图让自己像老虎机一样令人上瘾”,而是更强调把事情做完。

他多次提到,OpenAI 的 Codex 更关注真实工程问题,而不是社交媒体传播效果。例如,Codex 支持在 Mac 锁屏状态下继续使用电脑、支持新的 diff marker 设置、支持通过快捷键把当前应用画面发送给 Codex 作为上下文。这些功能并不适合截图传播,但能切实提高工程效率。

Theo - t3․gg 尤其强调 Codex 的 computer use 能力。随着模型能力提升,Codex 可以修改代码后实际查看运行结果、验证修改是否成功,而不是单纯依赖模型“想象”代码是否正确。他认为,这代表了 OpenAI 的核心思路:不是用更多 token 反复检查,而是用更好的环境和验证方式,让模型以更少 token 得到更可靠结果。

对于 Cursor,Theo - t3․gg 认为,外界低估了它的真正强项。Cursor 曾经是 AI 编程工具的第一心智,但随着 Claude Code 崛起,很多人把 Cursor 视为“退居第三”。他认为,这是因为很多人仍然只把 Cursor 当作 IDE 使用,而没有看到 Cursor Cloud 的能力。

在 Theo - t3․gg 看来,Cursor 的云端 agent 是三者中最接近未来形态的方案。Cursor Cloud 并不只是提供一个简单的 headless Linux sandbox,而是可以启动完整的图形化 Linux 环境,运行真实应用,再通过 computer use 测试修改结果。

这使得 Cursor 能够承担更多团队级、企业级任务。例如,在 Slack 中有人提出一个产品问题,团队成员可以直接 @Cursor bot,让它启动 agent 修复问题,并在同一 thread 中返回修复后的视频证明。他认为,这种“从协作工具发起任务,再返回可验证结果”的流程,是 Claude Code 和 Codex 当前都难以达到的。

因此,Theo - t3․gg 将三者定位为三个不同时间尺度的押注:Codex 押注当下,解决今天 agent 写代码如何更可靠的问题;Claude Code 押注几个月后的模型能力,认为模型会聪明到不必总是运行代码;Cursor 则押注更远未来,即开发者不再主要在本地电脑上运行 agent,而是通过 Slack、浏览器和云端环境触发任务。

此外,三家公司在开放性和生态策略上也存在明显差异:OpenAI 更愿意提供可构建的底层能力。例如,Codex CLI 中的 app server 为第三方 agentic coding 应用提供了构建基础,开发者可以在其上开发自己的工具。相比之下,Anthropic 更希望用户留在 Claude Code 自身 UI 和 CLI 体验里,把集成深度嵌入 Claude Code,而不是让外部工具以编程方式自由调用。Cursor 则有意向开放 SDK 和 agent 能力,但相关优先级和成熟度仍有不足。

在产品选择上,Theo - t3․gg 建议道,如果一个开发者讨厌写代码、缺乏动力,或者希望写代码过程更有趣、更有成就感,Claude Code 是一个很好的选择。它通过终端、多 agent、动画和强反馈机制,能让用户持续感受到“我正在高效推进”。

如果是经验丰富、对 AI 工具有怀疑精神的工程师,希望工具尽量少打扰自己,只在需要时可靠完成任务,那么 Codex 更合适。他认为,Codex 更像“由工程师构建、为工程师构建”的工具,强调稳定、验证和融入已有工作流。

参考链接:

https://x.com/thsottiaux/status/2061106703446450392

https://www.reddit.com/r/codex/comments/1tsydiy/reset_just_happened/?utm_source=chatgpt.com

https://costhawk.ai/leaderboard

https://techforward.io/why-the-20-to-200-pricing-leap-in-claude-code-and-codex/?utm_source=chatgpt.com

https://www.youtube.com/watch?v=JMYspR42HFM

https://www.youtube.com/watch?v=dcrASucavMk