惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

S
SegmentFault 最新的问题
V
Vulnerabilities – Threatpost
博客园_首页
GbyAI
GbyAI
Martin Fowler
Martin Fowler
S
Secure Thoughts
Help Net Security
Help Net Security
Attack and Defense Labs
Attack and Defense Labs
大猫的无限游戏
大猫的无限游戏
量子位
腾讯CDC
博客园 - 叶小钗
Threat Intelligence Blog | Flashpoint
Threat Intelligence Blog | Flashpoint
Microsoft Security Blog
Microsoft Security Blog
Cisco Talos Blog
Cisco Talos Blog
V
V2EX
P
Proofpoint News Feed
T
Tailwind CSS Blog
U
Unit 42
A
Arctic Wolf
PCI Perspectives
PCI Perspectives
B
Blog
F
Fortinet All Blogs
B
Blog RSS Feed
H
Hacker News: Front Page
P
Privacy & Cybersecurity Law Blog
Scott Helme
Scott Helme
G
GRAHAM CLULEY
Exploit-DB.com RSS Feed
Exploit-DB.com RSS Feed
H
Heimdal Security Blog
人人都是产品经理
人人都是产品经理
Forbes - Security
Forbes - Security
TaoSecurity Blog
TaoSecurity Blog
N
Netflix TechBlog - Medium
aimingoo的专栏
aimingoo的专栏
Security Archives - TechRepublic
Security Archives - TechRepublic
Y
Y Combinator Blog
Jina AI
Jina AI
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
Latest news
Latest news
P
Privacy International News Feed
SecWiki News
SecWiki News
L
LINUX DO - 最新话题
M
MIT News - Artificial intelligence
W
WeLiveSecurity
博客园 - 聂微东
T
Tor Project blog
T
Troy Hunt's Blog
cs.CL updates on arXiv.org
cs.CL updates on arXiv.org
Engineering at Meta
Engineering at Meta

InfoQ - 促进软件开发领域知识与创新的传播

Meta 收购 Manus 这事儿泡汤了 5.5万 Star 开源项目 Ghostty 被迫出走,GitHub 正在终结一代技术人的乌托邦 Slack 长时运行多智能体系统的上下文管理方案 从 T+1 到分钟级:金城银行基于 Apache Doris 构建高可靠、强一致的实时数据平台 谷歌云推出 Agents CLI,简化 AI 智能体开发全流程 Claude官方击穿高薪、高学历的安全防线!Anthropic点名10大高危职业,但有群人暂时稳了 亚马逊云科技终止 WorkMail 服务,并将 App Runner 转入维护模式 OPPO小布记忆:全模态碎片化内容的理解与智能整理实践|AICon上海 模力工场038周AI应用周榜:工具在消失,工作流在出现 Akamai CEO Tom Leighton:Agent 时代来临,云基础设施正从“中心化”转向“分布式边缘” 日均数百亿入库背后:从“人肉调度”到K8s弹性架构,度小满金融基于OceanBase重构入库架构实践 百度文库网盘发布GenFlow 4.0:月活用户超1亿,要把网盘变成全端AI工作台 Altman 投的 Agent 终端 Warp 开源了!斩获3.5万star 哪些客户需要拒, 敢让龙虾决定吗?_AI&大模型_InfoQ 中文站_InfoQ精选视频 从开发到生产:为什么越来越多的机器学习团队纷纷迁移到 Snowflake | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 探索多智能体工作流:LangGraph Snowflake Cortex AI | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 腾讯云分布式缓存数据库:AI Agent - 从提示词工程到 Harness 工程 | 腾讯云数据库 DBTalk_腾讯_凌敏_InfoQ精选视频 基于 Streamlit 为 CSV 数据构建分析智能体 | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 AI 智能体:告别文档缺漏 | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 构建 AI 驱动的数据管道:深度探讨 Snowflake Openflow 与非结构化数据 | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 云端太贵、本地不够聪明,英特尔押注“端云混合AI”:智能体PC会替人完成工作 不到10%的存储投入,可能拖垮90%的GPU投资!IBM把AI Agent塞进存储系统,算清企业最容易忽略的一笔账 Snowpark 上手实战 | BUILD 2025_大数据_王玮_InfoQ精选视频 ClickHouse + Langfuse,构建 Agent 可观测基石 腾讯云分布式缓存数据库:Cluster Proxy 共享连接架构深度解析 | 腾讯云数据库 DBTalk_腾讯_凌敏_InfoQ精选视频 AI 写代码太烧钱了:Copilot、Claude 一起涨价,不如把程序员请回来? 英特尔发布至强600系列工作站处理器与锐炫Pro B70 GPU,全新AI工作站来了 腾讯云分布式缓存数据库:从 Redis 到 Valkey - 开源社区如何快速创新 | 腾讯云数据库 DBTalk_腾讯_凌敏_InfoQ精选视频 印奇这次要“从0重做”智驾模型!首谈阶跃和千里双公司布局:中国AI商业闭环要靠车跑出来 从Cursor返聘归来,90后华裔女高管带Claude开启日更模式:token成本比工程师工资低多了! 从 Coding 到 Agent:QCon 北京 2026 全景复盘,优秀出品人 & 明星讲师名单揭晓 全链路支撑大模型国产化“Day 0适配”,商汤大装置构建全栈能力底座 凌晨,OpenAI 与亚马逊云科技史上最大联合发布来了 HashiCorp Vault 2.0 发布:引入新身份联邦机制,迈入 IBM 生命周期体系 Yelp 实现超 1,000 个 Cassandra 节点零停机升级 写了 17 年开源代码,我为什么认为 Coding Agents 堆功能是在瞎折腾? 基于 Apache Camel 编排智能体与多模态 AI 管道 面向智能体与人类用户的AI记忆系统:架构设计与核心场景实践|AICon上海 Anthropic 推出 Managed Agents,简化 AI 代理部署流程 阿里HappyHorse开启灰测,720P视频生成低至0.44元/秒 讯飞联合清华团队押注量子AI:不看营收、不设KPI,一群“无人区”科学家,抢夺下代AI算力入口 小米万亿模型全面开源:MIT 协议、1M 上下文,但还是打不过 DeepSeek Cortex Code 入门指南:面向数据工程师的实践路径 | 技术实践 openJiuwen社区首发Team Skills,定义Coordination Engineering新范式 用 Snowflake Cortex Agents 释放结构化数据的最大价值 | 技术实践 Grafana 利用 Kafka 对 Loki 进行了架构重构,并发布了一款命令行工具,旨在将可观测性引入编码代理 ClickHouse重构全文索引:对象存储上跑出高性能 Full-Text Search 可观测性和遥测技术如何提升软件工程实践 Dropbox 与 GitHub 合作,将单体库大小从 87GB 缩减至 20GB Agent 的下一站:基于长期记忆系统 EverOS 的自我演进|AICon上海 同一赛道,四种收费:Agent 控制层(Harness)开始分裂 Cloudflare Sandboxes 正式发布,为 AI 代理提供持久化隔离环境 Agent 的“记忆断片”困局,该怎么破?_AI&大模型_AICon 全球人工智能开发与应用大会_InfoQ精选视频 数据分析师如何快速建立在 AI 时代最值钱的能力:一份可落地的行动路线图 摩尔线程最新财报:研发占比超86%,万卡级大规模智算集群落地 当云区域失效:地缘动荡环境下的高可用重构 Slack 重构通知系统,设置参与度提升 5 倍 智能体工程的隐性技术债务 “我把所有模型都换成了DeepSeek V4”:月账单将降 90%,效果还更好 阿里云智能集团高级技术专家刘少伟已确认出席AICon上海站,并分享如何构建企业 Agent 的自动化行动架构 构建生产就绪的 tRPC API:Apollo Federation 的 TypeScript 替代方案 Anthropic推出面向Claude Code的基于智能体的代码审查功能 北京车展直击:斑马智能甩出车载Agent短剧,比亚迪率先落地,AI让智能座舱又热起来了 Snowflake 作为智能体运行时:从静态管道迈向自主数据系统 | 技术实践 Snowflake 上的本体体系:基于 Cortex Code 能力实现从架构到部署 | 技术实践 Cloudflare 公布 MCP 架构方案,应对企业面临的安全与治理风险 复杂的项目管理怎么做到「AI 友好」?飞书项目用「开放」给出答案 Snowflake Cortex Code 的规范驱动开发:将 SDLC 方法论引入 AI 辅助工作流 | 技术实践 Copilot 不让注册了:从“随便用”到“全面限”,agent 把原有订价模型顶穿了 当互联网用AI卷效率时,这家公司先问了一连串“能不能” Meta 开始记录员工每一次点击:AI 要接管工作,先监控会工作的人 Meta“Token榜”逼疯打工人,一夜烧掉公司几万刀!AI时代Token焦虑越来越离谱 智源FlagOS完成DeepSeek-V4-Flash在八款芯片Day0适配,实现三重技术突破 DeepSeek V4 重磅开源!首次打通华为Ascend,也没丢掉英伟达,百万上下文夺回国产模型话语权 李志飞的“新实验”:当超级个体撞上真实组织 GPT-5.5 登顶时刻,Anthropic 亲口承认 Claude 变笨了!网友群嘲:太敷衍 那些没空写的小需求,龙虾真能做吗?_AI&大模型_InfoQ 中文站_InfoQ精选视频 从 Pandas 到生产:使用任意 IDE 进行可扩展的 ML 数据管道与分布式处理 | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 pnpm 11 候选版本发布,带来 ESM 分发、供应链默认设置以及新的存储格式 银行业PDF表格提取方案重构:基于Java的分层方案 GPT-5.5 赢了 Opus 4.7 和 Mythos?奥特曼晒黄仁勋内部信:英伟达全员用上 Codex! Cloudflare 推出 Think:一款面向 AI 代理的持久化运行时 1850亿美元天价支出、75%代码由AI生成!谷歌正式宣告:全面转向智能体工作流 xAI落后太多,马斯克“开大”重金求购Cursor,100亿美金“分手费”都敢签! Pulumi 新增对 Bun 运行时的全面支持 姚顺雨腾讯模型首秀!不卷参数只做 “听话打工人”,Hy3 preview登场 | 附实测 老板让你“忽悠”投资人,你敢发给龙虾吗?_AI&大模型_InfoQ 中文站_InfoQ精选视频 Gemini CLI 引入子代理机制,实现任务委派与并行代理工作流 清华系团队星工聚将完成数千万天使轮融资,轮式机器人拿下头部制造企业亿级大单 Pretext.js 绕过 DOM 布局重排,实现 120 FPS 的高级交互体验 靠“AI 云”爆红的 Vercel,栽在一个第三方AI工具手里!IPO前夕遭黑,200万美元赎金谈崩? 高能研讨会|端侧 AI 正在重写实时感知效率上限_AI&大模型_王玮_InfoQ精选视频 2050大会看这篇就够了|报名、交通食宿指引大全 Java 近期资讯:OpenJDK JEP、Jakarta EE 12、Spring Framework、Micrometer、Camel、JBang 金融智能的架构编排:基于 Snowflake Cortex Agents 实现结构化与非结构化数据统一分析 | 技术实践 在AK大神爆火的任务里,摸清国产AI真实水平 百灵Ling-2.6-flash 正式发布:高 Token 效率,以 1/10 消耗实现 SOTA 级 Agent 能力 当 PM 懂AI,当技术懂产品:AI 时代产品力的双向进化|PM x AI产品力领航者大会即将开幕 为 AI 智能体设计记忆机制:揭秘 LinkedIn 的认知记忆智能体 获奖名单公布|2026主题征文第一期|分享你最有价值的龙虾场景与核心 Skill_热门活动_InfoQ写作社区官方_InfoQ写作社区
这家Agent 公司从 Claude 切到 DeepSeek v4:一年省下数百万美元,迁移工作量却是预期的 100 倍
Paul Sawers平川Tina · 2026-06-25 · via InfoQ - 促进软件开发领域知识与创新的传播

本文最初发布于博客 TheNewStack。

初创公司 Lindy 将其全部 AI 代理流量从 Anthropic 转移到了 DeepSeek v4,每年可以节省数百万美元的推理成本。首席执行官 Flo Crivello 解释了为什么迁移工作比预期多出许多。

图片来自 Unsplash+,由用户 Space Stock 提供

推理成本 已经成为可持续 AI 部署的最大障碍。最近,GitHub 放弃 了其 Copilot 订阅的统一费率,转而采用基于使用的计费方式,因为代理编码会话的成本超出了固定月费能够覆盖的范围——一些订阅者醒来时发现,他们的账单比之前高出数倍。与此同时,在短短四个月内,Uber 就烧光了 2026 年整年的 AI 预算,主要是在 Claude Code 上。这让首席运营官产生了质疑,他们所获得的回报是否值得这笔支出。

为应对这一更广泛的行业反思,Linux 基金会成立了 Tokenomics 基金会, 得到了谷歌、微软、IBM、Salesforce 等企业的支持。该基金会旨在围绕 AI Token 成本建立一个开放的标准。这一举措表明,业界已经意识到,企业目前尚无统一的方法来衡量或控制这方面的支出。

转型

对于大量运行 AI 代理的公司来说,前沿模型的经济性已经成为一个几乎关乎生存的问题。

Flo Crivello(前 Uber 工程师兼产品负责人)是 Lindy 的创始人兼首席执行官。Lindy 是一个无代码 AI 代理平台,可以自动化日常工作任务——从电子邮件分类和会议安排到 CRM 管理。作为 Teamflow 的转型举措,Crivello 在 2023 年创立了 Lindy。前者是一个他之前筹集了 5200 万美元 的资金创办的一家虚拟办公室初创公司。这些资本现在被用于支持 Lindy 的发展。

Lindy

上周,Crivello 在社交媒体上 宣布,Lindy 已经将其整个模型基础设施从 Anthropic 切换到了 DeepSeek。

Crivello 在 X 上写道,“今天我们扣动了扳机,将 100% 的 Lindy 流量从 Anthropic 模型切换到了 DeepSeek v4。这每年能为我们节省数百万美元,而且,我们在许多核心用例上看到了性能提升。对业务来说,这是变革性的。”

实际上,Crivello 早在几个月前就 暗示过他的意图。4 月份的时候,他曾经 在 X 上写道,推理是 Lindy 占比最高的单项支出(超过了工资单),并且只用了一年时间,开源大模型就从“远不及闭源模型”发展到了“在大多数使用场景中都跻身前沿水平”。他说,当时 Lindy 差点将 Kimi K2.5(来自中国 AI 公司 Moonshot AI 的一个模型)作为其默认设置,不过后来他们转向了总部位于北京的 Zhipu AI 开发的 GLM-5.1。

最终,这家公司选择了 DeepSeek v4,这是中国 AI 研究公司 DeepSeek 的一个旗舰开源模型。

当然,在全面投入生产的情况下从一家模型供应商切换到另一家绝非易事。Crivello 告诉 The New Stack,完成这一过程所需的时间取决于从何时开始计算。但无论如何,这都是一项艰巨的任务。

Crivello 解释道,“我们一直在考虑进行这次转型,并评估新的开源软件(OSS)方案已有 6 到 9 个月的时间,而 DeepSeek 自发布以来,我们也一直在关注它,大约有 2 个月了”。

值得注意的是,迁移工作比 Crivello 最初的预期要繁重许多。他说,“比我们想象的工作要多 100 倍”。评估(在现实世界的任务中系统性地测试新模型,验证它能否媲美甚或超过 Anthropic 模型的性能)是其中的一个重要部分。

Crivello 说,“模型评估的工作量很大,包括在线评估、离线评估,还有大量‘氛围评估’。[随后我们] 分阶段上线了在线评估,同时观察其对用户留存率的影响;[接着] 针对新模型调整了提示词。”

仅看成本节省这一项,还不足以证明这项工作的合理性。但性能结果给了 Crivello 更多的信心,特别是在其核心用例上,包括电子邮件收件箱分类和根据用户的反馈预先起草回复。

Crivello 解释说,“正是在那些任务中,我们看到了 DeepSeek 所带来的惊人的性能提升。”不过他也指出,在一些复杂的自动化任务上,DeepSeek 仍然落后于 Anthropic。

他说,“在工作流自动化方面,它仍然不如 Sonnet,不过,这对我们来说并不重要。”

DeepSeek 时刻

要理解 Lindy 的转型为何如此重要,了解 DeepSeek 在 AI 行业中所代表的意义会有所帮助。

2025 年 1 月,DeepSeek 公司在硅谷引起了轩然大波:其 R1 模型以极低的成本达到了与美国顶尖前沿模型相当的性能水平。这使得英伟达的股价出现了 一轮短暂但剧烈的抛售,投资者开始质疑关于 AI 计算需求的基本假设。此后,该公司接连发布新产品,不断缩小与前沿领域的差距。

2026 年 4 月发布的 DeepSeek V4 预览版 标志着又一次重大飞跃,而且不仅仅体现在价格上。在 LinkedIn 上,瑞士洛桑联邦理工学院(EPFL)教授、EPFL 人工智能中心联合主任 Marcel Salathe 指出,从地缘政治的角度来看,V4 有着更深远的意义:这是首次出现从芯片、框架到模型完全由中国自主研发的尖端 AI 技术栈。据悉,DeepSeek 耗时数月重写了 v4 版本,使其能在 CANN(华为版 Nvidia CUDA)上运行,从而 降低了对美国芯片基础设施的依赖。

这种地缘政治格局的转变带来了直接的商业影响。正如 The New Stack 此前报道 的那样,以中国人工智能实验室为主的廉价开放权重模型的出现,将 AI 模型市场一分为二:一端是 OpenAI 和 Anthropic 等公司推出的超高端前沿模型,另一端则是价格大幅降低的开放权重替代方案,而原本舒适的中间地带正在逐渐萎缩。数据印证了这一趋势:作为连接应用程序与 AI 服务提供商的中介平台,Vercel 的 AI Gateway 数据显示,DeepSeek 在 5 月单月内的 Token 交易量份额从不足 1% 跃升至 17%,而其实际支出份额仍维持在 1% 左右,这恰恰反映出这些 Token 的实际成本有多么低廉。

对于像 Lindy 这样大规模运行代理的公司而言,这种两极分化迫使他们不得不认真思考该选择哪种商业模式。对于 Lindy 的创始人来说,由于推理成本已经超过薪资支出,这个问题其实只是时间早晚的问题。

Lindy 最终选择了 Atlas Cloud——这家总部位于美国的推理服务提供商在美国本土托管 DeepSeek v4 模型。鉴于围绕中国开发模型的数据主权问题往往备受关注,这一点尤为重要。在回应 X 平台上一位评论者 的提问时,Crivello 直接谈及了此事。他指出,该模型由一家美国服务商在美国境内托管,并且在评估了“所有主要供应商”后,Atlas 脱颖而出。值得一提的是,自主托管从未被列入他们的考虑范围。

他说,“我们没有认真考虑过[自托管],不,那看起来会分散我们很大的注意力。”

发展前景和未来计划

虽然 Crivello 表示,此次转型最终为 Lindy 节省了数百万美元,但对于一家风险投资支持的公司来说,这对其发展前景的影响非常深远。

但具体有多少呢?Crivello 说,”很多“。

至于这一举措是否是永久性的,Crivello 并没有明确表态。他说,“世上没有什么是永恒的。如果 Anthropic 的下一次发布能让他们重新赢得我们的业务,我也不会感到惊讶,但他们需要大幅降价。”

同样值得注意的是,Lindy 仍然是 Anthropic 的客户,只是不是其核心产品。该公司仍然在内部使用 Claude,因为订阅方案的经济性使其变得可行。

Crivello 说,“我们内部使用的是 Max plan。如果没有它,那么我们就必须支付完整的 Token 价格,要是这样的话,我们会转向其他东西”。

关于 Lindy 最终是否可能被迫在其外部产品中重新采用 Anthropic 模型,在回应 Amp CEO 兼创始人 Quinn Slack 的 问题 时,Crivello 暗示这并非完全不可能。他 写道,“当我们检测到 Lindy 在任务中失败时,我们可能仍然会升级到 Opus,但那将是少数情况。”

Crivello 的观点是,像 Lindy 这样的公司(大型 Token 消费者)别无选择,只能采取行动。他说,“像我们这样在 Token 上花很多钱的公司,100% 要行动。不这么做将是不负责任的。其他公司要看具体情况,但我认为很多人只是认品牌。”

原文链接:

https://thenewstack.io/lindy-deepseek-anthropic-switch/

声明:本文为 InfoQ 翻译,未经许可禁止转载。

今日好文推荐

吴恩达戳破AI幻象:炒作过头了,未来公司是10人小队+Agent重做数据架构

Meta 几周内毁掉二十年工程文化,给所有“AI 优先”公司上了一课

终端开发秒变可交互、实时网页!Claude Code 刚刚更新:AI 编程进入看板协作时代

狂烧 Token 却赚不到钱?这家清华系 AI Infra 独角兽已破解算力成本难题