惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

T
Tenable Blog
K
KPMG report finds enterprise disconnect between AI and its ROI | CIO
V
Vulnerabilities – Threatpost
G
GRAHAM CLULEY
Simon Willison's Weblog
Simon Willison's Weblog
C
CXSECURITY Database RSS Feed - CXSecurity.com
P
Privacy International News Feed
H
Heimdal Security Blog
Exploit-DB.com RSS Feed
Exploit-DB.com RSS Feed
S
Secure Thoughts
MyScale Blog
MyScale Blog
C
Cyber Attacks, Cyber Crime and Cyber Security
V
Visual Studio Blog
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
L
LINUX DO - 最新话题
D
Darknet – Hacking Tools, Hacker News & Cyber Security
The Cloudflare Blog
美团技术团队
Recorded Future
Recorded Future
T
Tailwind CSS Blog
Latest news
Latest news
Security Archives - TechRepublic
Security Archives - TechRepublic
Security Latest
Security Latest
Know Your Adversary
Know Your Adversary
Cloudbric
Cloudbric
Schneier on Security
Schneier on Security
I
Intezer
L
LINUX DO - 热门话题
P
Palo Alto Networks Blog
云风的 BLOG
云风的 BLOG
cs.CL updates on arXiv.org
cs.CL updates on arXiv.org
Vercel News
Vercel News
Attack and Defense Labs
Attack and Defense Labs
人人都是产品经理
人人都是产品经理
L
LangChain Blog
爱范儿
爱范儿
博客园 - 三生石上(FineUI控件)
博客园 - 叶小钗
L
Lohrmann on Cybersecurity
S
SegmentFault 最新的问题
W
WeLiveSecurity
C
Cybersecurity and Infrastructure Security Agency CISA
S
Securelist
SecWiki News
SecWiki News
V2EX - 技术
V2EX - 技术
IT之家
IT之家
Cyberwarzone
Cyberwarzone
F
Full Disclosure
Spread Privacy
Spread Privacy
阮一峰的网络日志
阮一峰的网络日志

InfoQ - 促进软件开发领域知识与创新的传播

Meta 收购 Manus 这事儿泡汤了 5.5万 Star 开源项目 Ghostty 被迫出走,GitHub 正在终结一代技术人的乌托邦 Slack 长时运行多智能体系统的上下文管理方案 从 T+1 到分钟级:金城银行基于 Apache Doris 构建高可靠、强一致的实时数据平台 谷歌云推出 Agents CLI,简化 AI 智能体开发全流程 Claude官方击穿高薪、高学历的安全防线!Anthropic点名10大高危职业,但有群人暂时稳了 亚马逊云科技终止 WorkMail 服务,并将 App Runner 转入维护模式 OPPO小布记忆:全模态碎片化内容的理解与智能整理实践|AICon上海 模力工场038周AI应用周榜:工具在消失,工作流在出现 Akamai CEO Tom Leighton:Agent 时代来临,云基础设施正从“中心化”转向“分布式边缘” 日均数百亿入库背后:从“人肉调度”到K8s弹性架构,度小满金融基于OceanBase重构入库架构实践 百度文库网盘发布GenFlow 4.0:月活用户超1亿,要把网盘变成全端AI工作台 Altman 投的 Agent 终端 Warp 开源了!斩获3.5万star 哪些客户需要拒, 敢让龙虾决定吗?_AI&大模型_InfoQ 中文站_InfoQ精选视频 从开发到生产:为什么越来越多的机器学习团队纷纷迁移到 Snowflake | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 探索多智能体工作流:LangGraph Snowflake Cortex AI | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 腾讯云分布式缓存数据库:AI Agent - 从提示词工程到 Harness 工程 | 腾讯云数据库 DBTalk_腾讯_凌敏_InfoQ精选视频 基于 Streamlit 为 CSV 数据构建分析智能体 | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 AI 智能体:告别文档缺漏 | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 构建 AI 驱动的数据管道:深度探讨 Snowflake Openflow 与非结构化数据 | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 云端太贵、本地不够聪明,英特尔押注“端云混合AI”:智能体PC会替人完成工作 不到10%的存储投入,可能拖垮90%的GPU投资!IBM把AI Agent塞进存储系统,算清企业最容易忽略的一笔账 Snowpark 上手实战 | BUILD 2025_大数据_王玮_InfoQ精选视频 ClickHouse + Langfuse,构建 Agent 可观测基石 腾讯云分布式缓存数据库:Cluster Proxy 共享连接架构深度解析 | 腾讯云数据库 DBTalk_腾讯_凌敏_InfoQ精选视频 AI 写代码太烧钱了:Copilot、Claude 一起涨价,不如把程序员请回来? 英特尔发布至强600系列工作站处理器与锐炫Pro B70 GPU,全新AI工作站来了 腾讯云分布式缓存数据库:从 Redis 到 Valkey - 开源社区如何快速创新 | 腾讯云数据库 DBTalk_腾讯_凌敏_InfoQ精选视频 印奇这次要“从0重做”智驾模型!首谈阶跃和千里双公司布局:中国AI商业闭环要靠车跑出来 从Cursor返聘归来,90后华裔女高管带Claude开启日更模式:token成本比工程师工资低多了! 从 Coding 到 Agent:QCon 北京 2026 全景复盘,优秀出品人 & 明星讲师名单揭晓 全链路支撑大模型国产化“Day 0适配”,商汤大装置构建全栈能力底座 凌晨,OpenAI 与亚马逊云科技史上最大联合发布来了 HashiCorp Vault 2.0 发布:引入新身份联邦机制,迈入 IBM 生命周期体系 Yelp 实现超 1,000 个 Cassandra 节点零停机升级 写了 17 年开源代码,我为什么认为 Coding Agents 堆功能是在瞎折腾? 基于 Apache Camel 编排智能体与多模态 AI 管道 面向智能体与人类用户的AI记忆系统:架构设计与核心场景实践|AICon上海 Anthropic 推出 Managed Agents,简化 AI 代理部署流程 阿里HappyHorse开启灰测,720P视频生成低至0.44元/秒 讯飞联合清华团队押注量子AI:不看营收、不设KPI,一群“无人区”科学家,抢夺下代AI算力入口 小米万亿模型全面开源:MIT 协议、1M 上下文,但还是打不过 DeepSeek Cortex Code 入门指南:面向数据工程师的实践路径 | 技术实践 openJiuwen社区首发Team Skills,定义Coordination Engineering新范式 用 Snowflake Cortex Agents 释放结构化数据的最大价值 | 技术实践 Grafana 利用 Kafka 对 Loki 进行了架构重构,并发布了一款命令行工具,旨在将可观测性引入编码代理 ClickHouse重构全文索引:对象存储上跑出高性能 Full-Text Search 可观测性和遥测技术如何提升软件工程实践 Dropbox 与 GitHub 合作,将单体库大小从 87GB 缩减至 20GB Agent 的下一站:基于长期记忆系统 EverOS 的自我演进|AICon上海 同一赛道,四种收费:Agent 控制层(Harness)开始分裂 Cloudflare Sandboxes 正式发布,为 AI 代理提供持久化隔离环境 Agent 的“记忆断片”困局,该怎么破?_AI&大模型_AICon 全球人工智能开发与应用大会_InfoQ精选视频 数据分析师如何快速建立在 AI 时代最值钱的能力:一份可落地的行动路线图 摩尔线程最新财报:研发占比超86%,万卡级大规模智算集群落地 当云区域失效:地缘动荡环境下的高可用重构 Slack 重构通知系统,设置参与度提升 5 倍 智能体工程的隐性技术债务 “我把所有模型都换成了DeepSeek V4”:月账单将降 90%,效果还更好 阿里云智能集团高级技术专家刘少伟已确认出席AICon上海站,并分享如何构建企业 Agent 的自动化行动架构 构建生产就绪的 tRPC API:Apollo Federation 的 TypeScript 替代方案 Anthropic推出面向Claude Code的基于智能体的代码审查功能 北京车展直击:斑马智能甩出车载Agent短剧,比亚迪率先落地,AI让智能座舱又热起来了 Snowflake 作为智能体运行时:从静态管道迈向自主数据系统 | 技术实践 Snowflake 上的本体体系:基于 Cortex Code 能力实现从架构到部署 | 技术实践 Cloudflare 公布 MCP 架构方案,应对企业面临的安全与治理风险 复杂的项目管理怎么做到「AI 友好」?飞书项目用「开放」给出答案 Snowflake Cortex Code 的规范驱动开发:将 SDLC 方法论引入 AI 辅助工作流 | 技术实践 Copilot 不让注册了:从“随便用”到“全面限”,agent 把原有订价模型顶穿了 当互联网用AI卷效率时,这家公司先问了一连串“能不能” Meta 开始记录员工每一次点击:AI 要接管工作,先监控会工作的人 Meta“Token榜”逼疯打工人,一夜烧掉公司几万刀!AI时代Token焦虑越来越离谱 智源FlagOS完成DeepSeek-V4-Flash在八款芯片Day0适配,实现三重技术突破 DeepSeek V4 重磅开源!首次打通华为Ascend,也没丢掉英伟达,百万上下文夺回国产模型话语权 李志飞的“新实验”:当超级个体撞上真实组织 GPT-5.5 登顶时刻,Anthropic 亲口承认 Claude 变笨了!网友群嘲:太敷衍 那些没空写的小需求,龙虾真能做吗?_AI&大模型_InfoQ 中文站_InfoQ精选视频 从 Pandas 到生产:使用任意 IDE 进行可扩展的 ML 数据管道与分布式处理 | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 pnpm 11 候选版本发布,带来 ESM 分发、供应链默认设置以及新的存储格式 银行业PDF表格提取方案重构:基于Java的分层方案 GPT-5.5 赢了 Opus 4.7 和 Mythos?奥特曼晒黄仁勋内部信:英伟达全员用上 Codex! Cloudflare 推出 Think:一款面向 AI 代理的持久化运行时 1850亿美元天价支出、75%代码由AI生成!谷歌正式宣告:全面转向智能体工作流 xAI落后太多,马斯克“开大”重金求购Cursor,100亿美金“分手费”都敢签! Pulumi 新增对 Bun 运行时的全面支持 姚顺雨腾讯模型首秀!不卷参数只做 “听话打工人”,Hy3 preview登场 | 附实测 老板让你“忽悠”投资人,你敢发给龙虾吗?_AI&大模型_InfoQ 中文站_InfoQ精选视频 Gemini CLI 引入子代理机制,实现任务委派与并行代理工作流 清华系团队星工聚将完成数千万天使轮融资,轮式机器人拿下头部制造企业亿级大单 Pretext.js 绕过 DOM 布局重排,实现 120 FPS 的高级交互体验 靠“AI 云”爆红的 Vercel,栽在一个第三方AI工具手里!IPO前夕遭黑,200万美元赎金谈崩? 高能研讨会|端侧 AI 正在重写实时感知效率上限_AI&大模型_王玮_InfoQ精选视频 2050大会看这篇就够了|报名、交通食宿指引大全 Java 近期资讯:OpenJDK JEP、Jakarta EE 12、Spring Framework、Micrometer、Camel、JBang 金融智能的架构编排:基于 Snowflake Cortex Agents 实现结构化与非结构化数据统一分析 | 技术实践 在AK大神爆火的任务里,摸清国产AI真实水平 百灵Ling-2.6-flash 正式发布:高 Token 效率,以 1/10 消耗实现 SOTA 级 Agent 能力 当 PM 懂AI,当技术懂产品:AI 时代产品力的双向进化|PM x AI产品力领航者大会即将开幕 为 AI 智能体设计记忆机制:揭秘 LinkedIn 的认知记忆智能体 获奖名单公布|2026主题征文第一期|分享你最有价值的龙虾场景与核心 Skill_热门活动_InfoQ写作社区官方_InfoQ写作社区
Agent时代需要怎样的分布式基础设施
作者:梁义 · 2026-05-08 · via InfoQ - 促进软件开发领域知识与创新的传播

Agent 应用时代已呼之欲出

自本轮大模型技术爆发以来,Agent 得到了广泛关注。进入 2026 年后,伴随 OpenClaw 的现象级爆火,Agent 更是彻底破圈,进入了更广阔的大众视野。同时,如果说以往的 Agent 更多用于 Demo 或一些相对定制的场景,那么经过最近一年 Agent Skills 等技术的出现和逐渐成熟,如今的 Agent 已经可以处理更多的实际场景,可以认为 Agent 应用形态的时代可能即将到来。

Agent 应用的断代性差异——非确定性

在 Agent 应用出现前,无论是最早的单机应用,还是如今广泛使用的云原生微服务应用,真正面向应用的计算机程序本质上都是由人面向一些特定应用场景开发的,程序的逻辑因为是开发者人工编写的,有很强的确定性。但到了 Agent 的时代,Agent 运行的具体逻辑已经从由人编程控制换成了由大模型生成,而大模型的输出无论是业务的 Owner 还是应用的开发运维人员、甚至 Agent 框架和大模型自身的研发人员都无法准确预测,因而完全是非确定性的。

然而现有的大量基础设施仍然是面向云原生以及更早时代的确定性应用打造的,并不能很好地满足 Agent 应用的运行要求。这很可能是接下来制约 Agent 真正走向企业级大规模应用的一个巨大障碍,但同时也是基础设施领域研发创新人员在 Agent 时代面临的一个很好的技术创新机会。

Agent 的非确定性带来的独特运行特征和挑战

高动态——Agent 逻辑完全动态不确定无法事先预知

传统应用一般是人面向特定业务场景开发的,因而在绝大多数情况下都是静态不变的。应用的开发运维人员只要足够了解程序代码逻辑,基本上就可以准确预判应用可能的执行情况,并且这些程序无论是在何时何地运行,其执行逻辑在本质上可以认为也是相同不变的。以云原生微服务为例,每个微服务实例对每个请求的处理逻辑几乎都是一样的,开发运维人员对此都非常清楚,因此通过将微服务逻辑打包在一个统一的镜像内,即可通过 K8s 部署多个相同规格的容器实例,支持大规模的企业级应用。

然而到了 Agent 时代,情况完全变了。如下图所示,Agent 的执行逻辑是大模型驱动的,面对的是用户千奇百怪的自然语言提问,大模型相应地可能每次给出完全不一样的输出,进而又驱动 Agent 去调用各种各样不同的外部工具,甚至去执行一些由大模型根据本次请求输入动态生成的代码,如此不断循环直至大模型认为用户问题已经得到了解决为止,导致 Agent 实际上对每个请求的处理过程可能都是完全不一样的。

比如,有些简单请求可能很快就执行完,也不需要太多资源。而有些复杂请求则可能需要多轮交互/工具调用/执行 AI 生成代码等等,有些最新的 Agent 技术甚至需要在运行中拉起新的子 Agent,这些都需要更长时间和更多的计算资源。在此情况下,Agent 应用的运维人员事先完全无法预计一个请求的具体执行过程会有多复杂,比如不知道它会有多少次的大模型来回交互才能搞定,也不知道会需要调用哪些外部工具、是否会动态执行某些 AI 生成代码等等。

简言之,以往的应用是简单静态的,而 Agent 应用是复杂动态的。

由此首先带来一个很现实的问题,该如何分配 Agent 应用的资源?以往在容器微服务时代,开发运维人员可以凭借对代码运行逻辑的了解结合一些实际经验,就可以给每个容器微服务配置相同的资源。但到了 Agent 应用时代,光 Agent 需要多少运行资源就成了一个不好估计的问题,给少了可能运行出错或影响服务质量,拍脑袋给每个实例都分配很大的资源规格则显然会带来巨大的资源浪费。

不安全——工具和 AI 生成代码不可信

Agent 的另一个特征是执行逻辑可能不安全。Agent 运行中需要执行像大模型生成的代码或者去调用某些外部工具,这些 AI 生成代码和工具的执行实际上都可能会带来安全风险。而传统容器的隔离性又比较低,一旦运行了一些恶意代码,就有可能出现容器逃逸等安全问题。

一种容易想到的办法是用更安全的容器或虚拟机来代替传统容器,但仍然通过容器接口与 K8s 等传统的容器调度框架对接,从而让 Agent 可以运行在现有容器基础设施上,并提供更高的安全隔离能力。事实上,业界当前很多面向 Agent 提供的安全沙箱确实也是采用的这些技术。

然而即便如此可能仍然不够,比如下图的例子,一旦将 Agent 自身逻辑和 AI 生成代码或其它有风险的工具调用混合在一个安全容器/虚拟机内执行,即便安全容器/虚拟机隔离了对 Host 的风险攻击,但仍然存在容器/虚拟机内的某些重要隐私信息(比如访问大模型的凭证)被风险代码访问窃取的可能性,并不能在实际 Agent 应用场景下完全杜绝安全风险。

更合理的做法是 Agent 一旦需要执行这些 AI 生成的代码或者有风险的工具调用,就将其如下图所示按需动态地调度到另一个干净的安全容器/虚拟机里面运行,彻底与 Agent 本体隔离开来,从而完全避免风险。

然而这就要求基础设施除了在部署阶段简单支持各个容器应用的静态部署外,还需要支持应用运行中随时按需动态调度拉起新的安全容器/虚拟机实例并执行某些代码任务,这种任务级的动态调度执行能力是传统 K8s 容器微服务技术体系不具备的。

长会话——长时运行如何保证会话状态一致

云原生微服务以往为了方便运维和水平弹性扩缩实例数,一般提倡无状态微服务。而很多应用的实际业务逻辑也确实比较简单,比如很多的业务数据本身就已经在数据库里保存,请求的处理过程只需要根据请求参数修改数据库,执行逻辑自身确实是无状态的。

然而 Agent 天然是要求有状态的,比如在多轮对话场景下,用户的前后多次输入需要能始终交由同一个 Agent 实例处理,以保证上下文的一致性,从而确保 Agent 能接着正确处理。

同时,Agent 一直在往处理更复杂任务的方向演进,使得当前 Agent 对单个请求的执行处理过程变得越来越长,且过程中有大量的外部工具调用。一旦在生产环境中遇到请求处理过程中的实例故障,此时针对该请求可能已执行了几轮 Agent loop,且部分外部工具调用已经生效。此类故障情形下,类似以往微服务场景下简单地将实例重新拉起,将请求重新执行,可能会因为 Agent 执行逻辑的不确定性,走入完全不同的执行分支,导致又调用了其它一些不一样的工具,使得 Agent 出现不该有的多次相互不一致的外部工具调用,最终导致出现业务无法接受的错误执行结果,在企业生产应用中引起致命问题。

举个例子,如上图所示,假如一个订票 Agent 在故障前的请求处理过程中已经调用某个工具帮你预定了某个行程的机票,结果还没等到完全处理完这个请求出现了机器故障,之后 Agent 从故障中恢复过来后再次处理这个请求,结果由于 Agent 的非确定性,实际执行逻辑出现了变化后又帮你新订了一张同一行程的高铁票,这样的故障显然会造成巨大的业务损失。尤其是我们知道在实际企业级生产环境中,只要运行时间长了,集群中一定是会出现机器故障的。

综上,Agent 非确定性带来的高动态、不安全、长会话等特征对现有以 K8s 容器微服务为代表的基础设施体系构成了巨大挑战,很难直接基于现有体系实现真正的 Agent 大规模落地,那么 Agent 时代又需要怎样的分布式基础设施呢?

Agent 时代需要怎样的分布式基础设施

K8s 等传统分布式基础设施实际上真正擅长的是将集群的资源以容器的方式管理起来并分配给各个应用使用。K8s 对分出去的容器内跑什么样的应用逻辑,容器内的资源是否得到了充分的利用等一无所知也并不关心。这些都是 K8s 的用户需要关心的,同时容器需要分配多少资源这件事 K8s 也丢给了用户,K8s 只负责交付用户指定规格的容器。这在确定性运行的云原生微服务时代并没有什么太大问题,但到了非确定性的 Agent 时代,就自然遇到了前面的各种挑战。

围绕前面讲的 Agent 非确定性引入的高动态、不安全、长会话的特征和挑战,本质上,Agent 时代需要的已不只是把确定性的应用逻辑由人工规划装载到多个一模一样的容器内部署起来各自独立运行,而是需要一个更加灵活强大的分布式系统。它可以让 Agent 在调度拉起之后的长时运行过程中维持自身正确的会话状态,同时还可以根据实际运行需要动态拉起一些新的子任务去单独运行某些可能有风险的代码/子 Agent 等等,并且还支持它们之间共享和传递一些关键的上下文数据。另外 Agent 和它拉起的子任务/子 Agent 等都应该按实际运行的资源需求去高效动态地去利用集群上的资源,而不需要也无法由用户事先指定。

看到这里,有没有觉得这样的运行特征似曾相识?它其实就像我们在单机 OS 上跑程序一样,程序可以进程的方式长时运行不停访问修改内部内存变量,同时可以根据自身执行逻辑的需要去动态拉起新的子进程,通过 RPC 或者共享内存等方式传递数据和协同,所有的进程都按自身实际运行需要去高效使用单机上的资源,而不需要用户来事先指定。

唯一的差别是面向企业级 Agent 应用,我们现在需要将 Agent 运行在集群上。所以本质上我们需要的是一个集群上的分布式系统,具备类似单机 OS 的灵活动态调度、弹性利用资源能力,并支持长时间有状态运行。同时由于分布式系统的特殊性,必须要支持在故障情形的自动恢复且保证恢复后的状态一致。

那当前业界有这样满足 Agent 运行需求的分布式系统吗?

业界相关工作

答案是有的,这里简要介绍一些作者认为比较相关的业界工作供读者参考。

openYuanrong

从当前我们了解到的情况看,最匹配的开源系统是 openYuanrong[1]。

openYuanrong 的核心设计理念正是构建一套类单机 OS 的分布式内核,并通过这套内核统一支持各类可能的分布式应用负载,这非常适合解决前述 Agent 场景的典型问题。

支持 Agent 高动态

通过将 Agent 运行在 openYuanrong 上,可天然支持 Agent 实例的自动弹性,无需运维人员关注如何配置容器资源。openYuanrong 在此采用了典型的 Serverless 自动弹性技术,可以支持根据请求数量动态调整 Agent 实例数目,甚至无请求可以缩容到 0。除了这种水平弹性能力外,openYuanrong 还有独特的垂直弹性能力,可以按 Agent 实际运行的资源需求动态调整每个实例所在容器规格大小,这样既可弹性支持应用请求负载波动变化,也可以实现每个实例对资源的动态高效利用,从而完全消除 Agent 应用如何配置资源的困扰。

此外 openYuanrong 还有很重要的动态调度能力,可以支持 Agent 在运行中动态拉起新的子任务/子 Agent,甚至可以并发拉起多个子任务/子 Agent,实现分布式并行处理,这非常适合像 Agent Swarm 等一些最新的 Agent 场景。

解决 Agent 不安全问题

openYuanrong 支持多租户和安全隔离,通过与底层 K8s 等配合,可将实例按需调度至各类不同容器中运行。在 Agent 场景下,通过与自身的动态调度能力结合,openYuanrong 可以做到将 AI 生成的代码等真正有风险的代码调度至一个独立的安全容器内运行,与 Agent 本体运行的容器实现彻底的隔离,从而避免因为混用同一个容器导致的大模型访问凭证等隐私泄露。

支持 Agent 长会话

openYuanrong 支持有状态实例的调度和长时运行,从而可以满足 Agent 自身状态访问需求。同时在多轮会话场景下,openYuanrong 可以支持会话上下文亲和的请求路由,确保多轮会话场景下上下文一致。另外还可通过 openYuanrong 的数据系统支持 Agent 将自身状态实时分布式备份,从而确保即便遇到故障,在实例恢复后仍然可以保持状态一致,从而确保语义一致的断点续执行,实现最终的正确结果输出。

除了能很好地匹配 Agent 的这些特征之外,openYuanrong 还提供了异构算力支持等能力,可以将 Agent 和大模型推理服务、Agentic RL 等负载调度在同一个集群内,实现高效协同,并充分共享利用集群上的各类算力资源。

Ray

和 openYuanrong 一样,Ray[2]也是业界不多的同样具备成熟的任务级动态分布式调度能力的系统,因此可以匹配 Agent 运行中动态拉起子任务等需求。同时 Ray 的 Actor 也是有状态的,可以满足 Agent 长时有状态运行的要求。

但 Ray 此前更多用在离线分布式计算场景,支持在线服务类应用时可能需要在请求接入等方面多做一些工作。此外在安全隔离、多租、弹性等方面相对来说还存在较多的能力欠缺,这使其当前仍难以很好解决 Agent 在安全性和资源高效利用上的问题,因此可能还不适合直接支持企业级大规模 Agent 在线应用。

Anthropic Managed Agents

在构思本篇文章的过程中,作者也关注到了 Anthropic 最新的一篇关于 Managed Agents 的文章[3]。这篇文章中,Anthropic 在其之前提出的 Harness、Tool 等概念外,还明确提出了 Session、Sandbox 等新的概念,并明确提出将这些概念实现相互解耦,以更好地满足容错、安全等考虑。

尽管思考问题的角度略有不同,但关于将 Sandbox 剥离出 Harness、Many Brains、Many Hands 这些想法和本文的观点非常契合。比如,将 Sandbox 剥离出 Harness 正是为了解决我们前述的隐私泄露等问题,Many Brains 则对应我们前面讲的多个 Agent 实例的部署和水平弹性,Many Hands 则是我们前面讲的在 Agent 运行过程中可以动态拉起多个工具并行执行。但可惜文章在抛出了这些 Meta-Harness 理念外,并未详述当前的实现情况以及如何实现。

总结与展望

Agent 是对传统应用形态的彻底颠覆,带来了完全不同以往应用的非确定性,其高动态、不安全、长会话的运行特征是传统 K8s 容器微服务技术体系难以满足的,对分布式基础设施领域提出了全新挑战,要求类似单机 OS 一样更加灵活强大的分布式系统能力。幸运的是,业界已经有像 openYuanrong 等的开源系统已在此方向积累了很多能力可以很好匹配 Agent 应用的相关诉求。

相比于 Anthropic 等行业先锋,当前大部分企业可能都还停留在云原生微服务应用时代,还普遍缺乏 Agent 相关的大规模应用落地实践。但 Agent 应用确实又很可能即将在短时间内迎来爆发,因此相比于 K8s 在云原生时代的普及程度,企业需要面向 Agent 时代尽早储备相关技术,构建适合自身需要的 Agent 分布式基础设施。

作者介绍

梁义,华为通用 Serverless 首席专家,华为元戎首席架构师,openYuanrong Maintainer

博士毕业于浙江大学计算机学院,曾任职于 Ask.com、同花顺、阿里巴巴、蚂蚁集团等公司,长期从事分布式系统方向工作,涵盖搜索推荐、大数据、实时计算、在线机器学习、分布式计算、 Serverless、AI Infra 等领域,目前专注于构建统一支持包括 AI 在内各类分布式场景的通用 Serverless 分布式计算引擎 openYuanrong。

参考资料

[1] https://docs.openyuanrong.org/

[2] https://www.ray.io/

[3] https://www.anthropic.com/engineering/managed-agents