惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

博客园_首页
爱范儿
爱范儿
罗磊的独立博客
V
V2EX
量子位
Last Week in AI
Last Week in AI
Hugging Face - Blog
Hugging Face - Blog
博客园 - 司徒正美
Jina AI
Jina AI
博客园 - 叶小钗
小众软件
小众软件
博客园 - 【当耐特】
Y
Y Combinator Blog
让小产品的独立变现更简单 - ezindie.com
让小产品的独立变现更简单 - ezindie.com
T
Tailwind CSS Blog
博客园 - 聂微东
Microsoft Security Blog
Microsoft Security Blog
美团技术团队
P
Proofpoint News Feed
Cyber Security Advisories - MS-ISAC
Cyber Security Advisories - MS-ISAC
有赞技术团队
有赞技术团队
MongoDB | Blog
MongoDB | Blog
Recent Announcements
Recent Announcements
酷 壳 – CoolShell
酷 壳 – CoolShell

InfoQ - 促进软件开发领域知识与创新的传播

Meta 收购 Manus 这事儿泡汤了 5.5万 Star 开源项目 Ghostty 被迫出走,GitHub 正在终结一代技术人的乌托邦 Slack 长时运行多智能体系统的上下文管理方案 从 T+1 到分钟级:金城银行基于 Apache Doris 构建高可靠、强一致的实时数据平台 谷歌云推出 Agents CLI,简化 AI 智能体开发全流程 Claude官方击穿高薪、高学历的安全防线!Anthropic点名10大高危职业,但有群人暂时稳了 亚马逊云科技终止 WorkMail 服务,并将 App Runner 转入维护模式 OPPO小布记忆:全模态碎片化内容的理解与智能整理实践|AICon上海 模力工场038周AI应用周榜:工具在消失,工作流在出现 Akamai CEO Tom Leighton:Agent 时代来临,云基础设施正从“中心化”转向“分布式边缘” 日均数百亿入库背后:从“人肉调度”到K8s弹性架构,度小满金融基于OceanBase重构入库架构实践 百度文库网盘发布GenFlow 4.0:月活用户超1亿,要把网盘变成全端AI工作台 Altman 投的 Agent 终端 Warp 开源了!斩获3.5万star 哪些客户需要拒, 敢让龙虾决定吗?_AI&大模型_InfoQ 中文站_InfoQ精选视频 从开发到生产:为什么越来越多的机器学习团队纷纷迁移到 Snowflake | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 探索多智能体工作流:LangGraph Snowflake Cortex AI | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 腾讯云分布式缓存数据库:AI Agent - 从提示词工程到 Harness 工程 | 腾讯云数据库 DBTalk_腾讯_凌敏_InfoQ精选视频 基于 Streamlit 为 CSV 数据构建分析智能体 | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 AI 智能体:告别文档缺漏 | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 构建 AI 驱动的数据管道:深度探讨 Snowflake Openflow 与非结构化数据 | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 云端太贵、本地不够聪明,英特尔押注“端云混合AI”:智能体PC会替人完成工作 不到10%的存储投入,可能拖垮90%的GPU投资!IBM把AI Agent塞进存储系统,算清企业最容易忽略的一笔账 Snowpark 上手实战 | BUILD 2025_大数据_王玮_InfoQ精选视频 ClickHouse + Langfuse,构建 Agent 可观测基石 腾讯云分布式缓存数据库:Cluster Proxy 共享连接架构深度解析 | 腾讯云数据库 DBTalk_腾讯_凌敏_InfoQ精选视频 AI 写代码太烧钱了:Copilot、Claude 一起涨价,不如把程序员请回来? 英特尔发布至强600系列工作站处理器与锐炫Pro B70 GPU,全新AI工作站来了 腾讯云分布式缓存数据库:从 Redis 到 Valkey - 开源社区如何快速创新 | 腾讯云数据库 DBTalk_腾讯_凌敏_InfoQ精选视频 印奇这次要“从0重做”智驾模型!首谈阶跃和千里双公司布局:中国AI商业闭环要靠车跑出来 从Cursor返聘归来,90后华裔女高管带Claude开启日更模式:token成本比工程师工资低多了!
大规模工程支撑场景下的多智能体系统设计:Grab 实践案例
作者:Leela Kumili明知山 · 2026-05-24 · via InfoQ - 促进软件开发领域知识与创新的传播

Grab 分析数据仓库(ADW)团队推出了一套多智能体 AI 系统,用于自动化大规模数据平台中的工程支持工作流,目标是减少重复性运维工作并提升问题解决效率。这套系统主要处理内部的工程请求,包括数据仓库故障排查、SQL 调试和平台支持等相关工作,帮助工程师将精力转向具有更高价值的开发工作。

ADW 平台服务超一千名内部用户,管理着 15000 多张数据表,是 Grab 核心分析基础设施的重要组成部分。随着使用量增长,工程团队发现大量运维精力被重复性支持任务和临时问题排查所消耗,挤占了平台优化迭代与系统架构设计的工作时间。

Grab 分析部门负责人 Sneh Agrawal 在 LinkedIn 帖子中指出:

Grab 中央数据团队正在利用多智能体系统实现重复性运维工作的自动化,每月可节省数百个工程工时。这一转变有效释放了核心工程人力,推动团队从被动应急处理的“救火”模式转向深耕高价值的系统构建工作。

为此,团队搭建了一个多智能体架构,将收到的工程请求划分成调查与增强两大核心工作流。调查工作流专门用于处理各类问题诊断工作,包括查询分析、日志检索、数据表结构查询以及问题整理汇总;增强工作流则专注于生成可执行的输出,如代码变更、SQL 修复和待审查的自动合并请求。

多智能体架构技术栈(来源:Grab 技术博客

该系统采用基于 LangGraph 的工作流引擎进行编排,结合 FastAPI 服务,协调各智能体之间的路由、工具执行和状态管理。请求首先会被分类,然后路由至负责上下文检索、代码搜索或解决方案生成的专门智能体。每个智能体的职责受到严格约束,以便减少判定偏差,提升输出结果的稳定性。

智能体工作流,使用 Supervisor 控制通信流和任务委派(来源:Grab 技术博客

Grab 的工程师表示:

调查路径与增强路径的分离有效降低了智能体推理的复杂度,并提升了生产工作流的可靠性。

一项关键的架构决策是对工具生态进行了整合。系统最初在数据访问、日志和代码系统中使用了 30 多个内部工具,后来经过筛选,精简为一个工具集合,既提升了整体可维护性,也降低了智能体在选择工具时的不确定性。工具层包括受控的 SQL 执行、元数据访问、日志检索系统,以及与基于 Git 工作流的集成。

系统设计也考虑到了安全与治理。SQL 执行由验证层进行约束,敏感数据处理流程包含了检测和缓解暴露风险的机制。此外,所有产生代码变更的增强工作流在部署前均需经过人工审核,确保自动化输出始终处于工程监督之下。

上下文管理是一项重要的技术挑战。多步骤智能体推理需要在交互过程中保持相关状态,同时还要符合词元的使用限制。系统通过结构化上下文压缩与选择性检索策略解决这一问题,让智能体在不突破使用限制的同时保留必要的信息。

这套系统有效减少了工程师处理常规支持任务的时间,同时缩短了各类常见问题的处理周期。目前官方尚未公布具体量化性能数据,但团队表示,工程人力正逐步从被动应急处理转向平台构建与系统改进。

查看英文原文https://www.infoq.com/news/2026/05/grab-multi-agent-support-system/