惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

让小产品的独立变现更简单 - ezindie.com
让小产品的独立变现更简单 - ezindie.com
月光博客
月光博客
freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More
T
Tailwind CSS Blog
大猫的无限游戏
大猫的无限游戏
The Cloudflare Blog
博客园_首页
Jina AI
Jina AI
WordPress大学
WordPress大学
小众软件
小众软件
阮一峰的网络日志
阮一峰的网络日志
Apple Machine Learning Research
Apple Machine Learning Research
博客园 - 三生石上(FineUI控件)
酷 壳 – CoolShell
酷 壳 – CoolShell
博客园 - 叶小钗
美团技术团队
IT之家
IT之家
爱范儿
爱范儿
有赞技术团队
有赞技术团队
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
量子位
博客园 - 聂微东
人人都是产品经理
人人都是产品经理
博客园 - 【当耐特】

InfoQ - 促进软件开发领域知识与创新的传播

Meta 收购 Manus 这事儿泡汤了 5.5万 Star 开源项目 Ghostty 被迫出走,GitHub 正在终结一代技术人的乌托邦 谷歌开源“Agent Skill 超级工具箱”,云、库、引擎、AI全线打通,开发者狂喜 从 T+1 到分钟级:金城银行基于 Apache Doris 构建高可靠、强一致的实时数据平台 谷歌云推出 Agents CLI,简化 AI 智能体开发全流程 Claude官方击穿高薪、高学历的安全防线!Anthropic点名10大高危职业,但有群人暂时稳了 亚马逊云科技终止 WorkMail 服务,并将 App Runner 转入维护模式 OPPO小布记忆:全模态碎片化内容的理解与智能整理实践|AICon上海 模力工场038周AI应用周榜:工具在消失,工作流在出现 Akamai CEO Tom Leighton:Agent 时代来临,云基础设施正从“中心化”转向“分布式边缘” 日均数百亿入库背后:从“人肉调度”到K8s弹性架构,度小满金融基于OceanBase重构入库架构实践 百度文库网盘发布GenFlow 4.0:月活用户超1亿,要把网盘变成全端AI工作台 Altman 投的 Agent 终端 Warp 开源了!斩获3.5万star 哪些客户需要拒, 敢让龙虾决定吗?_AI&大模型_InfoQ 中文站_InfoQ精选视频 从开发到生产:为什么越来越多的机器学习团队纷纷迁移到 Snowflake | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 探索多智能体工作流:LangGraph Snowflake Cortex AI | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 腾讯云分布式缓存数据库:AI Agent - 从提示词工程到 Harness 工程 | 腾讯云数据库 DBTalk_腾讯_凌敏_InfoQ精选视频 基于 Streamlit 为 CSV 数据构建分析智能体 | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 AI 智能体:告别文档缺漏 | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 构建 AI 驱动的数据管道:深度探讨 Snowflake Openflow 与非结构化数据 | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 云端太贵、本地不够聪明,英特尔押注“端云混合AI”:智能体PC会替人完成工作 不到10%的存储投入,可能拖垮90%的GPU投资!IBM把AI Agent塞进存储系统,算清企业最容易忽略的一笔账 Snowpark 上手实战 | BUILD 2025_大数据_王玮_InfoQ精选视频 ClickHouse + Langfuse,构建 Agent 可观测基石 腾讯云分布式缓存数据库:Cluster Proxy 共享连接架构深度解析 | 腾讯云数据库 DBTalk_腾讯_凌敏_InfoQ精选视频 AI 写代码太烧钱了:Copilot、Claude 一起涨价,不如把程序员请回来? 英特尔发布至强600系列工作站处理器与锐炫Pro B70 GPU,全新AI工作站来了 腾讯云分布式缓存数据库:从 Redis 到 Valkey - 开源社区如何快速创新 | 腾讯云数据库 DBTalk_腾讯_凌敏_InfoQ精选视频 印奇这次要“从0重做”智驾模型!首谈阶跃和千里双公司布局:中国AI商业闭环要靠车跑出来 从Cursor返聘归来,90后华裔女高管带Claude开启日更模式:token成本比工程师工资低多了!
Slack 长时运行多智能体系统的上下文管理方案
Sergio De Si · 2026-04-30 · via InfoQ - 促进软件开发领域知识与创新的传播

为了在长时间运行的智能体系统中保持效率,Slack 工程师放弃了累积聊天记录的做法,转而采用结构化记忆、验证与蒸馏事实的方式来维持长时间运行智能体系统的连贯性与准确性。

虽然短时间的 LLM 会话通常不需要显式的上下文管理,但在长时间运行的会话中,要保持会话连贯性,上下文管理就变得至关重要——因为随着消息历史不断增加,每次请求都附带完整上下文会变得不切实际:

智能体框架会在 API 调用之间累积消息历史,以此为用户解决状态管理问题。但这会占用并填满智能体的上下文窗口,而上下文窗口对智能体可处理的信息总量存在硬性上限。即便只是接近上下文窗口的容量上限,也可能降低响应质量。

正如 Slack 高级软件工程师 Dominic Marks 所介绍的,Slack 的一款多智能体应用可跨越数百次请求,并生成数兆字节的输出。为应对这类复杂场景,他们采用了由三类互补上下文通道组成的方案:Director 日志(用于存储 Director 的结构化工作记忆)、Critic 评审(用于存储附带可信度评分的注释与结论报告)和 Critic 时间线(用于存储按时间排序、标注可信度评分的关键信息)。

Slack 采用了协调器/调度器式多智能体设计,中央协调器作为决策核心,负责接收各类请求,并将任务分派至下游智能体,也就是专家(Expert)与评审员(Critic)。

Critic 会对 Expert 的工作进行评估,因为部分结论“可能存在编造或严重曲解了数据”。他们接收 Expert 提交的摘要报告并核验报告中的相关依据。这一个评估工作是创建评分系统的基础,用于筛选出经多方信息交叉验证的结果。

Director 日志包含发现、观察、决策、问题与假设,并“提供统一的叙事脉络,确保其他智能体始终保持正确的工作方向”。

Critic 评审作为事实过滤器,使用证据核查工具来构建按可信度加权的结论列表。为了降低幻觉风险,Expert 被严格要求“仅针对提交的各项结论作出判断”。

最后,Critic 时间线基于 Director 日志、最新的 Critic 评审以及过往时间线内容构建连贯叙事,只保留可信证据,剔除重复信息,并通过优先采信高可信度来源来解决内容冲突。

虽然 Slack 的这套方案与其自身系统严格绑定,但它揭示了一个具有普适性的原则:与其在每一步交互中传递全部信息,不如搭建结构化摘要,让智能体能够根据已有内容稳定持续运行。这三个通道:

三者协同配合,在多轮交互之间维持整体连贯性,同时保留各类专业智能体的角色优势。Director 能够做出合理的战略决策,Expert 可以基于先前的理解继续工作,Critic 则能对各项结论进行客观评估。

Marks 表示,这种方法已被证实能够有效解决长时间运行的复杂智能体应用所存在的局限。如需了解完整的细节和示例,可查阅原文。

【声明:本文由 InfoQ 翻译,未经许可禁止转载。】

查看英文原文https://www.infoq.com/news/2026/04/slack-agent-context-management/