惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

Google DeepMind News
Google DeepMind News
S
Secure Thoughts
Application and Cybersecurity Blog
Application and Cybersecurity Blog
AWS News Blog
AWS News Blog
GbyAI
GbyAI
腾讯CDC
WordPress大学
WordPress大学
V
V2EX
小众软件
小众软件
C
CXSECURITY Database RSS Feed - CXSecurity.com
M
MIT News - Artificial intelligence
T
Troy Hunt's Blog
H
Hacker News: Front Page
Scott Helme
Scott Helme
The Hacker News
The Hacker News
Schneier on Security
Schneier on Security
K
Kaspersky official blog
S
Security @ Cisco Blogs
N
News | PayPal Newsroom
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
T
Threatpost
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
Martin Fowler
Martin Fowler
P
Privacy International News Feed
Blog — PlanetScale
Blog — PlanetScale
D
DataBreaches.Net
O
OpenAI News
P
Proofpoint News Feed
J
Java Code Geeks
B
Blog RSS Feed
Attack and Defense Labs
Attack and Defense Labs
L
Lohrmann on Cybersecurity
T
Threat Research - Cisco Blogs
C
Cybersecurity and Infrastructure Security Agency CISA
阮一峰的网络日志
阮一峰的网络日志
P
Palo Alto Networks Blog
Engineering at Meta
Engineering at Meta
AI
AI
Google DeepMind News
Google DeepMind News
雷峰网
雷峰网
Microsoft Azure Blog
Microsoft Azure Blog
Simon Willison's Weblog
Simon Willison's Weblog
人人都是产品经理
人人都是产品经理
T
Tailwind CSS Blog
G
GRAHAM CLULEY
A
Arctic Wolf
N
Netflix TechBlog - Medium
L
LINUX DO - 最新话题
爱范儿
爱范儿
博客园 - 聂微东

InfoQ - 促进软件开发领域知识与创新的传播

Meta 收购 Manus 这事儿泡汤了 5.5万 Star 开源项目 Ghostty 被迫出走,GitHub 正在终结一代技术人的乌托邦 Slack 长时运行多智能体系统的上下文管理方案 从 T+1 到分钟级:金城银行基于 Apache Doris 构建高可靠、强一致的实时数据平台 谷歌云推出 Agents CLI,简化 AI 智能体开发全流程 Claude官方击穿高薪、高学历的安全防线!Anthropic点名10大高危职业,但有群人暂时稳了 亚马逊云科技终止 WorkMail 服务,并将 App Runner 转入维护模式 OPPO小布记忆:全模态碎片化内容的理解与智能整理实践|AICon上海 模力工场038周AI应用周榜:工具在消失,工作流在出现 Akamai CEO Tom Leighton:Agent 时代来临,云基础设施正从“中心化”转向“分布式边缘” 日均数百亿入库背后:从“人肉调度”到K8s弹性架构,度小满金融基于OceanBase重构入库架构实践 百度文库网盘发布GenFlow 4.0:月活用户超1亿,要把网盘变成全端AI工作台 Altman 投的 Agent 终端 Warp 开源了!斩获3.5万star 哪些客户需要拒, 敢让龙虾决定吗?_AI&大模型_InfoQ 中文站_InfoQ精选视频 从开发到生产:为什么越来越多的机器学习团队纷纷迁移到 Snowflake | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 探索多智能体工作流:LangGraph Snowflake Cortex AI | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 腾讯云分布式缓存数据库:AI Agent - 从提示词工程到 Harness 工程 | 腾讯云数据库 DBTalk_腾讯_凌敏_InfoQ精选视频 基于 Streamlit 为 CSV 数据构建分析智能体 | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 AI 智能体:告别文档缺漏 | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 构建 AI 驱动的数据管道:深度探讨 Snowflake Openflow 与非结构化数据 | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 云端太贵、本地不够聪明,英特尔押注“端云混合AI”:智能体PC会替人完成工作 不到10%的存储投入,可能拖垮90%的GPU投资!IBM把AI Agent塞进存储系统,算清企业最容易忽略的一笔账 Snowpark 上手实战 | BUILD 2025_大数据_王玮_InfoQ精选视频 ClickHouse + Langfuse,构建 Agent 可观测基石 腾讯云分布式缓存数据库:Cluster Proxy 共享连接架构深度解析 | 腾讯云数据库 DBTalk_腾讯_凌敏_InfoQ精选视频 AI 写代码太烧钱了:Copilot、Claude 一起涨价,不如把程序员请回来? 英特尔发布至强600系列工作站处理器与锐炫Pro B70 GPU,全新AI工作站来了 腾讯云分布式缓存数据库:从 Redis 到 Valkey - 开源社区如何快速创新 | 腾讯云数据库 DBTalk_腾讯_凌敏_InfoQ精选视频 印奇这次要“从0重做”智驾模型!首谈阶跃和千里双公司布局:中国AI商业闭环要靠车跑出来 从Cursor返聘归来,90后华裔女高管带Claude开启日更模式:token成本比工程师工资低多了! 从 Coding 到 Agent:QCon 北京 2026 全景复盘,优秀出品人 & 明星讲师名单揭晓 全链路支撑大模型国产化“Day 0适配”,商汤大装置构建全栈能力底座 凌晨,OpenAI 与亚马逊云科技史上最大联合发布来了 HashiCorp Vault 2.0 发布:引入新身份联邦机制,迈入 IBM 生命周期体系 Yelp 实现超 1,000 个 Cassandra 节点零停机升级 写了 17 年开源代码,我为什么认为 Coding Agents 堆功能是在瞎折腾? 基于 Apache Camel 编排智能体与多模态 AI 管道 面向智能体与人类用户的AI记忆系统:架构设计与核心场景实践|AICon上海 Anthropic 推出 Managed Agents,简化 AI 代理部署流程 阿里HappyHorse开启灰测,720P视频生成低至0.44元/秒 讯飞联合清华团队押注量子AI:不看营收、不设KPI,一群“无人区”科学家,抢夺下代AI算力入口 小米万亿模型全面开源:MIT 协议、1M 上下文,但还是打不过 DeepSeek Cortex Code 入门指南:面向数据工程师的实践路径 | 技术实践 openJiuwen社区首发Team Skills,定义Coordination Engineering新范式 用 Snowflake Cortex Agents 释放结构化数据的最大价值 | 技术实践 Grafana 利用 Kafka 对 Loki 进行了架构重构,并发布了一款命令行工具,旨在将可观测性引入编码代理 ClickHouse重构全文索引:对象存储上跑出高性能 Full-Text Search 可观测性和遥测技术如何提升软件工程实践 Dropbox 与 GitHub 合作,将单体库大小从 87GB 缩减至 20GB Agent 的下一站:基于长期记忆系统 EverOS 的自我演进|AICon上海 同一赛道,四种收费:Agent 控制层(Harness)开始分裂 Cloudflare Sandboxes 正式发布,为 AI 代理提供持久化隔离环境 Agent 的“记忆断片”困局,该怎么破?_AI&大模型_AICon 全球人工智能开发与应用大会_InfoQ精选视频 数据分析师如何快速建立在 AI 时代最值钱的能力:一份可落地的行动路线图 摩尔线程最新财报:研发占比超86%,万卡级大规模智算集群落地 当云区域失效:地缘动荡环境下的高可用重构 Slack 重构通知系统,设置参与度提升 5 倍 智能体工程的隐性技术债务 “我把所有模型都换成了DeepSeek V4”:月账单将降 90%,效果还更好 阿里云智能集团高级技术专家刘少伟已确认出席AICon上海站,并分享如何构建企业 Agent 的自动化行动架构 构建生产就绪的 tRPC API:Apollo Federation 的 TypeScript 替代方案 Anthropic推出面向Claude Code的基于智能体的代码审查功能 北京车展直击:斑马智能甩出车载Agent短剧,比亚迪率先落地,AI让智能座舱又热起来了 Snowflake 作为智能体运行时:从静态管道迈向自主数据系统 | 技术实践 Snowflake 上的本体体系:基于 Cortex Code 能力实现从架构到部署 | 技术实践 Cloudflare 公布 MCP 架构方案,应对企业面临的安全与治理风险 复杂的项目管理怎么做到「AI 友好」?飞书项目用「开放」给出答案 Snowflake Cortex Code 的规范驱动开发:将 SDLC 方法论引入 AI 辅助工作流 | 技术实践 Copilot 不让注册了:从“随便用”到“全面限”,agent 把原有订价模型顶穿了 当互联网用AI卷效率时,这家公司先问了一连串“能不能” Meta 开始记录员工每一次点击:AI 要接管工作,先监控会工作的人 Meta“Token榜”逼疯打工人,一夜烧掉公司几万刀!AI时代Token焦虑越来越离谱 智源FlagOS完成DeepSeek-V4-Flash在八款芯片Day0适配,实现三重技术突破 DeepSeek V4 重磅开源!首次打通华为Ascend,也没丢掉英伟达,百万上下文夺回国产模型话语权 李志飞的“新实验”:当超级个体撞上真实组织 GPT-5.5 登顶时刻,Anthropic 亲口承认 Claude 变笨了!网友群嘲:太敷衍 那些没空写的小需求,龙虾真能做吗?_AI&大模型_InfoQ 中文站_InfoQ精选视频 从 Pandas 到生产:使用任意 IDE 进行可扩展的 ML 数据管道与分布式处理 | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 pnpm 11 候选版本发布,带来 ESM 分发、供应链默认设置以及新的存储格式 银行业PDF表格提取方案重构:基于Java的分层方案 GPT-5.5 赢了 Opus 4.7 和 Mythos?奥特曼晒黄仁勋内部信:英伟达全员用上 Codex! Cloudflare 推出 Think:一款面向 AI 代理的持久化运行时 1850亿美元天价支出、75%代码由AI生成!谷歌正式宣告:全面转向智能体工作流 xAI落后太多,马斯克“开大”重金求购Cursor,100亿美金“分手费”都敢签! Pulumi 新增对 Bun 运行时的全面支持 姚顺雨腾讯模型首秀!不卷参数只做 “听话打工人”,Hy3 preview登场 | 附实测 老板让你“忽悠”投资人,你敢发给龙虾吗?_AI&大模型_InfoQ 中文站_InfoQ精选视频 Gemini CLI 引入子代理机制,实现任务委派与并行代理工作流 清华系团队星工聚将完成数千万天使轮融资,轮式机器人拿下头部制造企业亿级大单 Pretext.js 绕过 DOM 布局重排,实现 120 FPS 的高级交互体验 靠“AI 云”爆红的 Vercel,栽在一个第三方AI工具手里!IPO前夕遭黑,200万美元赎金谈崩? 高能研讨会|端侧 AI 正在重写实时感知效率上限_AI&大模型_王玮_InfoQ精选视频 2050大会看这篇就够了|报名、交通食宿指引大全 Java 近期资讯:OpenJDK JEP、Jakarta EE 12、Spring Framework、Micrometer、Camel、JBang 金融智能的架构编排:基于 Snowflake Cortex Agents 实现结构化与非结构化数据统一分析 | 技术实践 在AK大神爆火的任务里,摸清国产AI真实水平 百灵Ling-2.6-flash 正式发布:高 Token 效率,以 1/10 消耗实现 SOTA 级 Agent 能力 当 PM 懂AI,当技术懂产品:AI 时代产品力的双向进化|PM x AI产品力领航者大会即将开幕 为 AI 智能体设计记忆机制:揭秘 LinkedIn 的认知记忆智能体 获奖名单公布|2026主题征文第一期|分享你最有价值的龙虾场景与核心 Skill_热门活动_InfoQ写作社区官方_InfoQ写作社区
为什么大量企业Agent死在原型阶段?亚马逊云科技储瑞松:Agent工程是关键
褚杏娟 · 2026-06-25 · via InfoQ - 促进软件开发领域知识与创新的传播

“Agentic AI 的爆发拐点已经到来。”亚马逊全球副总裁、亚马逊云科技亚太区联席总裁储瑞松表示。推动这一拐点出现的,不只是大模型能力的持续跃迁,更是 Agentic 工程体系的快速成熟。

亚马逊云科技全球数据库服务副总裁 Ganapathy “G2” Krishnamoorthy 进一步指出,Agentic AI 的核心变化在于,AI 正从一次性问答工具,转向能够持续理解上下文、调用工具、执行任务并不断学习的数字劳动力。企业竞争的关键,也将从“有没有使用 AI”,转向“能否把每一次任务都变成下一次任务的智能积累”。

他指出,未来的 AI Agent 将覆盖多类关键场景,包括改变员工工作方式的 Agent、提升安全与合规能力的 Agent、能够理解并交付软件的 Agent,以及帮助企业自行创建智能体的平台能力。

模型能力与工程体系形成飞轮

储瑞松认为,过去两年多里,Agentic AI 的底层支撑正在发生关键变化。一方面,大模型能力在快速竞争中持续突破,从推理能力、代码生成到多模态理解,模型的智能水平不断跨越新的门槛。另一方面,基于模型能力的 Agentic 工程体系也在快速成熟。

“二者正在形成一个相互促进的飞轮:模型能力不断提升,让智能体具备更强的推理、代码生成和多模态理解能力;而成熟的 Agentic 工程实践,又把真实业务场景中的反馈传导回模型迭代过程,进一步指引模型能力的突破方向。”

他将 Agentic 工程体系定义为,把模型能力转化为可稳定交付业务结果的智能体的系统化工程能力。这个体系并不是单一技术点,而是一套围绕模型、上下文、工具、流程、评估和治理构建起来的综合工程框架。

Agentic 工程体系的演进可以分为三层:

  • 第一层,早期行业广泛关注的 Prompt Engineering,重点是通过更有效的提示词,让模型理解用户希望它完成什么任务。

  • 第二层,Context Engineering,重点是如何在合适的时机,向模型提供正确的信息、工具和记忆,让模型不仅知道“要做什么”,也掌握“完成任务需要知道什么”。

  • 第三层是最近半年成为行业焦点的 Harness Engineering,它更进一步强调围绕模型搭建稳定执行框架,包括智能体循环、工具调用、任务评估、失败重试和安全护栏等机制,让模型不仅能理解任务,也能可靠地把事情做完。

围绕企业如何实现 Agentic 业务转型,储瑞松提出,企业首先要从工具导向转向业务结果导向。过去,不少企业推进 AI 项目时,关注点往往停留在选择什么模型、采购什么工具、搭建什么系统。但在 Agentic AI 时代,真正重要的问题是:企业到底希望 AI 带来什么业务结果。只有先定义清楚业务目标,模型选择、数据准备、工作流设计和平台建设才有明确方向。

对于希望启动第一个智能体项目的企业,储瑞松建议,起步场景无需过于复杂,但必须具备真实业务价值。理想场景应有明确的起点、终点和业务目标,需要智能体在多个系统和工具之间进行选择与判断,同时拥有可衡量的成功标准。此外,这类场景还应具备安全的失败模式,即便智能体执行出错,也不会造成不可逆后果。此外,企业还需要明确智能体的边界,包括自主程度、管辖范围,以及人机协作中的审核分工。

储瑞松提出,一个实用方法是像为新员工撰写岗位说明书一样定义智能体:明确它的职责范围、交付标准、权限边界和出错预案,并将其与业务 KPI 直接关联。这样一来,企业从启动第一个智能体工作流开始,就能够衡量其业务价值,并逐步扩展到更多 Agentic AI 工作流。

其次,数据也将成为企业最重要的护城河之一。在 Agentic AI 时代,数据不再只是静态资产,而会变成持续驱动智能体为企业创造价值的战略资产。企业多年积累的行业知识、客户数据、运营流程和业务经验,将成为其智能体系统最难被复制的竞争壁垒。

与此同时,Agentic 平台将成为概念验证与生产部署之间的分界线。当企业只是做几个智能体试点时,可以依赖局部工具和单点方案;但当企业要让成百上千个智能体与员工协同,甚至让智能体之间相互协作时,就必须依赖统一平台进行开发、部署、管理、评估和治理。平台能力决定了智能体能否从试验走向规模化生产。

此外,储瑞松还强调,信任和治理是发展的加速器,而不是刹车。企业也需要建立新的角色、流程、责任和管理体系,来协调人类员工与智能体之间的协作关系。

企业需要理解上下文的 Agent

“对许多企业员工而言,今天的工作方式已经越来越难以支撑高效协作。”Krishnamoorthy 表示,员工并不真正关心某个任务要在哪个工具里完成,他们真正关心的是,一个想法能否被快速推进、一个客户问题能否被及时响应,一个变更能否真正落地。但现实是,员工不得不在不同系统之间反复切换,承担“连接信息、判断下一步、推动任务流转”的操作员角色。

更大的问题是,许多 AI 工具虽然可以连接企业工具,但它们往往只回答一个问题,然后就忘记上下文。它们在孤立会话中运行,只理解单次请求、单一数据源,却不了解用户与谁协作、正在做什么项目,也无法把分散的业务流程连接成真正的智能系统。

Krishnamoorthy 认为,如果团队仍然需要人类不断连接信息点,如果用户仍然被迫充当工作流中的人工操作员,那么 AI 能够释放的效率就会被严重限制。领先组织之所以能够跑得更快,不只是因为执行速度更快,而是因为它们正在让每一项任务都为下一项任务积累智能。

真正改变工作方式的 Agent,必须能够跨越企业业务、数据和工具运行,并随着每一次查询、每一次活动持续学习。这样一来,用户在第 100 天获得的答案,应该比第 1 天更准确、更贴合业务环境。这意味着 Agent 不只是一个聊天界面,而应具备持续记忆、权限管理、上下文理解和跨系统执行能力。它需要知道谁在行动、哪些数据被访问、数据来自哪里,以及当前策略是否允许该操作。

企业长期面对一个矛盾:安全与速度似乎总是互相牵制。一边是快速开发、快速发布、快速响应客户需求;另一边是安全审查、漏洞检测、合规验证和风险控制。过去,安全经常被视为拖慢进度的环节。

但在 Agentic AI 时代,这种权衡关系不应继续存在。Krishnamoorthy 认为,企业安全正在从“存储、查询、仪表盘和告警”的世界,走向“上下文、推理和访问控制”的世界。没有上下文的安全信号只是噪声,只有结合企业具体环境、架构、权限和业务逻辑,安全系统才能真正判断风险优先级。

软件交付成为关键战场

除了工作流和安全,软件开发是 Agentic AI 落地的另一条主线。Krishnamoorthy 表示,几乎每一个 Agent、每一个工作负载、每一个业务站点,最终都会以软件形式交付给客户。因此,软件交付是企业创新速度能否真正转化为业务价值的关键环节。

今天,代码生成已经变得越来越便宜,也不缺少可以快速生成代码的工具。但对企业项目来说,真正困难的不是写出一段代码,而是理解企业环境、开发标准、系统架构和既有约束。一个不了解企业上下文的代码生成工具,可能会制造更多技术债,而不是提升工程效率。

亚马逊云科技认为,企业需要的不是单点代码生成,而是覆盖需求理解、系统设计、实现、测试、验证和发布的完整软件交付能力。Agent 应该能够理解项目结构、架构约束和测试要求,并在发布前完成验证,确保代码不仅“能写出来”,也“能正确交付”。

随着 Agent 写代码速度提升,软件流水线本身也必须同步升级。如果 Agent 让代码产出速度提升 10 倍,但企业的发布管线仍然以旧速度运转,最终瓶颈只会从“写代码”转移到“测试、审核和上线”。

因此,企业需要让发布管理也具备 Agentic 能力。代码生成之后,系统应能自动接管后续流程,包括审查变更、搭建环境、运行测试、发现失败、修复问题,并在问题影响客户之前完成验证。

未来的软件交付将从“人类推动流水线”转向“Agent 协调流水线”。多个 Agent 可以共同维护持续流动的开发、测试和发布流程,让企业在加快交付的同时,避免技术债持续积累。

亚马逊云科技进一步指出,今天许多企业的 Agent 仍卡在原型阶段,无法真正进入生产环境。原因不是模型不够强,而是企业缺少生产级 Agent 所需的基础设施,包括认证、记忆、长任务执行、安全、治理、工具接入、策略控制和运行环境。

在亚马逊云科技看来,企业不能只关注 Agent 本身,而应关注支撑 Agent 进入生产的完整平台。模型可以被视为“大脑”,而 Harness 或平台能力则是“身体”和“安全系统”。没有后者,再聪明的模型也很难可靠地完成企业级任务。