惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

IT之家
IT之家
Engineering at Meta
Engineering at Meta
腾讯CDC
宝玉的分享
宝玉的分享
H
Help Net Security
I
InfoQ
博客园 - Franky
The GitHub Blog
The GitHub Blog
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
H
Hackread – Cybersecurity News, Data Breaches, AI and More
Microsoft Security Blog
Microsoft Security Blog
M
MIT News - Artificial intelligence
博客园_首页
美团技术团队
Recent Announcements
Recent Announcements
freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More
雷峰网
雷峰网
The Cloudflare Blog
博客园 - 司徒正美
Vercel News
Vercel News
MyScale Blog
MyScale Blog
人人都是产品经理
人人都是产品经理
爱范儿
爱范儿
月光博客
月光博客

InfoQ - 促进软件开发领域知识与创新的传播

Meta 收购 Manus 这事儿泡汤了 5.5万 Star 开源项目 Ghostty 被迫出走,GitHub 正在终结一代技术人的乌托邦 Slack 长时运行多智能体系统的上下文管理方案 从 T+1 到分钟级:金城银行基于 Apache Doris 构建高可靠、强一致的实时数据平台 谷歌云推出 Agents CLI,简化 AI 智能体开发全流程 Claude官方击穿高薪、高学历的安全防线!Anthropic点名10大高危职业,但有群人暂时稳了 亚马逊云科技终止 WorkMail 服务,并将 App Runner 转入维护模式 OPPO小布记忆:全模态碎片化内容的理解与智能整理实践|AICon上海 模力工场038周AI应用周榜:工具在消失,工作流在出现 Akamai CEO Tom Leighton:Agent 时代来临,云基础设施正从“中心化”转向“分布式边缘” 日均数百亿入库背后:从“人肉调度”到K8s弹性架构,度小满金融基于OceanBase重构入库架构实践 百度文库网盘发布GenFlow 4.0:月活用户超1亿,要把网盘变成全端AI工作台 Altman 投的 Agent 终端 Warp 开源了!斩获3.5万star 哪些客户需要拒, 敢让龙虾决定吗?_AI&大模型_InfoQ 中文站_InfoQ精选视频 从开发到生产:为什么越来越多的机器学习团队纷纷迁移到 Snowflake | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 探索多智能体工作流:LangGraph Snowflake Cortex AI | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 腾讯云分布式缓存数据库:AI Agent - 从提示词工程到 Harness 工程 | 腾讯云数据库 DBTalk_腾讯_凌敏_InfoQ精选视频 基于 Streamlit 为 CSV 数据构建分析智能体 | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 AI 智能体:告别文档缺漏 | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 构建 AI 驱动的数据管道:深度探讨 Snowflake Openflow 与非结构化数据 | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 云端太贵、本地不够聪明,英特尔押注“端云混合AI”:智能体PC会替人完成工作 不到10%的存储投入,可能拖垮90%的GPU投资!IBM把AI Agent塞进存储系统,算清企业最容易忽略的一笔账 Snowpark 上手实战 | BUILD 2025_大数据_王玮_InfoQ精选视频 ClickHouse + Langfuse,构建 Agent 可观测基石 腾讯云分布式缓存数据库:Cluster Proxy 共享连接架构深度解析 | 腾讯云数据库 DBTalk_腾讯_凌敏_InfoQ精选视频 AI 写代码太烧钱了:Copilot、Claude 一起涨价,不如把程序员请回来? 英特尔发布至强600系列工作站处理器与锐炫Pro B70 GPU,全新AI工作站来了 腾讯云分布式缓存数据库:从 Redis 到 Valkey - 开源社区如何快速创新 | 腾讯云数据库 DBTalk_腾讯_凌敏_InfoQ精选视频 印奇这次要“从0重做”智驾模型!首谈阶跃和千里双公司布局:中国AI商业闭环要靠车跑出来 从Cursor返聘归来,90后华裔女高管带Claude开启日更模式:token成本比工程师工资低多了!
谷歌在 Next '26 大会上宣布推出 GKE Agent Sandbox 和 Hyper...
作者:Steef-Jan · 2026-05-13 · via InfoQ - 促进软件开发领域知识与创新的传播

在 Cloud Next '26 大会上,谷歌宣布了 Google Kubernetes Engine(GKE)的多项重大更新,其中最引人注目的是用于保证代理代码执行安全的 GKE Agent Sandbox,以及可以通过一个控制平面管理多达一百万个加速器芯片的 GKE hypercluster。编排与 Kubernetes 产品管理高级总监 Drew Bradstock 以及 GKE 产品组经理 Gari Singh 写道

Kubernetes 已经迅速成为 AI 时代的操作系统,目前 GKE 正为该平台上所有前 50 名的大客户提供 AI 工作负载支持,其中包括规模最大的前沿模型构建商。

这种框架反映了更广泛的行业趋势。根据 Databricks 的数据,多智能体 AI 工作流在近几个月里激增了 327%;而根据 CNCF 的数据,目前有 66% 的企业依赖 Kubernetes 来支撑生成式 AI 应用和智能体。

GKE Agent Sandbox 利用 gVisor(即保障 Gemini 安全的那项沙箱技术)为不受信任的代理代码执行提供内核级隔离。谷歌声称,该服务每秒可创建 300 个沙箱,延迟低于一秒,而且在 Axion 上运行时,其性价比比其他超大规模云平台高出 30%。作为 Kubernetes SIG Apps 的子项目,Agent Sandbox 在 2025 年 KubeCon NA 大会上发布,并引入了三个新的 Kubernetes 原语:Sandbox(核心工作负载资源)、SandboxTemplate(安全蓝图)和 SandboxClaim(用于向 ADK 或 LangChain 等更高层框架请求执行环境的事务性资源)。预配置的 Pod 预热池将冷启动延迟降至一秒以内。

Lovable 平台每天为超过 20 万个由 AI 生成的全新项目提供支持。它目前正在 Agent Sandbox 上运行生产工作负载。Lovable 联合创始人 Fabian Hedin 指出

GKE 先进的沙箱功能使我们能够每秒可靠地扩展数百个安全沙箱,即使在需求激增且难以预测的情况下,也能为构建者提供完美的支持。

代理沙箱领域正演变为三种方案之间的三方竞争。近日,Cloudflare 在其边缘网络上推出了基于容器隔离的 Sandboxes GA 服务,同时还针对比较轻量级的工作负载推出了基于 V8 隔离器的 Dynamic Workers。E2B 则采用 Firecracker 微虚拟机。值得注意的是,正如 Google Cloud 大使兼首席架构师 Alex Gkiouros 所说的那样,在三大超大规模云服务商中,GKE Agent Sandbox 目前是唯一提供原生代理沙箱解决方案的。谷歌有一个更广泛的战略是,让 Kubernetes 本身成为代理运行时,由 gVisor 作为开源的 Kubernetes 基础组件而非专有平台特性来提供隔离功能。这种开源特性是一个关键的差异化因素:任何 Kubernetes 集群都能运行 Agent Sandbox,而不仅限于 GKE。

GKE hypercluster 现在已经进入私有版正式发布阶段,其目标是解决另一种扩展难题。随着 AI 训练需求的增长,企业往往将基础设施拆分为数百个彼此孤立的集群,这增加了运维负担。Hypercluster 允许在一个符合规范的 GKE 控制平面上管理分布于 256000 个节点、横跨多个区域的 100 万个芯片。其安全性依托于谷歌的 Titanium Intelligence Enclave,这是一种经过硬件认证的“无管理员访问”模型,专有模型权重和提示词通过加密手段与平台管理员隔离开来。

Gkiouros 指出了一个需要认真权衡的现实问题:

一个 GKE 控制平面跨区域管理一百万个芯片,听起来很美妙,但当你考虑到影响范围和变更管理等问题时,就会发现它并不那么理想。私有 GA 才是适合它的地方。

在推理方面,两项改进带来了切实的性能提升。GKE Inference Gateway 中的“预测性延迟优化(Predictive Latency Boost)”功能利用机器学习驱动的路由机制,将首个 Token 延迟降低了多达 70%,用可以实时感知容量的智能调度取代了启发式猜测。该功能基于 llm-d 构建,后者最近已成为 CNCF Sandbox 的正式项目。跨 RAM、本地 SSD 和 Google Cloud Storage 的自动 KV 缓存存储分层功能解决了长上下文内存瓶颈。据谷歌报告,将 1 万条提示词卸载至 RAM 可提升 50% 的吞吐量,而将 5 万条提示词卸载至 SSD 则可提升近 70% 的吞吐量。

其他更新包括:用于优化强化学习工作负载的 RL Scheduler、用于内核隔离式奖励评估的 RL Sandbox,以及基于意图的自定义指标自动扩展功能。该功能通过直接从 Pod 获取指标(而非依赖外部监控技术栈),将 HPA 响应时间从 25 秒缩短至 5 秒。

原文链接:https://www.infoq.com/news/2026/05/gke-agent-sandbox-hypercluster/