惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

人人都是产品经理
人人都是产品经理
宝玉的分享
宝玉的分享
小众软件
小众软件
有赞技术团队
有赞技术团队
月光博客
月光博客
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
MyScale Blog
MyScale Blog
Engineering at Meta
Engineering at Meta
Stack Overflow Blog
Stack Overflow Blog
H
Hackread – Cybersecurity News, Data Breaches, AI and More
N
Netflix TechBlog - Medium
D
Docker
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
MongoDB | Blog
MongoDB | Blog
WordPress大学
WordPress大学
J
Java Code Geeks
罗磊的独立博客
V
Visual Studio Blog
雷峰网
雷峰网
H
Help Net Security
T
The Blog of Author Tim Ferriss
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
大猫的无限游戏
大猫的无限游戏
F
Fortinet All Blogs

博客园 - 张善友

纯 .NET 手写 CUDA kernel,GLM-5.3-Flash decode 跑出 llama.cpp 的 2 倍 3 张卡到底能不能跑大模型推理?从 vLLM、llama.cpp 到 TensorSharp 的多卡真相 AI 编程时代,.NET 的机会在哪里? Vibe Coding 月提交量 29 亿次之后:GitHub 的危机、Azure 迁移,以及 .NET 的机会 从 PostgreSQL 到 Kubernetes:开源的护城河,从来不写在代码里 人工智能最先替代的,是人工智能学院自己 企业架构的六种场景:从"四大流派"到数字原生与 AI 原生 TensorSharp 最新进展研究报告:从 DeepSeek V4 Flash 到 GLM-5.2,以及等待中的 GLM-5.3 Google 官方下场安利:Go 是 AI 时代的"理想语言"?其实 C# 更有资格坐这个位置 当"入门第一课"的作者开始 Vibe Coding:廖雪峰 2026 上半年 AI 编程实践深度探索 两种 Harness 哲学:从 DeepSeek Harness 的"过度抽象"争议,看 OpenClaw.NET 的另一种答案 JVMGuard 来了,.NET 开发者别慌:你的 dotnet-monitor 早就准备好了 .NET 11 Preview 7 发布:一大波硬核更新来袭,离正式版又近了一步! Agent 系统的不确定性治理:当软件工程遭遇"梯度下降" WorkBuddy 专家团的下一步:用 MetaSkill 把「提示词约定」升级为「运行时硬约束」 改变世界的17个方程,如何重塑 GoodCrew 的架构哲学 修 Bug 的手艺与架构的艺术:从熵增到熵减 "从"前锋"到"中场":为什么 Agent 基础设施的建设者必须是系统思考者" 纯 C# 追平 llama.cpp?.NET 本地推理三国杀 MCP 第五版 × OpenClaw.NET:从协议升级到生态编排 把 284B 的 DeepSeek V4 Flash 装进纯 .NET:TensorSharp 用一天改写了 .NET 推理栈的位置 从DDD到Ontology:当数字员工不再认"限界上下文"这堵墙 从 Harness 引擎到 MetaSkill DAG 的确定性架构 25家巨头联名的那封公开信,为什么数字员工架构师应该逐字读一遍 AI + C# NativeAOT:破解应用开发的"最后一公里" 本体:AI落地的"企业翻译官" C# MCP SDK 2.0 即将发布:去会话化、去握手、去运维噩梦 数字员工的成本账:OpenClaw.NET 如何用工程化实现"成功任务的单位经济学"(下) AI 成本战的隐性成本与降本五层:从"成功率悖论"到"系统复杂度"(中) 从 Token 价格战到成功任务单位经济学:AI 成本战的真正主线(上)
当 AgentGateway 遇上 OpenClaw.NET:企业级智能体基础设施的...
张善友 · 2026-06-06 · via 博客园 - 张善友

2026 年 6 月,Linux 基金会旗下的[智能体 AI 基金会(AAIF)正式接纳 AgentGateway 为第四大核心托管项目](https://aaif.io/blog/agentgateway-joins-aaif-as-an-open-gateway-for-agentic-ai-infrastructure/)。。这意味着企业终于有了一套能够同时管理传统应用流量与智能体流量的统一边界方案。

真正的重头戏在于 AgentGateway 与 OpenClaw.NET 的深度协同——一个主外、一个主内,一个负责全局治理、一个专注本地高安全执行。这套组合拳打下来,企业能获得:高吞吐、低延迟、强隔离、零信任。

▌ 为什么现有基础设施扛不住?

在智能体系统之前,网关的工作很单纯:转发 HTTP 请求,做做限流、鉴权,就能搞定。但现在的智能体工作流完全是另一回事:

传统需求

智能体新需求

短连接 Request/Response

持续推理循环

静态 API 路由

状态持久化

HTTP 协议

A2A 协议 + MCP 虚拟化

限流就行

模型上下文协议管理

传统的 API 网关无法感知这些需求,这就是 AgentGateway 出现的背景。

▌ 架构边界:云边协同的分层拓扑

AgentGateway 和 OpenClaw.NET 的职责分工非常清晰:

AgentGateway (AAIF 托管)

运行在企业网络外网边界或服务网格边缘

统一接管南北向流量以及跨多域的东向流量

xDS 控制平面,支持无中断动态更新

500k QPS,P99 延迟 < 0.2 毫秒

OpenClaw.NET (AgentQi 运行时)

运行在宿主机或边缘计算节点

专注于智能体实例生命周期、本地私有通道适配、物理工具沙箱执行

NativeAOT 原生编译,极低内存与启动开销

默认拒绝非本地环回绑定,强制执行本地沙箱约束

在实际部署中,AgentGateway 作为企业级大脑通过 xDS 动态下发路由策略;而运行在边缘虚拟机或标准工作站上的 OpenClaw.NET 实例,通过 Tailscale 建立的私有网或本地环回地址隐蔽运行,由 AgentGateway 代理其所有对外交互,从而规避了直接将智能体端口暴露给公网的网络风险。

▌ 微观架构:能力车道设计

OpenClaw.NET 的 NativeAOT 优化通过「能力车道」实现:

核心车道 (Core Lane) —— NativeAOT 极致性能

基本运行时循环、本地网关、CLI、OpenAI 兼容底层 API

可选车道 (Optional Lane) —— 按需加载

浏览器适配、MQTT 协议、通道适配器、工作流后端

实验车道 (Experimental Lane) —— 验证后合并

本地嵌入式模型侧车、适配器包装

JIT-only 车道 —— 动态插件专用

动态插件通道、动态命令钩子、.NET 动态插件

设计精髓:核心车道永远保持 NativeAOT 纯粹,实验功能单独隔离,验证通过后再合并——这才是企业级该有的严谨。

▌ 协议深度交织:A2A + MCP 的双向打通

A2A 协议的动态注册与地址重写

当 OpenClaw.NET 启动时,它会:

1. 生成智能体卡片(Agent Card):JSON 格式声明 C# 本地技能、执行边界、交互通道

2. 定期心跳注册:带 TTL 的租约时间,挂载到 AgentGateway 动态目录

3. 地址重写:网关将内网端点自动映射为公共安全代理端点

MCP 虚拟化与并发扇出性能优化

痛点:传统客户端顺序轮询 n 个 MCP 服务器,延迟线性累加。

AgentGateway 解法:并发扇出 + Fail-Open 降级

将分布在企业内部的多级 MCP 工具服务器联邦化为虚拟单一入口点

利用 Rust 异步并发机制实现高效并发扇出

当个别上游 MCP 服务器响应缓慢或宕机时,健康的工具服务仍能瞬间响应

效果:延迟从线性累加压缩到最慢那个决定全局速度。

▌ 双重零信任安全防御

2026 年初的 CVE-2026-25253 漏洞暴露了超过 17,500 个在线实例——这是血的教训。

边界安全:AgentGateway 拦截层

所有流入流量必须经过三层清洗:

1. 强身份验证:JWT / OAuth 2.0 / API Key / mTLS,基于 CEL 引擎编写细粒度 RBAC 规则

2. 主动多层护栏:正则敏感词过滤 + OpenAI Content API + AWS Bedrock Guardrails + Google Model Armor

3. 预算与速率限制:智能体级别调用配额和 API 计费预算墙

运行时控制:OpenClaw.NET 被动马具

被动马具治理模式的核心组件:

被动马具合约:智能体在启动高风险工具调用前,必须在内存中构建可供审计的静态工作计划

共享马具状态:协调多智能体系统中的数据读写集、前提假设和冲突检测

被动证据包:自动捕获执行现场的上下文、系统输入快照及潜在风险评级

被动治理账本:涉及高敏感逻辑时进入计划-执行-验证模式,挂起等待人类审批

关键创新:被动意味着智能体自己不知道会被审计——所有行为都被事后存证,但执行不会停下来。

▌ 混合计算拓扑:端云协同

端侧推理:OpenClaw.NET 本地能力

集成 Ollama,直接拉起 Gemma 4 等中小型开源模型

多模态投影器,零外网带宽消耗的边缘多模态理解

支持 E2B、E4B、31B 等 GGUF 格式量化版本

云端分流:AgentGateway 动态路由

当端侧算力不足时,无缝卸载给云端:

算力感知路由:实时采集 GPU 显存占用、KV Cache 深度、动态 LoRA 适配器加载状态

跨服务商平滑切换:OpenAI / Claude / Gemini / Azure / 自托管,故障自动转移

这完美契合了微软 Build 2026 提出的端云智能体战略。

▌ 统一可观测性:全链路分布式追踪

当异常发生时,如何定位问题?

用户指令注入 → OpenClaw.NET 端侧 (创建 Trace Parent Span) → AgentGateway 网关 (解包 + 注入 Child Span) → 云端 GPU 推理 (思维链推理耗时) → 返回端侧执行 (完整分布式拓扑轨迹)

所有节点的 Trace ID 保持强一致,运维大屏上一目了然。

▌ 协同部署演进路径

阶段

动作

目标

1

边界隔离

AgentGateway 部署为 K8s Ingress

2

端侧存证

OpenClaw.NET 启用被动马具治理

3

多维联邦

MCP 工具服务器虚拟化联邦

▌ 结语

AgentGateway + OpenClaw.NET 这套组合,本质上是把云原生的高并发与 .NET 的本地操控力做了深度融合。一个主外、一个主内,一个负责全局治理、一个专注高安全执行——这才是企业级智能体网络架构该有的样子。

随着 AAIF 标准化工作推进,未来 AgentGateway 与 OpenClaw.NET 的后继版本将进一步加深在 A2A 协议和多模态端侧协同上的契合度。一句话总结:边界过滤 + 端侧存证 + 多维联邦,这套架构为企业级智能化自动生产力的安全释放奠定了坚实的技术基石。

本文部分技术细节根据公开信息整理,如有出入请以官方最新发布为准。

相关链接:

  • https://aaif.io/blog/agentgateway-joins-aaif-as-an-open-gateway-for-agentic-ai-infrastructure/

  • https://github.com/clawdotnet/openclaw.net