惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

Microsoft Security Blog
Microsoft Security Blog
WordPress大学
WordPress大学
Stack Overflow Blog
Stack Overflow Blog
D
DataBreaches.Net
罗磊的独立博客
博客园 - 司徒正美
Last Week in AI
Last Week in AI
The Cloudflare Blog
大猫的无限游戏
大猫的无限游戏
Microsoft Azure Blog
Microsoft Azure Blog
B
Blog RSS Feed
The GitHub Blog
The GitHub Blog
宝玉的分享
宝玉的分享
Cyber Security Advisories - MS-ISAC
Cyber Security Advisories - MS-ISAC
小众软件
小众软件
Jina AI
Jina AI
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
Hugging Face - Blog
Hugging Face - Blog
B
Blog
博客园 - 【当耐特】
V
V2EX
Apple Machine Learning Research
Apple Machine Learning Research
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
酷 壳 – CoolShell
酷 壳 – CoolShell

InfoQ - 促进软件开发领域知识与创新的传播

Meta 收购 Manus 这事儿泡汤了 5.5万 Star 开源项目 Ghostty 被迫出走,GitHub 正在终结一代技术人的乌托邦 Slack 长时运行多智能体系统的上下文管理方案 从 T+1 到分钟级:金城银行基于 Apache Doris 构建高可靠、强一致的实时数据平台 谷歌云推出 Agents CLI,简化 AI 智能体开发全流程 Claude官方击穿高薪、高学历的安全防线!Anthropic点名10大高危职业,但有群人暂时稳了 亚马逊云科技终止 WorkMail 服务,并将 App Runner 转入维护模式 OPPO小布记忆:全模态碎片化内容的理解与智能整理实践|AICon上海 模力工场038周AI应用周榜:工具在消失,工作流在出现 Akamai CEO Tom Leighton:Agent 时代来临,云基础设施正从“中心化”转向“分布式边缘” 日均数百亿入库背后:从“人肉调度”到K8s弹性架构,度小满金融基于OceanBase重构入库架构实践 百度文库网盘发布GenFlow 4.0:月活用户超1亿,要把网盘变成全端AI工作台 Altman 投的 Agent 终端 Warp 开源了!斩获3.5万star 哪些客户需要拒, 敢让龙虾决定吗?_AI&大模型_InfoQ 中文站_InfoQ精选视频 从开发到生产:为什么越来越多的机器学习团队纷纷迁移到 Snowflake | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 探索多智能体工作流:LangGraph Snowflake Cortex AI | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 腾讯云分布式缓存数据库:AI Agent - 从提示词工程到 Harness 工程 | 腾讯云数据库 DBTalk_腾讯_凌敏_InfoQ精选视频 基于 Streamlit 为 CSV 数据构建分析智能体 | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 AI 智能体:告别文档缺漏 | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 构建 AI 驱动的数据管道:深度探讨 Snowflake Openflow 与非结构化数据 | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 云端太贵、本地不够聪明,英特尔押注“端云混合AI”:智能体PC会替人完成工作 不到10%的存储投入,可能拖垮90%的GPU投资!IBM把AI Agent塞进存储系统,算清企业最容易忽略的一笔账 Snowpark 上手实战 | BUILD 2025_大数据_王玮_InfoQ精选视频 ClickHouse + Langfuse,构建 Agent 可观测基石 腾讯云分布式缓存数据库:Cluster Proxy 共享连接架构深度解析 | 腾讯云数据库 DBTalk_腾讯_凌敏_InfoQ精选视频 AI 写代码太烧钱了:Copilot、Claude 一起涨价,不如把程序员请回来? 英特尔发布至强600系列工作站处理器与锐炫Pro B70 GPU,全新AI工作站来了 腾讯云分布式缓存数据库:从 Redis 到 Valkey - 开源社区如何快速创新 | 腾讯云数据库 DBTalk_腾讯_凌敏_InfoQ精选视频 印奇这次要“从0重做”智驾模型!首谈阶跃和千里双公司布局:中国AI商业闭环要靠车跑出来 从Cursor返聘归来,90后华裔女高管带Claude开启日更模式:token成本比工程师工资低多了!
Confluent将模式ID移至Kafka头部,以简化模式治理
作者:Leela Kum · 2026-05-09 · via InfoQ - 促进软件开发领域知识与创新的传播

Confluent 推出了一种Apache Kafka模式(schema)元数据的新管理方案,支持将模式 ID 存储在消息头部,而非消息载荷中。该更新旨在简化数据治理,让企业无需改动现有事件格式,即可落地模式的校验能力。此功能基于 Kafka 原生消息头部能力构建,并与 Confluent Schema Registry 深度集成。该注册中心被大量企业广泛应用于微服务、分析流水线及数据平台的事件驱动架构治理场景。

在采用 Confluent wire 格式的传统 Kafka 部署中,模式 ID 会直接内嵌在消息载荷里。这种方式虽然能保障消费者正常反序列化事件,但会将模式元数据与业务数据强耦合。长期来看,这种耦合会增加模式演进的复杂度,多团队、多系统共用同一事件流的场景下尤为明显;同时,跨生产者、消费者进行模式变更时,也会大幅提升协同成本。

采用新方案后,模式标识存放于 Kafka 记录的头部,消息载荷保持原样不变。消费者运行时通过头部中的 ID,从 Schema Registry 拉取对应模式完成解析。该方式兼容AvroProtobuf、JSON Schema 等主流格式,同时降低了对强耦合 wire 格式的依赖。模式解析逻辑与载荷彻底解耦,让事件流更灵活,更易于对接各类下游系统与工具链。

将模式 ID 迁移至 Kafka 消息头部前后的模式处理方式对比(来源:Confluent博客

Confluent 欧洲、中东及非洲地区的 CSTA 团队负责人Patrick Neff在 LinkedIn发文,强调模式治理对于流式系统与分析平台数据复用的关键价值:

模式是释放数据全部价值的核心基石。

基于消息头部的方案还支持渐进式落地。企业无需大规模重构代码、也无需协调所有生产者和消费者同步变更,就能逐步引入模式治理。可在现有事件流上附加模式 ID,在保持向后兼容的同时,循序渐进落地更严格的模式管理规范。

Confluent 的技术专家Gunnar Morling发文指出,该方案大幅提升了与存储系统及下游计算框架的互操作性:

将模式 ID 从消息载荷移入 Kafka 消息头部,是一次极大的体验优化:消息载荷变得合规且完整独立。

将模式元数据与有效载荷分离,使生产者和消费者的独立演进成为可能,验证集中在模式注册表中。这减少了协调开销,并在大规模环境简化了模式演进。它还通过启用跨管道的结构化事件数据一致性重用,改善了与 Apache Flink,以及分析或 ML 系统等工具的互操作性。

Confluent 产品管理总监David Araujo阐释了该功能如何实现零停机及客户端无感知的落地模式:

把模式 ID 迁移至消息头部后,无需改动载荷格式,就可以为 Kafka 中已有数据绑定模式规范。

迁移过程中,部分默认从载荷读取模式元数据的 Kafka 连接器和下游工具需要适配升级,生态环境就绪前会进入新旧两种模式并存的过渡期。目前该功能已在 Confluent Cloud 上线,后续将进入 Confluent Platform,搭配 Schema Registry 提供支持,并沿用现有授权许可体系。

原文链接:

 Confluent Moves Schema IDs to Kafka Headers to Simplify Schema Governance