惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

WordPress大学
WordPress大学
云风的 BLOG
云风的 BLOG
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
D
Docker
H
Help Net Security
Cyber Security Advisories - MS-ISAC
Cyber Security Advisories - MS-ISAC
Microsoft Azure Blog
Microsoft Azure Blog
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
T
Tailwind CSS Blog
让小产品的独立变现更简单 - ezindie.com
让小产品的独立变现更简单 - ezindie.com
月光博客
月光博客
C
Check Point Blog
S
SegmentFault 最新的问题
T
The Blog of Author Tim Ferriss
J
Java Code Geeks
M
MIT News - Artificial intelligence
B
Blog RSS Feed
MyScale Blog
MyScale Blog
大猫的无限游戏
大猫的无限游戏
Hugging Face - Blog
Hugging Face - Blog
腾讯CDC
美团技术团队
I
InfoQ
Blog — PlanetScale
Blog — PlanetScale

InfoQ - 促进软件开发领域知识与创新的传播

Meta 收购 Manus 这事儿泡汤了 5.5万 Star 开源项目 Ghostty 被迫出走,GitHub 正在终结一代技术人的乌托邦 Slack 长时运行多智能体系统的上下文管理方案 从 T+1 到分钟级:金城银行基于 Apache Doris 构建高可靠、强一致的实时数据平台 谷歌云推出 Agents CLI,简化 AI 智能体开发全流程 Claude官方击穿高薪、高学历的安全防线!Anthropic点名10大高危职业,但有群人暂时稳了 亚马逊云科技终止 WorkMail 服务,并将 App Runner 转入维护模式 OPPO小布记忆:全模态碎片化内容的理解与智能整理实践|AICon上海 模力工场038周AI应用周榜:工具在消失,工作流在出现 Akamai CEO Tom Leighton:Agent 时代来临,云基础设施正从“中心化”转向“分布式边缘” 日均数百亿入库背后:从“人肉调度”到K8s弹性架构,度小满金融基于OceanBase重构入库架构实践 百度文库网盘发布GenFlow 4.0:月活用户超1亿,要把网盘变成全端AI工作台 Altman 投的 Agent 终端 Warp 开源了!斩获3.5万star 哪些客户需要拒, 敢让龙虾决定吗?_AI&大模型_InfoQ 中文站_InfoQ精选视频 从开发到生产:为什么越来越多的机器学习团队纷纷迁移到 Snowflake | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 探索多智能体工作流:LangGraph Snowflake Cortex AI | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 腾讯云分布式缓存数据库:AI Agent - 从提示词工程到 Harness 工程 | 腾讯云数据库 DBTalk_腾讯_凌敏_InfoQ精选视频 基于 Streamlit 为 CSV 数据构建分析智能体 | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 AI 智能体:告别文档缺漏 | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 构建 AI 驱动的数据管道:深度探讨 Snowflake Openflow 与非结构化数据 | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 云端太贵、本地不够聪明,英特尔押注“端云混合AI”:智能体PC会替人完成工作 不到10%的存储投入,可能拖垮90%的GPU投资!IBM把AI Agent塞进存储系统,算清企业最容易忽略的一笔账 Snowpark 上手实战 | BUILD 2025_大数据_王玮_InfoQ精选视频 ClickHouse + Langfuse,构建 Agent 可观测基石 腾讯云分布式缓存数据库:Cluster Proxy 共享连接架构深度解析 | 腾讯云数据库 DBTalk_腾讯_凌敏_InfoQ精选视频 AI 写代码太烧钱了:Copilot、Claude 一起涨价,不如把程序员请回来? 英特尔发布至强600系列工作站处理器与锐炫Pro B70 GPU,全新AI工作站来了 腾讯云分布式缓存数据库:从 Redis 到 Valkey - 开源社区如何快速创新 | 腾讯云数据库 DBTalk_腾讯_凌敏_InfoQ精选视频 印奇这次要“从0重做”智驾模型!首谈阶跃和千里双公司布局:中国AI商业闭环要靠车跑出来 从Cursor返聘归来,90后华裔女高管带Claude开启日更模式:token成本比工程师工资低多了!
Cloudflare优化边缘栈:从大缓存转向高核并行
作者:Renato Lo · 2026-05-06 · via InfoQ - 促进软件开发领域知识与创新的传播

Cloudflare近期发布了Gen 13服务器,这标志着其网络处理流量方式的一次转变。公司不再依赖大容量 CPU 缓存来提速,而是重构软件,在最新的 AMD 服务器上利用更多处理器核心并行工作。

Cloudflare 强调了硬件与软件协同设计的重要性,过去,部分软件在多核场景下扩展性不足,需要依赖超大 CPU 缓存来弥补。如今通过软硬件同步调整,单机容量与边缘应用性能都得到了提升,同时能效也有所改善。

根据规格配置,Gen 13 采用 192 核AMD EPYC Turin 9965处理器、768 GB DDR5-6400 内存、24 TB PCIe 5.0 NVMe 存储,以及双 100 GbE 网卡。在满足相同响应时间目标的前提下,新规格让 Gen 13 单台服务器可承载的流量最高达到了上一代Gen 12(采用 AMD Genoa-X 9684X)的两倍。相关改动还带来了约 60%的机架容量提升,且不增加功耗,同时可用内存、存储和网络带宽也同步提高。

在另一篇文章“Inside Gen 13: how we built our most powerful server yet”中,Syona Sarma、JQ Lau、Ma XiongVictor Hwang介绍了新平台背后的工程取舍,内容涵盖 AMD EPYC 9965 服务器的布局与组件,以及理想的每核内存配置、散热效率和向 100 GbE 网络迁移的细节。在另一篇聚焦于硬件如何与重构后的Rust版FL2软件栈对齐的文章中,他们写道:

我们的目标是支持这样一类工作负载:它们如今依赖并行能力扩展,而非依赖缓存,从而在 Cloudflare 全球边缘基础设施上显著提升请求承载能力和单位功耗性能。

作者表示,Cloudflare 此前依赖具备超大 L3 缓存的处理器来维持低延迟,因为其部分软件尚未完全优化。在测试较新的 Turin Dense CPU(其缓存大约只有此前的三分之一)时,延迟最初上升了约 50%。通过与 AMD 共同分析问题并重写关键软件模块,Cloudflare 消除了这部分延迟惩罚,并释放出显著收益。团队补充说:

FL2 更清晰的架构、更好的内存访问模式和更少的动态分配,可能不像 FL1 那样依赖超大的 L3 缓存。这让我们有机会借助向 FL2 迁移,验证 Gen 13 的吞吐提升能否在不付出延迟代价的情况下实现。

在一则热门的Hacker News讨论中,许多读者认为这一架构转向很有意思,但也质疑性能提升中硬件与软件改写各自贡献了多少。不少人希望看到更清晰的基准测试和更多技术细节。用户 gdwatson 评论称:

我认为他们并没有解释清楚是如何解决缓存问题的,只是说他们用 Rust 重写了软件(……)。他们谈到了 Rust 更高的内存安全性;如果能进一步说明是否有某些具体语言特性影响了缓存表现,或者只是 Rust 让作者更安心地使用系统级语言来做这件事,那就更好了。

除核心架构调整外,此次发布还引入了 PCIe 加密硬件支持,并增强了 PCIe 加速器的支持。

原文链接:

Cloudflare Optimizes Edge Stack for High-Core CPUs Instead of Large Cache