惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

量子位
博客园 - 三生石上(FineUI控件)
D
DataBreaches.Net
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
GbyAI
GbyAI
P
Proofpoint News Feed
Microsoft Security Blog
Microsoft Security Blog
月光博客
月光博客
I
InfoQ
V
Visual Studio Blog
罗磊的独立博客
Engineering at Meta
Engineering at Meta
Vercel News
Vercel News
Jina AI
Jina AI
L
LangChain Blog
Apple Machine Learning Research
Apple Machine Learning Research
Cyber Security Advisories - MS-ISAC
Cyber Security Advisories - MS-ISAC
B
Blog
The Cloudflare Blog
小众软件
小众软件
雷峰网
雷峰网
V
V2EX
人人都是产品经理
人人都是产品经理
Stack Overflow Blog
Stack Overflow Blog

InfoQ - 促进软件开发领域知识与创新的传播

Meta 收购 Manus 这事儿泡汤了 5.5万 Star 开源项目 Ghostty 被迫出走,GitHub 正在终结一代技术人的乌托邦 Slack 长时运行多智能体系统的上下文管理方案 从 T+1 到分钟级:金城银行基于 Apache Doris 构建高可靠、强一致的实时数据平台 谷歌云推出 Agents CLI,简化 AI 智能体开发全流程 Claude官方击穿高薪、高学历的安全防线!Anthropic点名10大高危职业,但有群人暂时稳了 亚马逊云科技终止 WorkMail 服务,并将 App Runner 转入维护模式 OPPO小布记忆:全模态碎片化内容的理解与智能整理实践|AICon上海 模力工场038周AI应用周榜:工具在消失,工作流在出现 Akamai CEO Tom Leighton:Agent 时代来临,云基础设施正从“中心化”转向“分布式边缘” 日均数百亿入库背后:从“人肉调度”到K8s弹性架构,度小满金融基于OceanBase重构入库架构实践 百度文库网盘发布GenFlow 4.0:月活用户超1亿,要把网盘变成全端AI工作台 Altman 投的 Agent 终端 Warp 开源了!斩获3.5万star 哪些客户需要拒, 敢让龙虾决定吗?_AI&大模型_InfoQ 中文站_InfoQ精选视频 从开发到生产:为什么越来越多的机器学习团队纷纷迁移到 Snowflake | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 探索多智能体工作流:LangGraph Snowflake Cortex AI | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 腾讯云分布式缓存数据库:AI Agent - 从提示词工程到 Harness 工程 | 腾讯云数据库 DBTalk_腾讯_凌敏_InfoQ精选视频 基于 Streamlit 为 CSV 数据构建分析智能体 | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 AI 智能体:告别文档缺漏 | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 构建 AI 驱动的数据管道:深度探讨 Snowflake Openflow 与非结构化数据 | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 云端太贵、本地不够聪明,英特尔押注“端云混合AI”:智能体PC会替人完成工作 不到10%的存储投入,可能拖垮90%的GPU投资!IBM把AI Agent塞进存储系统,算清企业最容易忽略的一笔账 Snowpark 上手实战 | BUILD 2025_大数据_王玮_InfoQ精选视频 ClickHouse + Langfuse,构建 Agent 可观测基石 腾讯云分布式缓存数据库:Cluster Proxy 共享连接架构深度解析 | 腾讯云数据库 DBTalk_腾讯_凌敏_InfoQ精选视频 AI 写代码太烧钱了:Copilot、Claude 一起涨价,不如把程序员请回来? 英特尔发布至强600系列工作站处理器与锐炫Pro B70 GPU,全新AI工作站来了 腾讯云分布式缓存数据库:从 Redis 到 Valkey - 开源社区如何快速创新 | 腾讯云数据库 DBTalk_腾讯_凌敏_InfoQ精选视频 印奇这次要“从0重做”智驾模型!首谈阶跃和千里双公司布局:中国AI商业闭环要靠车跑出来 从Cursor返聘归来,90后华裔女高管带Claude开启日更模式:token成本比工程师工资低多了!
Netflix借助Apache Druid中的区间感知缓存让84%的查询结果直...
作者:Leela Kum · 2026-05-19 · via InfoQ - 促进软件开发领域知识与创新的传播

Netflix 通过引入一种区间感知(interval-aware)缓存策略,提升了 Apache Druid 的查询效率,大约 84%的分析结果可以直接由缓存返回,并使查询负载降低了约 33%。这一优化主要面向滚动时间窗口仪表盘,因为这类仪表盘会持续刷新查询,而时间范围仅有轻微移动,传统上这会导致重复计算,并反复扫描大型的数据集。

在 Netflix 这样的规模下,实时分析系统需要处理数万亿行数据,以支撑用于监控、实验以及运营决策的各类仪表盘。这些仪表盘会频繁执行几乎相同的查询,例如,滑动时间窗口上的错误率或用户参与度指标。尽管每次查询的意图保持不变,但时间边界的细微变化会让传统缓存系统把它们视为彼此不同的请求,从而在Apache Druid中造成较低的缓存复用率和重复计算。

Hello Interview 联合创始人Evan King在一篇帖子中这样描述这一挑战:

像“过去 3 小时内的错误数”这样的重复查询,尽管其底层大部分数据并未发生变化,但在传统缓存中仍会被当作不同请求来进行处理。

Netflix 的方法会把查询结果拆分成与时间对齐的片段,以便在相互重叠的滚动时间窗口查询之间实现复用。系统不会缓存完整的查询输出,而是为固定的时间区间保存中间聚合结果。当新查询到来时,时间窗口中稳定的历史部分会复用已缓存的片段,而只有最新的时间区间才会从 Druid 重新计算,并与缓存结果合并。

查询结构与缓存键分离(图片来源:Netflix博客文章)

Netflix 工程师Ben Sykes强调了这一方法的一个关键动机和成果,他指出:

发往 Druid 的查询量下降了 33%,P90 查询时间改善了 66%

在 Netflix 的规模下,Apache Druid 中超过 10 万亿行的数据使重复的滚动时间窗口查询成为一个主要的瓶颈。缓存层通过使用与粒度对齐的桶以及指数型 TTL 策略来应对这一问题,从而能够对历史区间进行长时间缓存,同时保持近期数据的新鲜度。这在数据准确性与性能效率之间取得了平衡。从架构上看,该缓存层以外部代理的形式运行,它会拦截传入的查询,将查询结构与时间区间分离,并生成可复用的缓存键。缓存片段存储在分布式键值系统中,从而能够独立过期并被高效检索。

查询流架构(图片来源:Netflix博客文章)

采用这种设计后,只有最近的时间区间需要重新计算,而历史片段则可以在多个相互重叠的查询之间复用。因此,到达 Druid 的查询所覆盖的时间范围被显著缩小,扫描的 segment 更少,处理的数据量也更低。在某些工作负载中,Netflix 观察到结果字节数最多可减少 14 倍,segment 扫描量也大幅下降。

该系统目前仅作为实验性层进行了部署,并且仍在持续演进。未来的工作包括将支持扩展到仪表盘工具使用的模板化 SQL 查询,以减少对 Druid 原生查询表达式的依赖。Netflix 也在探索把区间感知缓存更紧密地直接集成进 Apache Druid,从而消除对外部代理层的需求,并提升查询规划的效率。

查看英文原文:Netflix Serves 84% of Query Results from Cache with Interval-Aware Caching in Apache Druid