惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

B
Blog RSS Feed
B
Blog
N
Netflix TechBlog - Medium
量子位
月光博客
月光博客
博客园_首页
博客园 - Franky
酷 壳 – CoolShell
酷 壳 – CoolShell
Last Week in AI
Last Week in AI
T
The Blog of Author Tim Ferriss
Hugging Face - Blog
Hugging Face - Blog
雷峰网
雷峰网
M
MIT News - Artificial intelligence
J
Java Code Geeks
大猫的无限游戏
大猫的无限游戏
D
DataBreaches.Net
腾讯CDC
Engineering at Meta
Engineering at Meta
云风的 BLOG
云风的 BLOG
L
LangChain Blog
GbyAI
GbyAI
IT之家
IT之家
Y
Y Combinator Blog
人人都是产品经理
人人都是产品经理

InfoQ - 促进软件开发领域知识与创新的传播

Meta 收购 Manus 这事儿泡汤了 5.5万 Star 开源项目 Ghostty 被迫出走,GitHub 正在终结一代技术人的乌托邦 Slack 长时运行多智能体系统的上下文管理方案 从 T+1 到分钟级:金城银行基于 Apache Doris 构建高可靠、强一致的实时数据平台 谷歌云推出 Agents CLI,简化 AI 智能体开发全流程 Claude官方击穿高薪、高学历的安全防线!Anthropic点名10大高危职业,但有群人暂时稳了 亚马逊云科技终止 WorkMail 服务,并将 App Runner 转入维护模式 OPPO小布记忆:全模态碎片化内容的理解与智能整理实践|AICon上海 模力工场038周AI应用周榜:工具在消失,工作流在出现 Akamai CEO Tom Leighton:Agent 时代来临,云基础设施正从“中心化”转向“分布式边缘” 日均数百亿入库背后:从“人肉调度”到K8s弹性架构,度小满金融基于OceanBase重构入库架构实践 百度文库网盘发布GenFlow 4.0:月活用户超1亿,要把网盘变成全端AI工作台 Altman 投的 Agent 终端 Warp 开源了!斩获3.5万star 哪些客户需要拒, 敢让龙虾决定吗?_AI&大模型_InfoQ 中文站_InfoQ精选视频 从开发到生产:为什么越来越多的机器学习团队纷纷迁移到 Snowflake | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 探索多智能体工作流:LangGraph Snowflake Cortex AI | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 腾讯云分布式缓存数据库:AI Agent - 从提示词工程到 Harness 工程 | 腾讯云数据库 DBTalk_腾讯_凌敏_InfoQ精选视频 基于 Streamlit 为 CSV 数据构建分析智能体 | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 AI 智能体:告别文档缺漏 | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 构建 AI 驱动的数据管道:深度探讨 Snowflake Openflow 与非结构化数据 | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 云端太贵、本地不够聪明,英特尔押注“端云混合AI”:智能体PC会替人完成工作 不到10%的存储投入,可能拖垮90%的GPU投资!IBM把AI Agent塞进存储系统,算清企业最容易忽略的一笔账 Snowpark 上手实战 | BUILD 2025_大数据_王玮_InfoQ精选视频 ClickHouse + Langfuse,构建 Agent 可观测基石 腾讯云分布式缓存数据库:Cluster Proxy 共享连接架构深度解析 | 腾讯云数据库 DBTalk_腾讯_凌敏_InfoQ精选视频 AI 写代码太烧钱了:Copilot、Claude 一起涨价,不如把程序员请回来? 英特尔发布至强600系列工作站处理器与锐炫Pro B70 GPU,全新AI工作站来了 腾讯云分布式缓存数据库:从 Redis 到 Valkey - 开源社区如何快速创新 | 腾讯云数据库 DBTalk_腾讯_凌敏_InfoQ精选视频 印奇这次要“从0重做”智驾模型!首谈阶跃和千里双公司布局:中国AI商业闭环要靠车跑出来 从Cursor返聘归来,90后华裔女高管带Claude开启日更模式:token成本比工程师工资低多了!
Swiggy通过实时机器学习排序提升搜索自动补全效果
InfoQ · 2026-06-15 · via InfoQ - 促进软件开发领域知识与创新的传播

Swiggy 详细介绍了该公司用于自动补全搜索建议的实时机器学习排序系统架构,说明平台如何在严格延迟的要求下,将 OpenSearch 检索、特征存储和 learning-to-rank 模型结合起来。该系统以直接运行在 OpenSearch 内部的学习排序模型,替代了过去手工调优的启发式排序方案,在避免引入额外服务和网络跳转的同时,提高了自动补全结果的相关性。

据该公司介绍,自动补全请求对延迟尤其敏感,因为用户每输入一个字符,都可能触发一次新的搜索查询。因此,传统自动补全系统通常依赖词法匹配与静态排序规则,以优先保证速度。Swiggy 的新方案则将整个流程拆分为两个阶段:候选生成和排序。

当用户开始输入时,系统首先借助 OpenSearch 的词法检索,并结合基于嵌入式向量的相似度搜索,生成一组更宽泛的候选建议。该检索层对召回率和响应速度进行了优化。随后,这些候选建议会被送入排序层,由机器学习模型根据预测相关性重新排序。

该排序系统引入了实时信号,例如,用户交互历史、点击行为、查询上下文和条目热度。这些特征会与离线训练好的模型结合,并在线上进行推理。系统使用了一个特征存储同时服务于预计算特征和流式特征,从而在避免高成本实时计算的同时,仍然能够对最新用户行为做出响应。排序层采用与 OpenSearch 集成的学习排序方法进行构建,通常可通过像OpenSearch LTR这样的框架来实现,并使用RankLib等模型家族以及XGBoost这类梯度提升树(gradient boosted tree)方法来完成排序和重排序任务。

该自动补全平台还包含一个持续反馈的闭环,利用实时用户交互数据持续重训排序模型。点击率、转化率以及下单行为会被流式写入离线训练流水线,在那里生成更新后的排序模型,并先存入模型注册表,再部署到线上排序服务中。

典型机器学习排序服务与 OpenSearch LTR 延迟的对比(来源:Swiggy博客

该架构的设计目标是满足严格的性能要求。自动补全请求具有高度的交互性,因此必须提供低延迟响应,这也使系统在设计上更偏向轻量模型和优化后的推理路径。系统并没有在线上链路中依赖复杂的深度模型,而是在模型复杂度与服务效率之间取得了平衡,以在大规模场景下维持响应能力。

基于 OpenSearch LTR 的自动补全机器学习模型训练与部署流程(来源:Swiggy博客

该系统还包含一个反馈闭环,持续收集用户交互并用于改进排序模型。点击率和转化信号会被送入离线训练流水线,使模型能够适应不断变化的用户行为和新出现的查询模式。这使自动补全系统可以在无需手工更新规则的情况下适应新趋势。

Swiggy 工程师表示,该设计将机器学习整合进了一个传统上以规则和检索为主的组件中,同时没有牺牲延迟表现。候选生成与排序的分离,使每个阶段都可以独立优化;而特征存储与流式流水线的使用,则确保了训练环境与服务环境之间的一致性。

查看英文原文: Swiggy Improves Search Autocomplete Using Real Time Machine Learning Ranking