惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

博客园_首页
博客园 - Franky
大猫的无限游戏
大猫的无限游戏
博客园 - 三生石上(FineUI控件)
量子位
博客园 - 聂微东
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
S
SegmentFault 最新的问题
Apple Machine Learning Research
Apple Machine Learning Research
爱范儿
爱范儿
V
Visual Studio Blog
雷峰网
雷峰网
T
Tailwind CSS Blog
宝玉的分享
宝玉的分享
Blog — PlanetScale
Blog — PlanetScale
有赞技术团队
有赞技术团队
博客园 - 叶小钗
Microsoft Azure Blog
Microsoft Azure Blog
T
The Blog of Author Tim Ferriss
U
Unit 42
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
小众软件
小众软件
阮一峰的网络日志
阮一峰的网络日志
Y
Y Combinator Blog

人人都是产品经理

为什么你的产品找不到差异化?90%的失败都卡在第一步上(下) – 人人都是产品经理, 3年从30万到1300万用户、获2200万美元融资,这个AI教育产品用“抽卡”破解了获客难题 – 人人都是产品经理, 园区招商系统怎么做才能真正帮到去化?我加了这一个功能,推广链接转发400次阅读过万 – 人人都是产品经理, AI大事件:OpenAI发完网络安全模型又搞药物研发,小鹏汽车要抓”DeepSeek时刻” – 人人都是产品经理, 电商不是卖货,是一场更残酷的产品经理实战 – 人人都是产品经理, 没想到,活动营销又回来了! – 人人都是产品经理, 为何All-in海外KOC:一场关于AI时代窗口期的豪赌 – 人人都是产品经理, 重新理解企业的内部协作 – 人人都是产品经理, 苹果的 AI 战略到底是什么? – 人人都是产品经理, 医疗智能体·第2讲——合规护城河:等保、PIPL与HIPAA的架构实战 – 人人都是产品经理, 向量知识库五步法:从“答非所问”到“精准回复” – 人人都是产品经理, 鸿蒙PC三方库构建总指挥HPKBUILD(sha)库为例 – 人人都是产品经理, 何时该用LLM?AI产品经理的LLM设计指南 – 人人都是产品经理, 医疗信息领域的需求方、决策方、准入方以及关注点(二) – 人人都是产品经理, 即梦涨价:一场被误读的「傲慢」 – 人人都是产品经理, 面试AI PM必答题:Hermes和OpenClaw的区别,如何讲清楚业务价值 – 人人都是产品经理, AI的下一张船票:世界模型——AI产品经理必须理解的技术拐点 – 人人都是产品经理, 小红书做GEO,怎么让AI信你?记住这 3 个重要信息 – 人人都是产品经理, 5 家印度 AI 初创公司,看看印度 AI 再做什么 – 人人都是产品经理, AI项目跨团队协作:产品技术业务如何不打架 – 人人都是产品经理, Agentic Workflow(智能体工作流):让AI从”答案生成器”变成”数字员工” – 人人都是产品经理, lycium_plusplus 项目全景解读:OpenHarmony 三方库构建的“大管家” – 人人都是产品经理, 从爆单救火到前置履约:两套预采策略,把生鲜大促履约效率拉满 – 人人都是产品经理, 什么时候该补货?我用一轮数据做了一个决定 – 人人都是产品经理, 从“机械兜底”到“动态分流”:AI客服重复进线治理的4大底层逻辑 – 人人都是产品经理, 抖音拼效率,红书拼洞察 – 人人都是产品经理, 全民狂欢与退潮——为什么龙虾这波热潮冷却得如此之快? – 人人都是产品经理, Stripe押注!MPP重塑全球支付 – 人人都是产品经理, 小红书GEO:AI引用你的内容,不是因为你对,而是因为你看起来可信 – 人人都是产品经理, 前百度副总裁押注办公Agent,日韩付费爆发,Manus迎来强劲对手 – 人人都是产品经理,
ALL About AI 系列(三):RAG:检索增强生成
大波子 · 2025-10-05 · via 人人都是产品经理

在人工智能领域,大语言模型(LLM)虽然功能强大,但仍然存在知识更新困难和幻觉问题。为了解决这些问题,RAG(Retrieval Augmented Generation,检索增强生成)框架应运而生。

RAG(Retrieval Augmented Generation,检索增强生成)是一个将大语言模型(LLM)与来自外部知识源的检索相结合的框架,以改进问答能力的工程框架。通俗来说就是给大语言模型外挂一个知识库(通常是向量数据库),使其获得自身未能掌握的数据、知识。因此RAG基本解决了LLM知识更新困难以及幻觉问题。

RAG工程相较于微调大语言模型的成本会低很多,且目前随着 RAG 工程的发展,其最终实现效果也很不错。

RAG的实现流程

• 第一个大步骤就是将文本数据处理并进行向量化转化处理。这一步一般会用到 embedding 模型将文本块转化为向量并存储到向量数据库。

• 第二个大步骤则是根据用户输入的问题,在向量数据库中进行检索临近的文本块,整合个大模型输出最后的回复。

传统的文件知识库是用关键词匹配检索,而向量数据库是用语义匹配检索。

RAG的优化

优化其实就是针对RAG实现流程的各个节点进行优化,其中可能有些名词过于技术,产品经理做个了解即可,主要还是对可以优化的方向有个整体认知。

优化分块(chunk)

1️⃣选择合适的分块大小,并使用语义分块等高级分块策略,以确保检索到的Chunk 包含完整的上下文信息。同时可以使用滑动窗口增加上下文信息。

2️⃣有些时候文档内容会比较冗余,此时可以考虑对文档进行总结,减少冗余信息。

优化embedding

1.挑选合适的 embedding 模型:检索任务通常是判断两段内容是否相关,相似任务是判断两段内容是否相似,相关的内容不一定相似。

2.针对任务进行微调:embedding 模型的训练预料和实际检索的语料分布可能并不相同,此时在对应语料上进行 finetuning 可以显著提升检索到的内容的相关性。比如 OpenAI 也提供了代码相关的 code embedding 模型。

3.Adapter:也有研究者引入Adapter,在提取 query embedding 后进一步让 embedding 经过 Adapter,以便实现与索引更好的对齐。

优化提示词(prompt)

设计清晰、明确的Prompt,指导LLM 更好地利用检索到的上下文信息。同时要使用Prompt 工程技巧,详情可以参考ALL About AI 系列(二):提示词工程。

优化Query

1.Query 改写:对用户输入 query 进行修改或重写,通常只调整 query 结构、添加或删除关键词,或者通过近义词替换来扩展检索范围。

2.Query 纠错:通常是指尝试修正用户 query 中可能的拼写或语法错误。

3.Query Clarification:通常是指修正或分解用户 query 中不明确或模糊的内容,使系统更好地理解并执行相应的检索,有助于避免歧义。

优化生成

1.使用更强大的LLM,提高生成能力。根据具体任务,对LLM进行Finetune,提高生成效果。

2.使用合适的解码策略,如Top-ksampling、Nucleus sampling等,避免生成重复、不连贯的内容。控制生成长度,避免生成过于冗长的内容。

以上就是 RAG 技术最基础的内容,随着 RAG 技术的不断发展,市面上也在有层出不穷的技术,包括多模态 RAG、graphRAG 等,当然实际使用时还是要根据具体业务选择投入产出比最优的技术路线。

本文由人人都是产品经理作者【大波子】,微信公众号:【波仔的杂货铺】,原创/授权 发布于人人都是产品经理,未经许可,禁止转载。

题图来自Unsplash,基于 CC0 协议。