惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

有赞技术团队
有赞技术团队
G
Google Developers Blog
T
Tailwind CSS Blog
让小产品的独立变现更简单 - ezindie.com
让小产品的独立变现更简单 - ezindie.com
人人都是产品经理
人人都是产品经理
J
Java Code Geeks
P
Proofpoint News Feed
V
Visual Studio Blog
爱范儿
爱范儿
The Cloudflare Blog
博客园 - 叶小钗
V
V2EX
freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More
M
MIT News - Artificial intelligence
Microsoft Security Blog
Microsoft Security Blog
博客园 - 聂微东
H
Help Net Security
B
Blog
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
博客园 - 【当耐特】
量子位
宝玉的分享
宝玉的分享
WordPress大学
WordPress大学
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知

人人都是产品经理

为什么你的产品找不到差异化?90%的失败都卡在第一步上(下) – 人人都是产品经理, 3年从30万到1300万用户、获2200万美元融资,这个AI教育产品用“抽卡”破解了获客难题 – 人人都是产品经理, 园区招商系统怎么做才能真正帮到去化?我加了这一个功能,推广链接转发400次阅读过万 – 人人都是产品经理, AI大事件:OpenAI发完网络安全模型又搞药物研发,小鹏汽车要抓”DeepSeek时刻” – 人人都是产品经理, 电商不是卖货,是一场更残酷的产品经理实战 – 人人都是产品经理, 没想到,活动营销又回来了! – 人人都是产品经理, 为何All-in海外KOC:一场关于AI时代窗口期的豪赌 – 人人都是产品经理, 重新理解企业的内部协作 – 人人都是产品经理, 苹果的 AI 战略到底是什么? – 人人都是产品经理, 医疗智能体·第2讲——合规护城河:等保、PIPL与HIPAA的架构实战 – 人人都是产品经理, 向量知识库五步法:从“答非所问”到“精准回复” – 人人都是产品经理, 鸿蒙PC三方库构建总指挥HPKBUILD(sha)库为例 – 人人都是产品经理, 何时该用LLM?AI产品经理的LLM设计指南 – 人人都是产品经理, 医疗信息领域的需求方、决策方、准入方以及关注点(二) – 人人都是产品经理, 即梦涨价:一场被误读的「傲慢」 – 人人都是产品经理, 面试AI PM必答题:Hermes和OpenClaw的区别,如何讲清楚业务价值 – 人人都是产品经理, AI的下一张船票:世界模型——AI产品经理必须理解的技术拐点 – 人人都是产品经理, 小红书做GEO,怎么让AI信你?记住这 3 个重要信息 – 人人都是产品经理, 5 家印度 AI 初创公司,看看印度 AI 再做什么 – 人人都是产品经理, AI项目跨团队协作:产品技术业务如何不打架 – 人人都是产品经理, Agentic Workflow(智能体工作流):让AI从”答案生成器”变成”数字员工” – 人人都是产品经理, lycium_plusplus 项目全景解读:OpenHarmony 三方库构建的“大管家” – 人人都是产品经理, 从爆单救火到前置履约:两套预采策略,把生鲜大促履约效率拉满 – 人人都是产品经理, 什么时候该补货?我用一轮数据做了一个决定 – 人人都是产品经理, 从“机械兜底”到“动态分流”:AI客服重复进线治理的4大底层逻辑 – 人人都是产品经理, 抖音拼效率,红书拼洞察 – 人人都是产品经理, 全民狂欢与退潮——为什么龙虾这波热潮冷却得如此之快? – 人人都是产品经理, Stripe押注!MPP重塑全球支付 – 人人都是产品经理, 小红书GEO:AI引用你的内容,不是因为你对,而是因为你看起来可信 – 人人都是产品经理, 前百度副总裁押注办公Agent,日韩付费爆发,Manus迎来强劲对手 – 人人都是产品经理,
AI 产品经理,如何理解 RAG 技术?简洁版
wanee · 2024-08-16 · via 人人都是产品经理

本文将深入探讨增强检索技术的关键步骤、应用领域及其优势与局限性,揭示如何通过这项技术提升模型输出的可信度和专业性,同时确保对最新数据的访问。

一、什么是增强检索

LLMs 外挂一个“LLMs 外挂一个“实时更新的知识库”,使用外部数据提高LLMs的准确性专业性。

二、解决了什么问题

模型误导输出/知识缺乏实效性/垂直领域知识不足

三、应用领域

很通用,问答系统/内容摘要/对话系统/文本生成等

四、关键步骤

1. 在接到输入时,检索一组与之相关的文档或信息片段

  • 对于于这个输入构建一个或多个查询。
  • 这些查询从一个大型的数据存储(如文本数据库或知识库)中检索相关信息。

2. 将这些检索到的信息与输入结合起来,作为生成模型的输入

  • 模型通过一个检索系统(通常是预先训练好的检索模型或者是简单的基于关键词的检索系统)在数据存储中搜索相关的文档/信息片段
  • 返回一组与查询最相关的文档/信息片段,随后被编码为向量形式。通常使用预训练的语言模型(如BERT、RoBERTa等)来完成。
  • 融编码后的文档向量与原始查询的表示被融合,作为生成模型的输入。生成模型(如GPT)然后根据这些信息生成最终的输出文本。
  • 生成模型不仅考虑了原始输入的信息,也考虑了检索到的相关信息。

3. 生成更加准确和信息丰富的文本

  • 生成模型输出的文本被呈现给用户,作为对原始查询的回答或补充信息。

五、优势

1. 成本低,无需模型训练

通过检索现有的知识库,增强模型的回复质量,相比fine-tune的微调模型而言,成本更低,无需对模型进行重新训练。

2. 增强模型输出的可信度

Reg生成的回答可以附带对应的引用来源,用户点击引用来源后,可以查看对应的引用内容,可以随时验证模型回答的准确性,从而增加对模型输出的信任。

3. 增强模型输出的专业性

通过检索知识库中的信息,可以有效减少模型作出错误判断的可能性,并且通过检索知识库加上提示词的优化可以满足不同行业或者客群的定制话需求

4. 能够始终访问最新的数据

知识库可以实时更新便于调用最新的信息和数据,对于实时需要获取信息的领域尤为重要,比如教育医疗和金融领域。

六、局限性

不能根治LLM的本质局限。

不会改变推理能力,模型参数不变,模型固有能力不变,如果模型本身参数不足,在理解和推理上存在固有的缺陷,单纯用Rag技术,也无法提高模型的输出质量。

本文由 @wanee 原创发布于人人都是产品经理,未经许可,禁止转载

题图来自Unsplash,基于 CC0 协议

该文观点仅代表作者本人,人人都是产品经理平台仅提供信息存储空间服务。