惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

人人都是产品经理
人人都是产品经理
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
月光博客
月光博客
雷峰网
雷峰网
Google DeepMind News
Google DeepMind News
Y
Y Combinator Blog
Microsoft Security Blog
Microsoft Security Blog
M
MIT News - Artificial intelligence
WordPress大学
WordPress大学
MongoDB | Blog
MongoDB | Blog
V
V2EX
博客园 - 【当耐特】
GbyAI
GbyAI
Stack Overflow Blog
Stack Overflow Blog
I
InfoQ
Martin Fowler
Martin Fowler
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
Hugging Face - Blog
Hugging Face - Blog
B
Blog
V
Visual Studio Blog
D
DataBreaches.Net
C
Check Point Blog
freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More
F
Fortinet All Blogs

博客园 - aqi00

鸿蒙版本的JSBridge兼容与安卓配套的H5啦 15天学会AI应用开发(二十)使用LangChain实现RAG检索功能 15天学会AI应用开发(十九)使用LangGraph实现持久记忆功能 鸿蒙版本的小小机器人APP开放源码啦 15天学会AI应用开发(十八)使用LangGraph实现精确记忆功能 15天学会AI应用开发(十七)使用LangGraph实现会话记忆功能 15天学会AI应用开发(十六)LangChain实现对话记忆功能 15天学会AI应用开发(十五)使用LangChain封装AI执行链 15天学会AI应用开发(十四)搭建LangChain的开发环境 15天学会AI应用开发(十三)上下文与RAG的阶段性总结 15天学会AI应用开发(十二)从PDF、WORD、网页构建RAG 15天学会AI应用开发(十一)从TXT文件构建RAG知识库 15天学会AI应用开发(九)利用Chroma持久化向量数据 15天学会AI应用开发(八)使用向量数据库实现RAG功能 15天学会AI应用开发(七)有了大模型为什么还要引入RAG 15天学会AI应用开发(六)使用离线大模型对文本生成摘要 一文速览 HarmonyOS 6.1.1 推出的十个新特性 15天学会AI应用开发(五)使用AI摘要来压缩上下文消息 15天学会AI应用开发(四)根据Token长度截断历史对话 15天学会AI应用开发(三)把历史对话作为提示词会怎样 15天学会AI应用开发(二)为什么编写提示词这么重要 15天学会AI应用开发(一)搭建AI大模型应用开发环境 一文理清 HarmonyOS 6.0.2 涵盖的十个升级点 FFmpeg开发笔记(一百零二)国产的音视频移动开源工具FFmpegAndroid FFmpeg开发笔记(一百零一)跨平台的开源音视频移动框架MobileFFmpeg 一文速览 HarmonyOS 6.0.1 引入的十个新特性 一文读懂 HarmonyOS 6.1 带来的十大重要升级 新书《鸿蒙HarmonyOS 6应用开发:从零基础到App上线》出版啦 FFmpeg开发笔记(一百)国产的Android开源视频压缩工具VideoSlimmer FFmpeg开发笔记(九十九)基于Kotlin的国产开源播放器DKVideoPlayer
15天学会AI应用开发(十)把文本嵌入模型换成国产模型
aqi00 · 2026-06-28 · via 博客园 - aqi00

前面两篇文章在演示RAG功能时,做向量化的文本嵌入模型都用国外的all-MiniLM-L6-v2,该模型主要适用英文,对于中文总体也能用,但在细节上处理欠佳。本文就来介绍如何使用国产离线的文本嵌入模型替换国外模型,以及如何体现国产模型的比较优势。

一、all-MiniLM-L6-v2的缺点

虽然all-MiniLM-L6-v2的优点很多,比如下列几点:

1、体积极小:几十 MB,随便本地离线下载
2、速度超快:CPU 就能跑,不用显卡
3、通用好用:英文很强,中文也能用(日常 RAG 足够)
4、适配所有向量库:FAISS、Chroma、Milvus 全都兼容

但是all-MiniLM-L6-v2的缺点也很明显,就是它对中文的理解能力一般,有时会出现一些似是而非的错误。

比如之前的文章《15天学会AI应用开发(八)使用向量数据库实现RAG功能》,运行Python测试代码时,如果输入的问题是“RAG是什么”,输出日志结果如下:

然而原始的知识库是这样的:

可见问题“RAG是什么”的正确答案是第二条知识“RAG代表检索增强生成,通过检索外部知识提升大模型回答准确性。”,但all-MiniLM-L6-v2返回的答案却是最后一条知识“RAG让大模型能引用外部知识,避免胡说八道。”,说明all-MiniLM-L6-v2对中文的支持不够精准。

对于专业中文的RAG来说,更好的办法是换成国产的文本嵌入模型,比如BGE-small、BGE-base、Qwen-Embedding等等。

二、下载中文嵌入模型BGE-small

BGE-small的模型页面为 https://modelscope.cn/models/BAAI/bge-small-zh-v1.5 ,模型文件大小为192.25MB。

在下载离线大模型前,要先在命令行执行下面的pip安装命令:

接着命令行通过cd命令进入Python工程的所在目录,再执行下面的模型下载命令:

上面下载命令的“--model”参数表示离线大模型为“BAAI/bge-small-zh-v1.5”,而“--local_dir”参数表示离线大模型的本地保存目录。

下载完毕,即可在Python工程的目录下方找到bge-small-zh-v1.5文件夹,里面保存的便是BGE-small的具体模型文件。

三、结合BGE-small与FAISS实现RAG

接下来演示如何使用BGE-small与FAISS实现RAG检索功能。在编写Python代码前,要先在命令行执行下面的pip安装命令:

然后编写下面的Python检索测试代码,与之前教程的代码相比,仅仅把all-MiniLM-L6-v2改成了bge-small-zh-v1.5:

运行上面的Python代码,根据提示先输入问题“RAG是什么?”,再输入问题“RAG有哪些作用?”,输出日志结果如下:

可见在回答问题“RAG是什么?”的时候,BGE-small正确返回了第二条知识“RAG代表检索增强生成,通过检索外部知识提升大模型回答准确性。”。
在回答问题“RAG有哪些作用?”的时候,BGE-small也正确返回了最后一条知识“RAG让大模型能引用外部知识,避免胡说八道。”

由此说明,中文嵌入模型确实比国外的all-MiniLM-L6-v2拥有更准确的中文检索结果。

本系列的AI应用开发文章目录为《15天学会AI应用开发全目录(零基础小白,零Token消耗)》。