惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

P
Proofpoint News Feed
Martin Fowler
Martin Fowler
The GitHub Blog
The GitHub Blog
B
Blog RSS Feed
U
Unit 42
阮一峰的网络日志
阮一峰的网络日志
量子位
GbyAI
GbyAI
Cyber Security Advisories - MS-ISAC
Cyber Security Advisories - MS-ISAC
云风的 BLOG
云风的 BLOG
小众软件
小众软件
博客园 - 三生石上(FineUI控件)
L
LangChain Blog
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
博客园_首页
IT之家
IT之家
V
Visual Studio Blog
Y
Y Combinator Blog
Blog — PlanetScale
Blog — PlanetScale
宝玉的分享
宝玉的分享
Apple Machine Learning Research
Apple Machine Learning Research
I
InfoQ
D
Docker
V
V2EX

博客园_首页

Linux实操--组管理、权限管理和定时任务 Java + EasyExcel 实现单个接口导出多个Excel Mem0 源码解析系列(二):提示词工程的深度剖析 Openclaw TaskFlow究竟是什么?和普通Skill技能有什么区别 博文阅读密码验证 - 博客园 嘉立创开源:应该是全网MicroPython教程最多的开发板 Hermes Agent 集成实践:从协议到生产 2026年AI编程工具横评:Cursor、Codex、Claude Code、Zed、Windsurf Java程序员必看的RAG入门教程 2026 AI效率神器:Superpowers + Claude Code 保姆级教程 本地大模型部署全攻略:从 0 到 1 玩转 Ollama 【从0到1构建一个ClaudeAgent】内存管理-上下文压缩 .NET 高级开发 | 设计、实现一个事件总线框架 电子小白入门之NE555 3. WorkBuddy:隐藏玩法,一键召唤专家,让 AI 以"专家身份"给你干活 和AI一起搞事情#3:Claude Teammate 游戏开发翻车实录 【OpenClaw】通过 Nanobot 源码学习架构---(7)Memory C# .NET 周刊|2026年3月3期 我在 Debian 11 上把 K8s 单机搭起来了,过程没你想的那么顺(/opt 目录版) 深度学习进阶(七)Data-efficient Image Transformer CLI+Skill搭建浏览器AI自动化框架,告别一切重复枯燥任务 告别Token账单无底洞:OpenClaw本地部署,重塑企业数据主权的唯一解 FastAPI+Vue:文件分片上传+秒传+断点续传,这坑我帮你踩平了! SBTI 爆火后,我做了个程序员版的 CBTI。。已开源 + 附开发过程 多模态检索开始进入工程期:用 Sentence Transformers 搭建可落地的 Multimodal RAG 100多行代码实现一个最简单的Agent(用ReAct) Claude Code 通关手册(八):推荐 5 个 Hooks,代码质量提升 3 倍 老板:“有人截图了!”。安全部门:“收到,马上查暗水印!” - why技术 技术之外,皆是人间 C#/.NET/.NET Core技术前沿周刊 | 第 69 期(2026年4.01-4.12)
15天学会AI应用开发(十)把文本嵌入模型换成国产模型
aqi00 · 2026-06-28 · via 博客园_首页

前面两篇文章在演示RAG功能时,做向量化的文本嵌入模型都用国外的all-MiniLM-L6-v2,该模型主要适用英文,对于中文总体也能用,但在细节上处理欠佳。本文就来介绍如何使用国产离线的文本嵌入模型替换国外模型,以及如何体现国产模型的比较优势。

一、all-MiniLM-L6-v2的缺点

虽然all-MiniLM-L6-v2的优点很多,比如下列几点:

1、体积极小:几十 MB,随便本地离线下载
2、速度超快:CPU 就能跑,不用显卡
3、通用好用:英文很强,中文也能用(日常 RAG 足够)
4、适配所有向量库:FAISS、Chroma、Milvus 全都兼容

但是all-MiniLM-L6-v2的缺点也很明显,就是它对中文的理解能力一般,有时会出现一些似是而非的错误。

比如之前的文章《15天学会AI应用开发(八)使用向量数据库实现RAG功能》,运行Python测试代码时,如果输入的问题是“RAG是什么”,输出日志结果如下:

然而原始的知识库是这样的:

可见问题“RAG是什么”的正确答案是第二条知识“RAG代表检索增强生成,通过检索外部知识提升大模型回答准确性。”,但all-MiniLM-L6-v2返回的答案却是最后一条知识“RAG让大模型能引用外部知识,避免胡说八道。”,说明all-MiniLM-L6-v2对中文的支持不够精准。

对于专业中文的RAG来说,更好的办法是换成国产的文本嵌入模型,比如BGE-small、BGE-base、Qwen-Embedding等等。

二、下载中文嵌入模型BGE-small

BGE-small的模型页面为 https://modelscope.cn/models/BAAI/bge-small-zh-v1.5 ,模型文件大小为192.25MB。

在下载离线大模型前,要先在命令行执行下面的pip安装命令:

接着命令行通过cd命令进入Python工程的所在目录,再执行下面的模型下载命令:

上面下载命令的“--model”参数表示离线大模型为“BAAI/bge-small-zh-v1.5”,而“--local_dir”参数表示离线大模型的本地保存目录。

下载完毕,即可在Python工程的目录下方找到bge-small-zh-v1.5文件夹,里面保存的便是BGE-small的具体模型文件。

三、结合BGE-small与FAISS实现RAG

接下来演示如何使用BGE-small与FAISS实现RAG检索功能。在编写Python代码前,要先在命令行执行下面的pip安装命令:

然后编写下面的Python检索测试代码,与之前教程的代码相比,仅仅把all-MiniLM-L6-v2改成了bge-small-zh-v1.5:

运行上面的Python代码,根据提示先输入问题“RAG是什么?”,再输入问题“RAG有哪些作用?”,输出日志结果如下:

可见在回答问题“RAG是什么?”的时候,BGE-small正确返回了第二条知识“RAG代表检索增强生成,通过检索外部知识提升大模型回答准确性。”。
在回答问题“RAG有哪些作用?”的时候,BGE-small也正确返回了最后一条知识“RAG让大模型能引用外部知识,避免胡说八道。”

由此说明,中文嵌入模型确实比国外的all-MiniLM-L6-v2拥有更准确的中文检索结果。

本系列的AI应用开发文章目录为《15天学会AI应用开发全目录(零基础小白,零Token消耗)》。