惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

V
V2EX
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
WordPress大学
WordPress大学
罗磊的独立博客
小众软件
小众软件
I
InfoQ
Y
Y Combinator Blog
宝玉的分享
宝玉的分享
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
Hugging Face - Blog
Hugging Face - Blog
MyScale Blog
MyScale Blog
博客园 - 聂微东
Microsoft Security Blog
Microsoft Security Blog
H
Help Net Security
酷 壳 – CoolShell
酷 壳 – CoolShell
博客园_首页
S
SegmentFault 最新的问题
博客园 - 三生石上(FineUI控件)
P
Proofpoint News Feed
博客园 - 司徒正美
Cyber Security Advisories - MS-ISAC
Cyber Security Advisories - MS-ISAC
Microsoft Azure Blog
Microsoft Azure Blog
Jina AI
Jina AI
N
Netflix TechBlog - Medium

博客园 - 大树2

agent经典的ReAct过程 Cumora AI Agent 协同工作平台 Dify用于建 AI 应用(chat,agent,工作流,RAG,MCP, web App)的平台 国内主流大模型的API的申请地址 AI 智能体架构设计的12条原则 AI Agent 是如何一步步开发完成的 Crew AI 多agent 技术媒体编辑部:批量生产科技文章 demo 使用CrewAI 多agent 协作,创作高考优秀作文的demo 使用本地ollama 部署的模型,不需要token,使用ollama及第三方向量模型 langgraph LLM 大模型 做意图分类 llamaindex 开源 RAG 框架 使用汇总 面向多模态检索的向量数据库对比分析和技术选型Chroma,PGVector,Milvus UV python的包和环境管理工具 cursor AI工具配合编程总结 FastApi python, React TS 快速构建AI agent开发 Python conda 调用AI 模型 扣子 工作流程开发 AI图片,图像工具,创作工具 安装openclaw ClawHub CLI openclaw skills 安装 的三种方式:命令安装,手动下载安装,web ui安装 openclaw 学习资源 与三种沙箱模式的区别及配置 Cursor的四大模式:Agent、Plan、Debug、Ask,到底怎么用,能让效率翻倍 你能想到的openclaw 落地应用场景有哪些? windows cmd安装openclaw openclaw 安装手册及链接飞书 conda安装,langchain使用,国内提供大模型api调用的平台 langChain 大模型开发知识汇总 AI大模型应用开发知识体系 Nacos核心参数配置,解决某个应用注册后没有心跳问题,可能是将该服务配置为临时服务 腾讯云:购买域名,域名解析,域名备案,安全组,SSL证书,配置ssl证书,nginx转发
RAG 中英双语 Embedding 嵌入模型
大树2 · 2026-07-17 · via 博客园 - 大树2

RAG Embedding 嵌入模型

文本向量化,存人向量库,文档粗召回,文档重新排序介绍

BAAI--bge-large-zh-v1.5(向量化,粗召回 亿万级文档)
BAAI--bge-small-zh-v1.5(向量化,粗召回 百万级文档)
BAAI--bge-reranker-large(重新排序)

是中文知识库、英文文档混合场景通用,国内 RAG 首选重排模型.
是中英双语交叉编码器(Cross-Encoder)重排模型,由智源 BAAI 开源,专门做检索结果精排序,是 RAG 知识库、文档问答系统必备组件BGE

1.文本向量,保存到向量库
2.向量相似度召回100条候选,送入reranker 模型按分值重新排序,取出前5条告分文档,和用户输入的问题一起 交给大模型生成答案

典型应用场景
1.企业内部知识库问答(你当前文档上传检索业务)
2.本地文档、PDF、TXT,markdown 检索系统
3.智能客服、医疗 / 法律垂直问答
4.本地搜索引擎、论文文献筛选

模型 参数 模型体积 速度 检索精度 适用场景
bge-small-zh-v1.5 24M ~96MB 最快,CPU 无压力 中等,简单场景够用 单机低配、百万级文档、并发高、轻量化服务
bge-large-zh-v1.5 326M ~1.3GB 慢,推荐 GPU 加速 中文语义匹配更强,歧义区分更好 高精度知识库、专业文档(法律 / 医疗)、追求检索质量