惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

C
Check Point Blog
罗磊的独立博客
博客园 - 叶小钗
Google DeepMind News
Google DeepMind News
Hugging Face - Blog
Hugging Face - Blog
人人都是产品经理
人人都是产品经理
J
Java Code Geeks
WordPress大学
WordPress大学
大猫的无限游戏
大猫的无限游戏
Blog — PlanetScale
Blog — PlanetScale
F
Fortinet All Blogs
小众软件
小众软件
M
MIT News - Artificial intelligence
Cyber Security Advisories - MS-ISAC
Cyber Security Advisories - MS-ISAC
酷 壳 – CoolShell
酷 壳 – CoolShell
The GitHub Blog
The GitHub Blog
A
About on SuperTechFans
Y
Y Combinator Blog
Recorded Future
Recorded Future
量子位
美团技术团队
S
Security @ Cisco Blogs
G
Google Developers Blog
Cyberwarzone
Cyberwarzone
C
Cybersecurity and Infrastructure Security Agency CISA
博客园 - 三生石上(FineUI控件)
博客园 - 司徒正美
D
Docker
S
Schneier on Security
T
Tor Project blog
阮一峰的网络日志
阮一峰的网络日志
T
Threatpost
P
Privacy & Cybersecurity Law Blog
C
Cisco Blogs
L
Lohrmann on Cybersecurity
NISL@THU
NISL@THU
Microsoft Azure Blog
Microsoft Azure Blog
博客园 - 聂微东
让小产品的独立变现更简单 - ezindie.com
让小产品的独立变现更简单 - ezindie.com
T
The Exploit Database - CXSecurity.com
A
Arctic Wolf
I
Intezer
Latest news
Latest news
Martin Fowler
Martin Fowler
G
GRAHAM CLULEY
B
Blog
V
Vulnerabilities – Threatpost
The Register - Security
The Register - Security
S
Securelist
T
Tenable Blog

博客园_首页

Plist 二进制格式 Milvus 和 PGVector,哪个更好? OpenClaw 已过时?在 VS Code 中运行 Hermes Agent! 第30篇文章:一个大三计科生的自白 Manim如何在数学公式中完美显示中文? Docker 部署 RocketMQ 5 并发编程核心概念辨析 C#事务处理最佳实践:别再让“主表存了、明细丢了”的破事发生 CLI 是什么?为什么大厂突然集体卷命令行? 【从0到1构建一个ClaudeAgent】协作-自主Agent UIImageView 设置图片不生效的原因排查 最小二乘问题详解20:无先验约束下的增量式SFM自由网平差 痞子衡嵌入式:大话双核i.MXRT1180之XIP应用里借助MU实现可靠Flash IAP的方法 AI Chat 封装, SemanticKerne.AiProvider.Unified 已发布 Windows下右键编辑js文件无法打开记事本——在注册表中使用环境变量 在后台服务中使用 Scoped 服务,为什么总是报错? H200 安装驱动并使用sglang启动模型 wireshark 抓包Trap上报告警内容 我用 AI 辅助开发了一系列小工具(2):图片压缩工具 [A Primer On MC and CC] 2.1 Memory Consistency 1 - 指令重排序和 SC 模型 Oracle数据库SCN推进技术详解与实践指南 玩转控件:封装个带图片的Label控件 Claude Code 4.7 真正该升级的不是模型,而是你的工作流 前端小白一句话,AI 帮我做了个颜值拉满的桌面媒体播放器。当代码不再是门槛,一句话编程就是现实。 5. WorkBuddy: 小龙虾的灵魂三件套,让你的小龙虾不只是工具 SQLite 分片方案实战:三种分片策略的深度对比 告别简陋 UI!一款基于 Fluent Design 和基于 WinUI 的开源免费、现代化的 Avalonia UI 控件库 关于二进制排列组合枚举的总结 AI开发-python-LangGraph框架(3-27-LangGraph从零实现大模型智能决策工作流) ElasticSearch主分片和副本分片概念详解 【002】HTTPS 粗解:证书、TLS 握手与对后端配置的影响 Hermes Agent 一周暴涨五万 Star,但我劝你别急着追 明明连接的是Redis的DB0,为什么能查到DB3的数据? 【从0到1构建一个ClaudeAgent】协作-Agent团队 熟悉电子元器件之后,电子小白下一步该怎么走? MAF快速入门(23)通过C#类定义Skills .NET 高级开发 | 手写一个对象映射框架 FastAPI数据库ORM怎么选?我肝了三个Demo后,终于不再纠结了 mysqldump 参数拾遗:在遗忘与铭记之间 C# .NET 周刊|2026年3月5期 Claude code入门 - 陈彦斌 一文学习入门 ThingsBoard 开源物联网平台 GitHub 热门项目 | 2026年04月16日 如何为GIT设置全局勾子,为每次提交追加信息 Number.isFinite和isFinite与isNaN()和Number.isNaN的区别 PortSwigger SQL注入LAB2 推荐一个测试人必备的Skills,从功能到性能全搞定(附详细实操和安装下载方式) 筑基期:掌握Odoo基础核心知识点02(Odoo XML 开发方式详解) GLM模型这么火,咱们用vllm也咧一个呗! 深入理解 AbortController:从底层原理到跨语言设计哲学 字符串学习笔记 多租户系统框架的基础模块设计和分析设计 Apache SeaTunnel Zeta 为什么能做到“又快又稳”? AI开发-python-LangGraph框架(3-26-LangGraph基本概念及第一个简单样例) Vue 3 组件通信,别只会用 Props 和 Emits 了,这几个狠活儿你得看看 ElasticSearch7.X版本配置密码 用Manim实现动态交点计算--从一个动点问题说起 团结引擎+Addressable+Instant Game打包抖音小游戏 function call 实战:让 LLM 自动判断 pod 异常、调用日志工具并完成故障分析 bubseek —— 让 Agent 的足迹,变成团队的洞察 通过 C# 读取并导出 PDF 书签 如何用 GitHub Actions 实现 Steam 自动化发布 【从0到1构建一个ClaudeAgent】并发-后台任务 .NET 高级开发 | 定制 ASP.NET Core 框架 电子小白:什么是运算放大器(运放) zero2Agent:面向大厂面试的 Agent 工程教程,从概念到生产的完整学习路线 堆上的ORW HC32F460 USB CDC通信异常:非对齐访问异常排查 20260413-Hyperbridge 攻击事件:发生在默克尔山上的验证绕过 那些喊着AI 要淘汰你的人,正在靠你的焦虑赚大钱! 深度学习进阶(八)Swin Transformer 最小二乘问题详解19:带先验约束的增量式SFM优化与实现 SnapTranslate 3.0 正式发布:全局划词翻译 + 完整英语学习闭环,一站式搞定查词、记词、复习 工作的意义、工作的困难认知再思考 .NET + AI 进阶实战:基于类的技能开发 - 打造可治理的 Agent 能力模块 【从0到1构建一个ClaudeAgent】规划与协调-技能 上周热点回顾(4.6-4.12) 电子小白的工具三件套:面包板、杜邦线、万能板 单表五亿数据的查询优化 | Mysql、StarRocks 2. WorkBuddy:从“我是谁”到“帮我干活” C# 如何减少代码运行时间:7 个实战技巧 基于HelixToolkit.SharpDX 渲染3D模型 - 笺上知微 从零开始的双臂具身VLA起源及现阶段发展综述 - SkyXZ 记对 xonsh shell 的使用, 脚本编写, 迁移及调优 - pluvium27 受够了Vibe Coding的失控?换个起点,让AI事半功倍 从开始配置漏洞环境到漏洞复现流程 - 難しい 关于10年工作经验的程序员对OpenClaw的实战经验分享以及看法 - 虚无境 Any metadata 的内存布局 C# .NET 周刊|2026年3月2期 - InCerry 我帮你测过了,测试圈排名第二的 Skill 依然很牛逼 Skill Discovery | 无监督技能发现的经典工作总结 - MoonOut 上下文工程是什么?过时了么?一文讲明白! - 一枫说码 开了 TUN 模式还是直连?90% 的人都踩过这个坑 AScript扩展多种脚本语言 - rockey627 AI 学习笔记:Agent 的记忆机制 你能被装进一个文件里吗?——7 万人把同事"蒸馏"成了 AI - 我没有三颗心脏 Claude Code 通关手册(七):给 AI 装上技能包——Skills 完全指南 - 暮色之狐 在浏览器中快速编辑代码:VSCode Web 集成实践 - Newbe36524 蒸馏自己 skill?基于 Deepseek 的蒸馏器,丐版蒸馏方式,简单便捷 - To_Carpe_Diem Spring AI Aliababa和AgentScope,哪个更好? - 苏三说技术
.NET如何实现向量语义分析
fanly11 · 2026-05-18 · via 博客园_首页

图片

图片

     这段时间一直在做插件平台,组件插件化,还有AI Agent组件插件,还扩展支持ai 知识库,向量语义分析,还研究了语言大模型、向量大模型,还有什么归一化,点积,余弦相似度等语义算法分析匹配,之前一直用llamasharp,然后用LLamaEmbedder 做向量语义分析,但是发现匹配不准确。后面查资料LLamaEmbedder 做中文短文本语义向量,本来就不准,尤其是:现在几点 / 当前时间 / 几点了 / 查时间生成模块代码 / 数据库表结构
它不准是天生缺陷。

二、LLamaEmbedder 为什么不准?(核心原因)   

它是 LLM 大语言模型,不是向量模型,不是专门为语义向量训练的,向量质量远不如 Sentence-BERT、BGE、m3e 这类专业模型。
    中文支持极差LlamaEmbedder 原生对中文短文本、口语化问句几乎不优化。
    输出的向量没有归一化、没有对齐语义导致余弦相似度乱跳:
        同义句分数低
        无关句分数高
    速度慢、占用高对比专业向量模型,完全不适合做匹配。

二、.net 真正准的语义向量方案(中文最强)

有两种向量模型方案:
方案 1:BGE 向量模型(国内最准)
方案 2:m3e 向量模型(轻量、超快、中文专门训练)

三、如何使用BGE 向量模型做向量语义分析

 下载这个:bge-small-zh 中文向量模型

https://hf-mirror.com/Xenova/bge-small-zh-v1.5

或单独下载vocab.txt,model.onnx

https://hf-mirror.com/Xenova/bge-small-zh-v1.5/resolve/main/vocab.txt

https://hf-mirror.com/Xenova/bge-small-zh-v1.5/resolve/main/onnx/model.onnx

然后可以封装成以下代码:需要通过nuget引用下载Microsoft.ML.OnnxRuntime和Microsoft.ML.Tokenizers

  public class OnnxBgeEmbeddingService : IDisposable
  {
      private readonly InferenceSession _session;
      private readonly BertTokenizer _tokenizer; // 使用 BertTokenizer

      // 模型输入名称(动态获取或硬编码)
      private readonly string _inputNameIds;
      private readonly string _inputNameMask;
      private readonly string _inputNameTokenType; // 新增:token_type_ids 名称
      private readonly string _outputName;

      // BGE 模型配置
      private const int MaxLength = 512;
      private const int PadTokenId = 0;
      private const int TokenTypeId = 0; // BGE/BERT 单句输入通常全为 0

      public OnnxBgeEmbeddingService(string modelPath, string vocabPath)
      {
          // 1. 初始化 ONNX 会话
          var sessionOptions = new SessionOptions();
          sessionOptions.InterOpNumThreads = 4;
          sessionOptions.IntraOpNumThreads = 4;

          _session = new InferenceSession(modelPath, sessionOptions);

          // 2. 初始化分词器
          _tokenizer = BertTokenizer.Create(vocabPath);

          // 3. 获取模型输入输出名称
          var inputKeys = _session.InputMetadata.Keys.ToList();
          _inputNameIds = inputKeys.FirstOrDefault(k => k.Contains("input_ids")) ?? "input_ids";
          _inputNameMask = inputKeys.FirstOrDefault(k => k.Contains("attention_mask")) ?? "attention_mask";
          // 关键修复:查找 token_type_ids 或 token_type_ids 类似的键
          _inputNameTokenType = inputKeys.FirstOrDefault(k => k.Contains("token_type")) ?? "token_type_ids";

          if (_session.OutputMetadata.Count == 0)
              throw new InvalidOperationException("Model has no outputs.");
          _outputName = _session.OutputMetadata.Keys.First();
      }

      public float[] GenerateEmbedding(string text)
      {
          if (string.IsNullOrWhiteSpace(text))
              throw new ArgumentException("Text cannot be null or empty");

          // 1. 分词并预处理 (截断 + 填充)
          var (inputIds, attentionMask, tokenTypeIds) = EncodeAndPreprocess(text);

          // 2. 构建输入张量
          // 注意:大多数 BGE ONNX 模型接受 int64 (long),部分优化模型接受 int32 (int)
          // 如果报错 Type Mismatch,请将 DenseTensor<long> 改为 DenseTensor<int>
          var inputIdsTensor = new DenseTensor<long>(inputIds, new[] { 1, inputIds.Length });
          var attentionMaskTensor = new DenseTensor<long>(attentionMask, new[] { 1, attentionMask.Length });
          var tokenTypeIdsTensor = new DenseTensor<long>(tokenTypeIds, new[] { 1, tokenTypeIds.Length });

          var inputs = new List<NamedOnnxValue>
      {
          NamedOnnxValue.CreateFromTensor(_inputNameIds, inputIdsTensor),
          NamedOnnxValue.CreateFromTensor(_inputNameMask, attentionMaskTensor),
          NamedOnnxValue.CreateFromTensor(_inputNameTokenType, tokenTypeIdsTensor) // 关键修复:添加此输入
      };

          // 3. 执行推理
          using var results = _session.Run(inputs);

          // 4. 提取结果
          var rawOutput = results.First().AsTensor<float>();

          // 关键修复:正确获取维度
          // rawOutput 形状通常为 [1, seq_len, hidden_size]
          // Dimensions 是一个 int[] 数组,例如 [1, 512, 384]
          if (rawOutput.Rank != 3)
              throw new InvalidOperationException($"Expected 3D output, got {rawOutput.Rank}D");

          int seqLen = rawOutput.Dimensions.Length; // 序列长度
          int hiddenSize = rawOutput.Dimensions.Length; // 向量维度

          float[] embedding = new float[hiddenSize];

          // 5. 平均池化 (Mean Pooling)
          int validTokenCount = 0;
          for (int i = 0; i < seqLen; i++)
          {
              // 只有当 attention mask 为 1 时才参与计算
              if (attentionMask[i] == 1)
              {
                  for (int j = 0; j < hiddenSize; j++)
                  {
                      // 累加每个维度的值
                      embedding[j] += rawOutput[0, i, j];
                  }
                  validTokenCount++;
              }
          }

          // 求平均
          if (validTokenCount > 0)
          {
              for (int i = 0; i < hiddenSize; i++)
              {
                  embedding[i] /= validTokenCount;
              }
          }

          // 6. L2 归一化
          Normalize(embedding);

          return embedding;
      }

      /// <summary>
      /// 编码并预处理:截断、填充、生成 Mask 和 Token Type IDs
      /// </summary>
      private (long[] InputIds, long[] AttentionMask, long[] TokenTypeIds) EncodeAndPreprocess(string text)
      {
          // 使用 BertTokenizer 编码
          // EncodeToIds 返回 ReadOnlyMemory<int>
          int[] originalIds = _tokenizer.EncodeToIds(text).ToArray();

          int currentLen = originalIds.Length;

          // 1. 截断 (Truncation)
          if (currentLen > MaxLength)
          {
              Array.Resize(ref originalIds, MaxLength);
              currentLen = MaxLength;
          }

          // 2. 填充 (Padding)
          if (currentLen < MaxLength)
          {
              int oldLen = originalIds.Length;
              Array.Resize(ref originalIds, MaxLength);
              // 将新增部分填充为 PadTokenId (0)
              for (int i = oldLen; i < MaxLength; i++)
              {
                  originalIds[i] = PadTokenId;
              }
          }

          // 3. 生成 Attention Mask 和 Token Type IDs
          long[] attentionMask = new long[MaxLength];
          long[] tokenTypeIds = new long[MaxLength];

          for (int i = 0; i < MaxLength; i++)
          {
              // Mask: 非 Padding 位为 1,Padding 位为 0
              attentionMask[i] = (originalIds[i] != PadTokenId) ? 1 : 0;

              // Token Type IDs: BGE 单句任务通常全为 0
              tokenTypeIds[i] = TokenTypeId;
          }

          // 将 int[] 转换为 long[] 以匹配 ONNX 输入要求
          long[] finalInputIds = Array.ConvertAll(originalIds, x => (long)x);

          return (finalInputIds, attentionMask, tokenTypeIds);
      }

      private void Normalize(float[] vector)
      {
          float sum = 0;
          foreach (var v in vector)
          {
              sum += v * v;
          }
          float norm = (float)Math.Sqrt(sum);
          if (norm > 0)
          {
              for (int i = 0; i < vector.Length; i++)
              {
                  vector[i] /= norm;
              }
          }
      }

      public void Dispose()
      {
          _session?.Dispose(); 
      }
  }

以下是调用:

 var onnxBgeEmbeddingService = new OnnxBgeEmbeddingService("Models/model.onnx", "Models/vocab.txt")
 onnxBgeEmbeddingService .GenerateEmbedding("微服务是什么")

以下就是用向量语义分析检索出来的AI对话结果

2758bc00e5642d3f126761146c0a5d87