惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

博客园 - 【当耐特】
小众软件
小众软件
S
SegmentFault 最新的问题
GbyAI
GbyAI
量子位
爱范儿
爱范儿
L
LangChain Blog
Vercel News
Vercel News
A
About on SuperTechFans
腾讯CDC
博客园_首页
酷 壳 – CoolShell
酷 壳 – CoolShell
月光博客
月光博客
博客园 - 聂微东
Stack Overflow Blog
Stack Overflow Blog
H
Help Net Security
U
Unit 42
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
V
V2EX
V
Visual Studio Blog
美团技术团队
D
DataBreaches.Net
The GitHub Blog
The GitHub Blog
N
Netflix TechBlog - Medium

推广

Codex 助力小项目,全部重写了一遍,有点意思! 管转满血模型 GPT-5.5 / gpt-image-2 API 已上线,倍率调低 0.3,注册留 ID 送 5 美金额度 GPT-5.5 / gpt-image-2 API 已上线, 0.06$/张,注册留 ID 送 5 美金额度 不知道为什么, V2EX 的铜币实在是用不完。今天也没什么特别要宣传的,就随便来发发牢骚,消费一下铜币吧。 腾讯云国际站代充值渠道-支持 USDT 支付-免绑卡注册——LingduCloud 零度云! [发 15 个码] 开发的 Mac 应用 Deepseek coding plan 限量供应 腾讯云国际企业认证账号出售:阿里云/华为云国际可开国内节点 codex 中转,留邮箱就送。 5.1 香港旅游, Za bank 众安银行开户额外返现 300HKD 目前 GPT Plus 价格已经顶上天了,我们开发了 Pro 200 刀 拼车功能.... 3.3 元 即可上车 GPT5.5 出了? 限时 0.1x 倍率 送刀了 评论区抽 10 刀共*10 阿里云国际站充值代充-官方授权分销商开户——LingduCloud 零度云 [福利] 分享一个完美解锁 GPT-5.4 限制的住宅代理: Novproxy(内附 500M 免费试用) GPT 5.5 上了 0.1x 还不来? SentiCat 开启公测:一款自研架构的桌面 Agent,主打“任务执行+情感陪伴” 自用 OpenAI API 中转 🤡 自己搞了个 AI token 中转,能用 Codex / Claude Code,随便测下 Ai2You 智友社-让更多的人用上更好的 Ai,解决您的 AI 焦虑! 一个英语学习 APP [iOS] ,送 50 个终身会员 [中转] A 社官方满血 Opus-4-7 上线,限时免费开蹬!支持对接 & 开票! aicoding.sh: Claude API 企业级中转服务,数万用户稳定运行 GPT-5.5 上线 0.2x 倍率 Codex Plus/Pro 高缓存号池 持续稳定一个月 5.4 典型用量 8 元一亿 Token 新开业中转站 kir 0.2x GTP 0.1x gpt-image-2 0.08 华为云实名号购买:阿里云|腾讯云实名号免费开 感谢 V2EX 上各位 NAS🍆 和 Datahoarder 玩家的关注和真实反馈!作为个人开发者,能得到这么多硬核玩家们的讨论,我非常荣幸。 今天摸鱼给 NanaAI 也接入了 GPT-Image-2 腾讯云国际站实名账号 LingduCloud 零度云:腾讯云国际站实名账号认证教程! 价格差不多是官方 8 分之一的 codex 渠道,分享给大家 [星问] 紫微斗数 AI 智能解盘送福利了
Hitmux-Context-Engine——开源替代 ACE
Hitmux · 2026-06-27 · via 推广

https://github.com/hitmux/hitmux-context-engine

ACE 虽好,但 HCE 更好!开源且可自己部署!

1.先说优点:

  1. 几乎不要钱。推荐使用的 Qwen3 Embedding 4B 仅仅 0.02 刀/MTokens 输入
  2. 开源,完全自己部署。后端数据库也可以自建,也可以用免费的。甚至连向量模型,如果有好显卡也可以部署。即便没有,官方 api 成本也几乎为 0
  3. 准确度高。真实测试见附录

2. 准备条件

向量数据库:Milvus

如果机器大于 4G 内存,可以考虑自己安装 Milvus 数据库开源下载 Windows 可以用 Docker 安装

如果条件不够的,当然有免费的远程数据库,看上去是用的 AWS 的机器,有免费 5GB 空间:Zilliz Cloud

向量嵌入模型

这里推荐 Qwen3 Embedding 4B 硅基流动,国际站有一刀试用,完全够了

关于 Qwen3 Embedding 4B:

不推荐用 8B 的版本,因为据我测试 OpenRouter 上面的 8B 版本速度慢了 5 倍

如果想试用的话,直接注册硅基流动,我看国际站有 1 刀试用 Qwen3 Embedding 4B 官方定价输入 0.02$/M ,输出免费

这大概是什么概念呢?假设你有 100 万行的巨型代码库,大概 1000 万 Tokens 首次建立索引要全量输入,花费 0.2 刀 然后在开发期间查询了 1000 次,每次需要将查询的话转化成向量,一次 20Tokens ,共 20000/1000000*0.02=0.0004 刀 开发期间共改了 50%的代码。这些代码需要增量索引,花费 0.1 刀

0.1+0.2+0.0004=0.3004 ,差不多 2 块钱 一个硅基流动的试用一刀额度够完成三个这样 100w 行项目的开发

安装并配置 HCE

npm i -g @hitmux/hce 然后创建~/.hitmux-context-engine/config.conf并写入

embeddingProvider = OpenAI
openaiBaseUrl = https://example.com #不要带 /v1
embeddingModel = qwen/qwen3-embedding-4b
openrouterApiKey = sk-or-your-openrouter-api-key
milvusAddress = localhost:19530

如果用的是 Zilliz Cloud ,就把milvusAddress换成

# milvusAddress = your-zilliz-cloud-public-endpoint # 配置了下面的 Token ,此项可以省略,能自动推断
milvusToken = your-zilliz-cloud-personal-key

配置 MCP:

{
  "mcpServers": {
    "hitmux-context-engine": {
      "command": "hce"
    }
  }
}

OR

[mcp_servers.hitmux-context-engine]
command = "hce"

好了,完成了

cd 到你的项目,确保.gitignore 等文件正确 然后hce index即可。 用 OpenRouter 的 qwen3-embedding-4b 速度大概在 5w 行代码要 2 分钟 但查询一次仅仅 3-5s ,和代码库大小关系不大

附录

效果

https://github.com/hitmux/hitmux-context-engine/blob/main/README.zh-CN.md 页面最下方的图片

原理

见代码......