惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

大猫的无限游戏
大猫的无限游戏
云风的 BLOG
云风的 BLOG
小众软件
小众软件
V
V2EX
博客园 - Franky
博客园 - 司徒正美
Apple Machine Learning Research
Apple Machine Learning Research
量子位
博客园 - 【当耐特】
雷峰网
雷峰网
WordPress大学
WordPress大学
Jina AI
Jina AI
Google DeepMind News
Google DeepMind News
N
Netflix TechBlog - Medium
爱范儿
爱范儿
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
阮一峰的网络日志
阮一峰的网络日志
IT之家
IT之家
Blog — PlanetScale
Blog — PlanetScale
Hugging Face - Blog
Hugging Face - Blog
H
Hackread – Cybersecurity News, Data Breaches, AI and More
V
Visual Studio Blog
Microsoft Security Blog
Microsoft Security Blog

远飞闲记

用 OpenClaw 搭建全自动晨间简报系统 Open Claw(🦞龙虾): 新手最常踩的 8 个坑,我帮你踩过了 什么是AI Agent(智能体)? OpenClaw 在微信端使用指南 如何让OpenClaw🦞更好用-调教篇 OpenClaw(龙虾🦞)自主赚钱实验笔记 本地Qwen+云模型:OpenClaw真实体验 AI博客主题开发记 OpenClaw初试记 十年博客路:在AI水文泛滥的时代,为何还在坚守? AI Coding实战吐槽:别被"400刀大神"带偏,这些坑我帮你踩过了! 《相信》把不可能变为可能 我们写的程序被杀毒软件杀了,杀毒软件到底杀了什么? 👋2024 探索Unity单元测试:构建可靠游戏代码的基石 实用小黄鸭调试法 炸裂的Unity割韭菜这事 还是要有信念 您好2023 Docker启动提示虚拟化失败 Golang中配置文件热重载方案 重置博客主题 双链知识管理及logseq使用体验 魔幻的魔都疫情 漫谈国内NFT市场状况 如何在UE4中平衡蓝图与C++的使用 2021时光荏苒,2022可遇可期 UE4(Unreal Engine)本地化资源功能 摈弃:“拥有更多=做的更好的”的观念 鱿鱼游戏
AI技能(Skill)和知识库瘦身:你喂给模型的每行废话,都在烧钱
2026-06-11 · via 远飞闲记

起因

这周我把公司 AI 组整理的项目知识库接进了 Claude Code 的开发流程,结果简直了 🤦‍♂️

模型的 Token 费用直接往上飙,迭代开发一个小需求花了将近 2 个小时。而之前同样复杂度的需求,顶多 30 分钟内搞定了。

怀揣着纳闷查了下原因——发现是因为知识库里某个 800 多行的 md 文件 导致的。

是的,就一个文件。

问题在哪

很多人觉得「知识库越大越好」「技能越全越牛」,恨不得把团队 wiki、API 文档、历史决策记录一股脑全塞给 AI。

但你有没有想过——大模型上下文窗口是固定的

你把一个 800 行的文件喂进去,模型得「读完」它才能理解你的需求。这期间:

  1. Token 消耗量暴涨(钱啊)
  2. 模型注意力被稀释(质量降了)
  3. 响应速度变慢(时间长了)

你以为是「喂得越饱,干活越好」——实际上是「喝水撑死」。

三个规则

我踩完坑之后,给自己定了三条铁律:

1. 每个 md 文件不超过 200 行

超过 200 行,说明这个文件的粒度有问题。拆。不要犹豫。

2. 用 readme 建立索引,别把所有细节堆进去

readme 就是地图,告诉模型「什么信息在哪个文件里」。模型需要的是导航能力,不是全文背诵。

3. 模块粒度要清晰、明确、简单

一个模块做一件事。如果这个文件既讲 API 又讲部署又讲历史背景——拆成三个文件。

最终解法

文件拆完之后,整个知识库还是有点大。怎么办?

向量化

把整个知识库通过向量化模型转成向量数据,存到本地的向量数据库里。写一个脚本和 Skill,让模型在需要的时候主动检索,而不是被动接收全部内容。

效果:

  • 上下文干净了
  • Token 省了
  • 响应变快了
  • 关键是——精度反而提高了

因为模型拿到的是精确匹配的相关信息,不是一堆噪音里的模糊答案。

小结

给你的 AI 知识库和 Skill 做一次瘦身吧。检查一下:

  • 有没有超过 200 行的文件?
  • 能不能用 readme 做索引?
  • 颗粒度够不够清晰?

你的模型会感谢你——你的钱包也是 😊