惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

Hugging Face - Blog
Hugging Face - Blog
Recent Announcements
Recent Announcements
V
Visual Studio Blog
博客园 - 叶小钗
H
Help Net Security
aimingoo的专栏
aimingoo的专栏
宝玉的分享
宝玉的分享
U
Unit 42
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
F
Fortinet All Blogs
V
V2EX
Stack Overflow Blog
Stack Overflow Blog
WordPress大学
WordPress大学
D
DataBreaches.Net
J
Java Code Geeks
H
Hackread – Cybersecurity News, Data Breaches, AI and More
A
About on SuperTechFans
酷 壳 – CoolShell
酷 壳 – CoolShell
量子位
C
Check Point Blog
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
小众软件
小众软件
Microsoft Azure Blog
Microsoft Azure Blog
M
MIT News - Artificial intelligence

博客园 - AlfredZhao

Git 提交代码:从报错到 SSH 免密推送 GitHub 克隆他人私有仓库:从授权到下载 理解Oracle Property Graph:以账户转账示例完成图特性最小测试 APEX 无法分配 SH 用户?一个存储过程轻松解决 SH 中文化样例数据使用手册 Oracle 排除非业务表:一份能直接抄的“全量过滤”SQL 进程都杀了,为什么 `netstat` 还能看到端口? MAC 空间告急?Codex 的 156GB 缓存垃圾,这样清! 人工清理问题数据:先查准,再删除 TK(Trusted Knowledge)为何而生? 使用快捷键快速切换 Mac 外接显示器模式 客户环境 Nginx 配置:流式报表与超时排查要点 Security Central:数据库安全的统一控制与运营平台 Palantir 眼中的一次“订单可能延期”,如何成为实时决策的起点? 从一条订单消息到 Bronze、Silver、Gold:我的第一次 Kafka + Lakehouse 实验 UUID v4 与 v7:同样是唯一 ID,为什么数据库表现可能完全不同? 用 crontab 给 LLM 使用量装上“监控眼” DeepSeek 与 GPT API 价格调整:该关注什么? 查看 Oracle 数据库中的定时任务执行情况 Codex 专用用户登录后自动进入默认项目目录 Mac 小技巧:用方向键优雅处理超长网址 Oracle GDD 与 Raft:别把共识机制和数据主权混为一谈 在 Oracle APEX 中用 BGE_BASE 生成向量:从模型导入到历史数据更新 行业人+AI:真正有价值的四个关键要素 知识库文件解析失败:一次由 Domain Index 引发的定位记录 Unicode 码位数、UTF-8 字节数、中英文差异和 Oracle 长度别再混淆了 Skill 的使用:从路径到能力边界 切换 Embedding 模型时,千万别忽略历史向量维度 kbot 适配 GPT-5.6:一次参数兼容性排查 Git 打 Tag 上传 GitHub 遇到 SSH 超时,如何处理?
AI编程系列02:合并知识功能,给 AI 问数和 RAG 场景打基础
AlfredZhao · 2026-06-12 · via 博客园 - AlfredZhao

按照之前文章《氛围编程实战系列:先规划清楚学习路径》这个规划路径,我们今天来开发第二个功能:合并知识功能。

总结这篇文章的初期阶段,其实让笔者非常的困惑。因为经历了太多思想碰撞。最终认为如果要持续学习一件新事物,还必须要从现实出发,不要为了学习而学习,而要为了解决一个实际问题而学习,哪怕这个问题开始很小,也没关系,不断迭代打磨终会有些价值。

01 | 不沉迷于Demo,想解决一个真问题

笔者是从2014年开始养成了写技术blog的习惯,当时给自己设了一个朴素的原则:把要做的事情想清楚,把想清的事情做出来,把做出的事情写下来。如今十几年过去,很庆幸一直没丢弃这个习惯。

但最近笔者其实也一直在思考一个问题,在当前的生成式AI时代背景下,知识、技术其实非常容易获得,连写一个新的应用程序都开始了Vibe Coding,人类坚持写技术blog的意义还有多大?与瞬间就能生成各类文章的AI相比,人工编写的优势又在哪里?

以笔者目前的认知,思考后的想法是这样的:AI发展到最后,基础模型能力会非常强悍,但它也是公共资源,模型能力可以被我们每个人调用,那么,当大家都使用同一个高能力模型的情况下,每个人的差异就会体现在使用模型的能力,而这个能力,在前期可能还和提示词工程、Agent、workflow编排等工程技术相关,但随着模型能力不断提升,需要人类做工程干预的就会越来越少,而最终的差异,一定还是比拼的真正属于自己的私有数据,这可能会是新时代真正属于每个人的私有不动产。

举个最简单的例子,你想要AI帮你写份年度工作总结,但你自己就没有记录这一年的真实工作记录给到他,那AI再强,写的再天花乱坠,其结果对你、对公司而言,都注定是没有任何价值的。

所以,现在最重要的事情,就是构建起属于自己的私有知识库。知识库可以是多个维度的,比如可以有你的工作记录,也可以有你的日常生活待办事项,还可以把一些验证过的技术知识沉淀下来。

02 | 从最熟悉的技术问题沉淀开始

现在几乎所有人每天都会和AI聊上几句,对于技术从业者,和AI聊很多技术问题,会发现因为LLM幻觉或初始对话时信息提供不够精准等问题,导致最初交付结果跑偏,但是经常可能在反复交谈过程中,在自己的真实环境验证后,不断迭代追问,针对最初的问题就能得到一个经过自己实际验证,可以真正解决自己问题的可信答案。

亦或者你已经有了一个类似龙虾、小马的Agent,可以让Agent去交互,但最终解决问题后,想把解决问题的方案记录沉淀下来。

笔者就想把这个准确的答案,以及我最初的这个问题提炼出来,然后存到属于自己的私有数据库里,作为个人的可信知识。

03 | 可信知识管理模块的设计和开发

可信知识管理:录入、查询、编辑、状态流转、批量合并,以及与待办事项互转。

开始 Vibe Coding ...

① 支持共享录入的待办事项流程

录入的界面最早尝试 Vibe Coding时已经有了,这里笔者让 Codex 帮我做了下微调,让其同时支持知识录入和待办事项录入,比如下面当选择待办事项时,会直接写入待办事项,从而避免那种纯粹的待办事项内容,污染到可信知识内容:

② 支持批量选择与合并能力

对录入知识的合并,场景是当发现录入的有些问题,如果篇幅不长,本质是都同属于一类大问题,可以对其合并,更利于后续对可信知识的利用(比如提升RAG场景下的召回率):

可以选择想合并的知识,点击”合并所选“就能弹出合并确认界面,支持二次编辑,最终可以”确认合并“也可以后悔”取消“。

③ 支持可信知识与待办事项之间的事务型互转能力

可信知识与待办事项之间,有互相转换的需求。

常见使用场景:

  • 可信知识之前录入了一些属于待办事项的,不适合作为知识。
  • 待办事项有些是技术问题,做完之后,适合转换为知识,供以后知识库使用。

所以笔者让Codex设计在两个工作区提供人工确认入口,类似这样:

点击”转为待办“,会弹出确认窗口:

同样,反之也支持将某项待办转为可信知识:

同样,点击”转为知识“,也会弹出确认窗口,避免误操作:

至此,可信知识管理:录入、查询、编辑、状态流转、批量合并,以及与待办事项互转已完成。

为后续的 AI 问数和 RAG 场景打好了数据基础。

关注我,大家一起成长~