惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

美团技术团队
B
Blog RSS Feed
博客园_首页
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
Google DeepMind News
Google DeepMind News
D
Docker
Blog — PlanetScale
Blog — PlanetScale
M
MIT News - Artificial intelligence
C
Check Point Blog
The Cloudflare Blog
T
Tailwind CSS Blog
大猫的无限游戏
大猫的无限游戏
量子位
The GitHub Blog
The GitHub Blog
Microsoft Azure Blog
Microsoft Azure Blog
I
InfoQ
T
The Blog of Author Tim Ferriss
博客园 - 【当耐特】
Vercel News
Vercel News
P
Proofpoint News Feed
Hugging Face - Blog
Hugging Face - Blog
V
V2EX
博客园 - 司徒正美

V2EX

我用 AI 写代码,但终端管理反而成了累赘——于是我做了 codux [调研] 各位在公司都用什么 ide 和 agent 写代码? 老运维 share 一个运维平台 看到有公司考核 token 指标,很好奇大家上个月的 AI 账单是多少 GLM-Coding 调用持续报错: z.ai 的 Lite 套餐几乎无法使用,官方 Pro/Max 是否稳定? 现在还有什么渠道可以稳定安全地使用 Claude 吗? 上海漕河泾内推,本组有 2 个 hc,一个后端,一个前端,预算都是 20k 左右,不打卡,氛围好 如果 V2EX 上有一组不永久保存聊天记录(比如只保存 7 天或者 24 小时)的聊天室,那么会开启哪些有用或者有趣的可能? gemini cli 貌似挂了,一直返回 403 第一次在自媒体上赚到钱 收集了最近在使用的低价 GPT, Gemini,邮箱等 AI 会员的小店合集 讨论个大实话:现在企业还在说 AI 编程提效 20%, 30%的,真的太落后,没用懂 AI。因为包括很多前沿公司,已经狂奔到提效 200%-500%的情况 [招聘][远程][币安] 前端/后端/QA/iOS/Android 至少 3 年以上经验 目前有大量 HC 欢迎投递 Chatgpt Pro 用量用不完的可以开这些设置 面试的时候好像遇到钓鱼了,给各位避个坑 cursor 年续费 22 号到期, 自动续费是否还是老的计次套餐呢 被两件破事毁掉的一下午,琐碎的内耗消磨人的精力 使用 Planet 存储 Codex 的会话或者重要信息 如果业务部门领导不要你开发功能,而是要求你教会它用 claude code 开发功能,你会怎么做? 分享一个 MacOS 接绿联 CM818 USB 转 DP 转接器使用感受 我的 HR 朋友 10 年老 Java ,非全大专,大家帮忙看看简历 开源了一个 AI 口语练习工具,音素级发音评分,完全免费可自部署 V2EX 上有哪些你觉得很有趣、印象深刻的妹纸? 字节为啥不出个国内版 Vercel? 有在大马的朋友吗? 问个运营商问题 你们在有领导的公司大群发过的最大胆的消息是什么 公司裁员,目前没有工作。想试试摆摊,做一个移动鲜啤打酒车 我的硬盘 Memblaze Pblaze 5 Linux 下不识别,给 Linux 内核提交了补丁, AI 说有望被合并 只有我一个人觉得 codex 不好用?
目前的 Agent 是不是皇帝的金锄头?
isSamle · 2026-02-02 · via V2EX

前情提要:

  1. 从 25 年年头 deepseek 带火了国内大模型氛围后,大部分公司就火急火燎的上马模型项目
  2. 经过一年的模型迭代基本上进化出了具备一定使用价值的各类模型
  3. 从模型训练到模型落地,各种工作流配置、知识库、智能体、自动写代码等等等……
  4. 近段时间发布的 Agent 打通阿里系应用,大龙虾 Clawdbot ,让 AI 帮你操作 XXX……

个人感受: 结合工作中遇到的情况,感觉现在的发展模式不太得劲,现在相当于让 AI 去分析自然语言,然后借用各种工具接口,去实现各种功能,Agent 和系统是分开的。

个人想法: 有一个 All-In-One 的想法,个人觉得关键技术应该是“模型记忆”,我们对系统的使用其实是对数据一系列的增删改查,包括现在个人能接触到的 Agent 的模式,也逃不过调用接口、MCP 、Skills 去实现对外部数据的增删改查;另一面,人类设计系统、人类记忆、学习、改变认知、掌握技能、输出知识等一系列过程,也是脑中数据的增删改查。

核心重点: 解决关键技术:“模型记忆”,可能以一个接口分发网关的形式呈现: 主要解决两个难题:1. 无序输入的有序存储 、2. 有序存储的无限归纳

  1. 当请求模型接口的时候,首先识别用户身份,这决定了后续数据存储的对应域;
  2. 通过分片、嵌入模型、大模型解析的方法,对传入的无序内容进行解构;
  3. 将解构后的内容,在记忆中做一定的检索,然后整合为新的内容;
  4. 通过语境和配置分析是否外部检索,调用传统的接口、MCP 、Skill ;
  5. 最后对所有的内容进行整合输出,并重新分片解构,存入记忆;

例如: user: 今天 XX 天气怎么样? system:用户是 xxx ,标记数据关联 xxx ; system: 分片:今天、XX 、天气; memory:检索到今天关联数据、XX 关联数据、xxx 关联数据、天气关联数据; system:分析有获取当前日期的需要、分析有调用天气接口的需要; ai: 获取日期、获取天气; ai: 整理内容,输出回复结果; system: 对对话进行切片,记忆:某年某月某日某地某人问过某问题回过某回复;

记忆的模式:ai 归类--相关日期--相关人--相关地点--相关元素--

经过对 AI 的调教,我们可以在他们的记忆里存储 N 个 N 维且相关质检有关联的表单(实际不以常规表单呈现,但是通过记忆的有序抽取可以构成一个表单,就类似于你问 XX 班语文成绩,然后回应就是,张三 90 分,李四 100 分…这样的有序类表结构),这个时候就不需要各种各样的系统了,AI 即是系统、AI 即是万物

flowchart TD
    A["拦截模型调用"] --> B["解析请求内容"]
    B --> C["在向量数据库查记忆"]
    C --> D["携带记忆进行整合"]
    D --> E{"需要外部检索?"}
    E -- "是" --> F1["构造检索关键词"]
    F1 --> F2["执行外部检索(知识库/联网)"]
    F2 --> F3["获取检索结果"]
    F3 --> F4["整合 请求内容 + 记忆 + 检索结果"]
    E -- "否" --> F4
    F4 --> G["按用户需要的形式返回响应"]
    G --> H["将过程中的内容写入向量数据库记忆"]

看下过年期间有没有空搞个 Demo 出来,有感兴趣一起搞的吗