惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

IT之家
IT之家
博客园_首页
S
SegmentFault 最新的问题
罗磊的独立博客
博客园 - 【当耐特】
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
阮一峰的网络日志
阮一峰的网络日志
D
Docker
雷峰网
雷峰网
Google DeepMind News
Google DeepMind News
博客园 - 司徒正美
V
V2EX
大猫的无限游戏
大猫的无限游戏
V
Visual Studio Blog
腾讯CDC
宝玉的分享
宝玉的分享
酷 壳 – CoolShell
酷 壳 – CoolShell
人人都是产品经理
人人都是产品经理
T
Tailwind CSS Blog
Vercel News
Vercel News
H
Help Net Security
博客园 - Franky
D
DataBreaches.Net
aimingoo的专栏
aimingoo的专栏

分享创造

分享 KCase 脑图测试用例生成平台(AI 辅助生成测试用例) 标签页囤积症自救:写了个插件 TabRack,主打快速检索、自动分类和 AI 摘要 [file-preview]一个比较全面的在线文件预览组件库-支持 react 和 vue 撸了个 iOS 小应用[极简水印相机],直接免费 做了一个 V2EX Skill 写了个 iOS 打码 App「遮鸭 Maskduck」,纯离线免费 35 岁前端,裁员失业后,我花 1 个月做了个 AI 生图网站 亲身经历猫咪急症,我做了一款猫狗疼痛检测工具,希望能救你家毛孩一命 如何用 AI 做比较酷炫的落地页? 求真!最近 AI 生图的能力强到可怕 开源一个查看 k8s 的菜单栏工具-kubebar Packpour:我做了个专门给 App Store Connect 填多语言元数据的小工具 面对 140 年一遇的超级厄尔尼诺,我做了个全球监测小站 做了一个自动翻译的 Hacker News 客户端 做了一个 AI 头像生成器,可以免费生成 2 次 [送码 50 个] 自己手搓了个高颜值的倒数日 App——拾光机,求 V 友们指点 一个将苹果健康 APP 数据导出的工具,然后把你的数据喂给 AI 分析 我做了一个叫「订阅斩」的 iOS App,专门对付那些悄悄扣钱的订阅 做了个草率的日麻互动漫画,听听反馈 喜欢自己洗车的朋友们,我用 ai 做了一款洗车小程序 -- 洗车志 感谢 V2EX 上各位 NAS🍆 和 Datahoarder 玩家的关注和真实反馈!作为个人开发者,能得到这么多硬核玩家们的讨论,我非常荣幸。 用 AI 开发熊孩子自律的小程序 用 OpenClaw 搭建个人运动助手 今天摸鱼给 NanaAI 也接入了 GPT-Image-2 [Video Companion]一个 chrome 插件,解决大多对视频操作的需求~欢迎使用提 bug AI 时代,做产品简单了,把产品推广出去却变的更难了~ bestskills.dev - Skills 精选和评测站点 免 ROOT 强力卸载安卓广告软件 一个 All In One 的运维工具,支持 SSH、数据库、Redis 管理 [开源] Codeg V0.10:专注于代码生成的多智能体 IDE(cc、codex、gemini、opencode……),新版本重构了工作区,飞一般的体验,支持桌面端、服务器部署
做了一个 AI 工作流 SOTA 诊断 skill,希望能直接基于工作空...
gilgameshcc · 2026-05-13 · via 分享创造

先说真话——

发这帖主要是想找几个 fellow ,一起追 Claude Code / Cursor / MCP / agent 这一摊东西的当前 SOTA

我自己用 Claude Code 半年,从 hooks / skills / MCP / subagent 一路跟着出新,但每周还是会怀疑两次"我这套 harness 是不是已经落后了"——你们应该也有过这种感觉。

X 和即刻上人人都在晒 setup ,没人讲「你当前 workspace 在哪一档 / 跟 SOTA 差哪几条 / 下一步先装哪个能消化的」。所以我做了一个工具 lorejump.com但更想做的是建一个小群,30 人左右,互相戳一下姿势。


工具长什么样

两种用法:

轻量看一眼:直接在 lorejump.com 首页输入框聊两句,它跑一个自适应问卷( A 问卷 → B 出分 → C 深聊)给你一个 7 维诊断。看完想深扫再装 skill 。

深扫:在你自己 Claude Code 里装 skill + 配 MCP ,/lorejump-optimize 一下,它扫你的 CLAUDE.md / .claude/ 配置 / 仓库结构 / spec 体系,用你自己的 agent 对照 SOTA 知识库打分 —— 输出 7 维分数 + 落后维度 + 1-3 条"当下能消化、可验证"的下一步(不强推完整 harness 模板让你 copy )。

评分逻辑在 agent 侧,知识库在 MCP 侧(只有 2 个 tool:get_sota_pack 拉 SOTA 画像 + submit_report 回执)。你的代码 / prompt 不离开你的机器

7 个维度:D1 Spec 驱动 / D2 上下文管理 / D3 版本控制 / D4 测试质量 / D5 多 Agent 利用 / D6 文档体系 / D7 工作流自动化( D1 + D5 是我赌的"还没被占据的差异化维度",D3/4/6/7 对齐既有 SOTA )。

跑完一次后再跑 /lorejump-harness,server 会带「自上次以来 N 条新实践、K 条与你相关」的 diff 文本——这是我真正想做的事:演变追踪 + 集体经验,不靠"top X%"这种统计学套路。

承诺:skill 跑出来你觉得没对上你的姿势 / 没给到有用的东西 —— 直接来群里 @ 我,我个人帮你看。范围限 AI 工作流( Claude Code / Cursor / Codex / MCP / skill / subagent / hooks ),我都跑过。我也不会的,我帮你在群里找到会的人。


还没想清楚的 3 个问题

  1. SOTA 怎么定义:现在 1 周扫一次 Claude / Anthropic / Cursor / Codex 官方更新 + 部分活跃 dev 实践,server 直读 markdown 而非 BI schema 。但热点变化更快——要不要做"用户自报实践"反向喂?喂了怎么验真?
  2. W0-W4 阶段识别:skill 现在用扫描信号反推用户 workspace 形态( W0 裸项目 → W4 完整 harness 五层齐全),按当前档推下一步。独立开发 / 团队 lead / 内容创作者关心的事不一样——同一档下要不要分流推荐?
  3. 跑完一次之后凭什么再来:我现在只敢做 H1 diff digest (附在 nudge 文本里,不做独立邮件 / streak / wrapped )。但这够不够拉人回来?还是说就该接受"一次性诊断 + 偶尔回看",不强求留存?

这 3 条都想拉群里聊。


群的规则

  • 30 人左右,群里就是我( GIL )—— 我能管多少管多少,挤不下再说,不写 waitlist
  • 我每条 @ 都会接,但不承诺时效(一个人,老实说)
  • repo 现在没公开(一个人搞,文档比代码乱),关键决策我直接群里贴
  • 进来后第一周认真用一次( Web 试 or skill 深扫都行)+ 反馈 3 条具体的,就算共创

怎么进群:楼下回复。我看到就拉群。


不指望刷屏。同样在追 SOTA 的兄弟来一个我珍惜一个,每条回复都会接。