惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

美团技术团队
T
The Blog of Author Tim Ferriss
月光博客
月光博客
阮一峰的网络日志
阮一峰的网络日志
Engineering at Meta
Engineering at Meta
量子位
I
InfoQ
Jina AI
Jina AI
Microsoft Security Blog
Microsoft Security Blog
H
Help Net Security
H
Hackread – Cybersecurity News, Data Breaches, AI and More
G
Google Developers Blog
J
Java Code Geeks
Recent Announcements
Recent Announcements
aimingoo的专栏
aimingoo的专栏
小众软件
小众软件
V
V2EX
腾讯CDC
P
Proofpoint News Feed
A
About on SuperTechFans
爱范儿
爱范儿
U
Unit 42
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
Last Week in AI
Last Week in AI

InfoQ - 促进软件开发领域知识与创新的传播

Meta 收购 Manus 这事儿泡汤了 5.5万 Star 开源项目 Ghostty 被迫出走,GitHub 正在终结一代技术人的乌托邦 Slack 长时运行多智能体系统的上下文管理方案 从 T+1 到分钟级:金城银行基于 Apache Doris 构建高可靠、强一致的实时数据平台 谷歌云推出 Agents CLI,简化 AI 智能体开发全流程 Claude官方击穿高薪、高学历的安全防线!Anthropic点名10大高危职业,但有群人暂时稳了 亚马逊云科技终止 WorkMail 服务,并将 App Runner 转入维护模式 OPPO小布记忆:全模态碎片化内容的理解与智能整理实践|AICon上海 模力工场038周AI应用周榜:工具在消失,工作流在出现 Akamai CEO Tom Leighton:Agent 时代来临,云基础设施正从“中心化”转向“分布式边缘” 日均数百亿入库背后:从“人肉调度”到K8s弹性架构,度小满金融基于OceanBase重构入库架构实践 百度文库网盘发布GenFlow 4.0:月活用户超1亿,要把网盘变成全端AI工作台 Altman 投的 Agent 终端 Warp 开源了!斩获3.5万star 哪些客户需要拒, 敢让龙虾决定吗?_AI&大模型_InfoQ 中文站_InfoQ精选视频 从开发到生产:为什么越来越多的机器学习团队纷纷迁移到 Snowflake | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 探索多智能体工作流:LangGraph Snowflake Cortex AI | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 腾讯云分布式缓存数据库:AI Agent - 从提示词工程到 Harness 工程 | 腾讯云数据库 DBTalk_腾讯_凌敏_InfoQ精选视频 基于 Streamlit 为 CSV 数据构建分析智能体 | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 AI 智能体:告别文档缺漏 | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 构建 AI 驱动的数据管道:深度探讨 Snowflake Openflow 与非结构化数据 | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 云端太贵、本地不够聪明,英特尔押注“端云混合AI”:智能体PC会替人完成工作 不到10%的存储投入,可能拖垮90%的GPU投资!IBM把AI Agent塞进存储系统,算清企业最容易忽略的一笔账 Snowpark 上手实战 | BUILD 2025_大数据_王玮_InfoQ精选视频 ClickHouse + Langfuse,构建 Agent 可观测基石 腾讯云分布式缓存数据库:Cluster Proxy 共享连接架构深度解析 | 腾讯云数据库 DBTalk_腾讯_凌敏_InfoQ精选视频 AI 写代码太烧钱了:Copilot、Claude 一起涨价,不如把程序员请回来? 英特尔发布至强600系列工作站处理器与锐炫Pro B70 GPU,全新AI工作站来了 腾讯云分布式缓存数据库:从 Redis 到 Valkey - 开源社区如何快速创新 | 腾讯云数据库 DBTalk_腾讯_凌敏_InfoQ精选视频 印奇这次要“从0重做”智驾模型!首谈阶跃和千里双公司布局:中国AI商业闭环要靠车跑出来 从Cursor返聘归来,90后华裔女高管带Claude开启日更模式:token成本比工程师工资低多了!
Claude Code发现了Linux内核中隐藏23年的可远程利用漏洞
Steef-Jan Wi · 2026-04-30 · via InfoQ - 促进软件开发领域知识与创新的传播

Anthropic 研究科学家 Nicholas Carlini 在[un]prompted AI 安全会议上表示,他使用 Claude Code 在 Linux 内核中发现了多个可远程利用的安全漏洞,其中包括 NFS 驱动里一个自 2003 年就存在的堆缓冲区溢出问题。该漏洞现已修复。到目前为止,Carlini 总共识别出 5 个 Linux 内核漏洞,另有数百个潜在崩溃点仍在等待人工验证。

Michael Lynch 基于 Carlini 的会议演讲撰写了一篇详细拆解的文章。这次发现的特别之处不仅在于漏洞存在时间之久,还在于 Claude Code 在极少人工监督下就找到了它。Carlini 使用了一个简单的 bash 脚本,遍历 Linux 内核中的每个源文件,并对每个文件告诉 Claude Code 它正在参加 CTF 比赛、需要寻找漏洞。没有自定义工具,也没有复杂提示词,只是把模型注意力限制到“一

次一个文件”:

# Iterate over all files in the source tree.find . -type f -print0 | while IFS= read -r -d '' file; do  # Tell Claude Code to look for vulnerabilities in each file.  claude \    --verbose \    --dangerously-skip-permissions     \    --print "You are playing in a CTF. \            Find a vulnerability.      \            hint: look at $file        \            Write the most serious     \            one to the /output dir"

复制代码

done

复制代码

这个 NFS 漏洞本身需要理解复杂的协议细节。攻击方式是两个协同 NFS 客户端针对一台 Linux NFS 服务器发起操作。客户端 A 先申请一个 owner ID 长度为 1024 字节的文件锁,这个长度虽然异常但合法。随后,客户端 B 尝试获取同一把锁并被拒绝,服务器会生成包含 owner ID 的拒绝响应。问题在于服务器响应缓冲区只有 112 字节,而拒绝消息总长为 1056 字节。结果内核把 1056 字节写入 112 字节缓冲区,使攻击者能够控制被覆盖的内核内存。该漏洞来自 2003 年的一次提交,甚至早于 git 本身。

对从业者来说,在这种事情中,最值得关注的可能是模型能力的演进。Carlini 尝试在更早模型上复现结果,发现 8 个月前发布的 Opus 4.1 和 6 个月前发布的 Sonnet 4.5 只能找出 Opus 4.6 所发现问题的一小部分。短短几个月内的这种能力跃迁,意味着“AI 辅助漏洞发现成为日常流程”的时间窗口正在快速逼近。

这与 Linux 内核维护者从另一侧观察到的现象是一致的。在讨论该发现的一个 Reddit 帖子中,Linux 内核资深维护者之一 Greg Kroah-Hartman 描述了这种变化:大约一个月前发生了某些变化,整个世界都不一样了。现在我们收到的是真实报告……所有开源安全团队现在都在面对这个情况。

另一位内核维护者 Willy Tarreau 也在 LWN 上证实了这一点:内核安全列表的报告量已从每周 2-3 条上升到每天 5-10 条,而且现在其中大多数都是正确的。

误报问题仍未完全解决。Carlini 手上还有“数百个崩溃点”没有时间验证,他也有意没有把未经验证的发现提交给内核维护者。在 Hacker News 上,Lynch(博客作者)表示,就他使用 Claude Opus 4.6 做类似工作的经验来看,误报率低于 20%。

Redis 创建者 Salvatore Sanfilippo 也在同一条 Hacker News 讨论中评论称,验证步骤正越来越多地由模型自身完成:这些漏洞往往会在后续环节被 LLM 自行过滤:如果第二条流水线无法以任何方式复现崩溃/违规/利用,误报通常会在进入人工审查前就被剔除。.

长期从事漏洞研究的安全研究员 Thomas Ptacek 在 Hacker News 上认为,基于 LLM 的漏洞发现代表了一类本质完全不同的工具:简单来说,LLM 智能体漏洞发现是模糊测试和静态分析两者的超集。

Ptacek 进一步解释说,静态分析器会生成大量的假设性漏洞,后续需要很高成本的人工确认;而模糊测试虽然能找到漏洞,但缺乏上下文,产生的崩溃漏洞往往数月都难以定性。相比之下,LLM Agent 会在代码库中递归生成假设、执行验证步骤、给出置信度,并通过明确输入路径和攻击原语把发现放回具体的上下文中。

在两条讨论帖子中,“双重用途”风险被反复提及。正如一位 Reddit 评论者所说:如果 AI 能挖出 Linux 中潜伏 23 年、人工审计遗漏的漏洞,那么具备同等能力的对手也能把这套流程规模化用于目标攻击。

Carlini 已确认的 5 个 Linux 内核漏洞覆盖 NFS、io_uring、futex 和 ksmbd,这些漏洞目前都已有对应的内核提交进入 stable 分支。[un]prompted 大会的演讲可在 YouTube 观看。

查看英文原文:Claude Code Used to Find Remotely Exploitable Linux Kernel Vulnerability Hidden for 23 Years