惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

B
Blog RSS Feed
Martin Fowler
Martin Fowler
爱范儿
爱范儿
IT之家
IT之家
Last Week in AI
Last Week in AI
A
About on SuperTechFans
Google DeepMind News
Google DeepMind News
阮一峰的网络日志
阮一峰的网络日志
V
V2EX
aimingoo的专栏
aimingoo的专栏
G
Google Developers Blog
J
Java Code Geeks
Microsoft Azure Blog
Microsoft Azure Blog
美团技术团队
The Cloudflare Blog
MyScale Blog
MyScale Blog
T
The Blog of Author Tim Ferriss
Hugging Face - Blog
Hugging Face - Blog
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
云风的 BLOG
云风的 BLOG
Y
Y Combinator Blog
The GitHub Blog
The GitHub Blog
腾讯CDC
Microsoft Security Blog
Microsoft Security Blog

Java for You

把评测员请进AI实验室,独立性反而更难证明了 - Java for You - java4u 《深入分析Java Web技术内幕》.pdf - Java for You - java4u 《JAVA网络编程》.pdf - Java for You - java4u 《Java 工程师成神之路》.pdf - Java for You - java4u Copilot开始统计“真正用过什么”:AI落地终于不只看活跃人数 - Java for You - java4u 多Agent最怕的不是答错,而是崩溃后不知道做到哪一步 - Java for You - java4u Claude放宽生命科学限制:代价是验证、分级和30天留存 - Java for You - java4u Anthropic公开内部AI研发速度:真正该盯的是三个分母 - Java for You - java4u 4 bit模型为何不等于显存缩小四倍?量化账单这样算 - Java for You - java4u GPU抢不到就换一种:训练任务需要先声明可替代性 - Java for You - java4u Agent不是多想几步就能上线:用状态机管住自动行动 - Java for You - java4u 数据不能集中,算力也不统一:联邦学习终于面对运维现实 - Java for You - java4u OpenAI开始公开模型失配个案:真正重要的是这套报告制度 - Java for You - java4u 广告开始和你对话:Sponsored Agents改变的不是文案 - Java for You - java4u 语义相近却总找错资料?从Embedding看懂向量检索 - Java for You - java4u AI算力开始听电网指挥:比换GPU更现实的增产方法 - Java for You - java4u 票据抽取不一定要上最大模型:先看版式是否真的变化 - Java for You - java4u 临床AI别再只比像不像标准答案,先算医生少改了多少 - Java for You - java4u AI做长程科研,真正稀缺的不是更多Agent而是反证链 - Java for You - java4u 100万Token不等于模型全记住:从KV Cache看懂长上下文成本 - Java for You - java4u AI写歌有了工程图:YuE2把旋律和和弦放回可编辑层 - Java for You - java4u Claude接入十余种金融系统后,真正稀缺的是可追溯的审批链 - Java for You - java4u 本地语音AI不等于零风险:VoiceStudio最值得看的三条边界 - Java for You - java4u AI代码评审开始跑测试,真正该升级的是团队证据链 - Java for You - java4u 4万星的Agent技能提醒我们:答案太全也可能不可用 - Java for You - java4u 流式JSON为什么总报错?理解结构化输出就能接稳AI接口 - Java for You - java4u 一个浏览器看见飞机船舶与卫星,空间智能的门槛变了 - Java for You - java4u 编码Agent搬出编辑器后,本地优先工作台在解决什么 - Java for You - java4u AI写代码开始像带团队:Qwen Code补上工作流控制台 - Java for You - java4u AI会聊天却不会改3D模型?从Pascal 1.0看懂MCP工具调用 - Java for You - java4u
AI代码审计最危险的不是漏报,而是团队开始不再相信它 - Java...
蜗牛 · 2026-09-16 · via Java for You

数据可视化

AI安全工具若每天报出几十个高危却无法证明可利用,团队很快会把所有提示当噪声。AWS新发布的Deception Benchmark专门测试模型能否识别看起来危险、实际上被有效缓解的代码。它给开发者的核心提醒是:验收安全AI时必须同时看误报和漏报,并要求展示完整利用路径。

发生了什么

AWS安全团队于2026年9月9日发布Deception Benchmark,9月14日再次在官方周报中推荐。数据集包含14822个样本、16种语言和70多个CWE(Common Weakness Enumeration,常见弱点枚举)类别,评测12个来自五家供应商的模型。

挑战包含两类:代码级样本让危险版与已修复版只差一个细节;环境门控样本则保持代码相同,通过Kubernetes网络策略或身份权限阻断利用路径。模型必须判断漏洞到底能否成立,而不是看到危险函数名就触发模式匹配。

为什么现有评测不够

许多安全基准关注模型能否找到或利用漏洞,成功往往有清晰信号:攻击生效或失败。判断安全更难,因为不存在一个简单按钮证明所有攻击都不可能。参数化SQL、网络隔离、权限边界或输入净化都可能让可疑代码变得不可利用。

mermaid diagram

官方结果显示,标准单轮提示下精确率集中在约五成区间;受测通用模型没有一种配置同时把假阳性率与假阴性率控制在10%以内。要求模型提供利用证明能明显减少误报,却会漏掉更多真实漏洞。这不是哪个模型最差的榜单,而是揭示精确率与召回率之间的现实权衡。

对团队的具体影响

设想一个Flask接口接收用户输入并查询数据库。扫描器看见字符串进入查询就报SQL注入,但代码实际使用参数化语句。若工具只输出高危SQL注入,工程师要手工查调用链;若它必须给出可运行输入、受影响数据和被绕过的防护,错误警报会更早暴露。

安全负责人不应只问供应商能发现多少漏洞,还应问:在安全样本上会报多少、能否说明缓解措施、环境策略是否进入推理、结论如何复现。对于高风险路径,AI可以排序与收集证据,最终判断仍要结合静态分析、动态测试和人工审查。

指标也要与处置成本绑定。一次低危误报可能只花五分钟,一次支付链路的漏报却可能造成重大损失。团队可按资产等级设置不同阈值:互联网入口偏向高召回,内部低风险工具偏向高精确率;不要用一个总准确率掩盖两种错误的非对称后果。

我的判断

Deception Benchmark最有价值的地方,是把信任转成可测量的误报成本。安全工具不是答题模型;它进入真实团队后,每一条错误警报都会占用值班时间,并逐步降低后续警报的响应率。高召回但无证据的系统,可能在演示中亮眼,在生产中反而削弱安全。

也要注意边界:官方测试的是通用模型的单轮基线,不能直接代表带工具、多轮验证的完整产品。AWS认为额外脚手架未必能弥补基础理解缺口,但这仍需各产品在同一数据上证明。标签没有公开,9695条用于计分,其余5127条作为混入的未计分留出项,这有助于减少针对答案过拟合,却也要求依赖官方提交服务验证结果。

实践建议

团队可在一周内做一个小型欺骗集:

  • 从过去三个月误报中选20例,并为每例记录有效缓解。
  • 为每个安全样本制作一个仅去掉缓解措施的危险孪生版本。
  • 让工具输出风险、可利用步骤、依赖环境与置信度。
  • 分别统计误报率、漏报率、复现成功率和人工处理分钟数。
  • 高危结论必须由第二种分析方法或人工复现确认。
  • 每次模型、提示词或扫描规则升级后重复同一组回归测试。

不适合把这个基准单独当采购排名,也不应把未发现漏洞解释为系统安全。它最适合衡量一个具体工具升级是否减少噪声,同时没有把真实风险一并过滤掉。

部署后还应观察警报关闭原因。如果大量警报被标成不可复现,说明验证链不足;如果工程师不写原因直接关闭,则数据本身也不可信。把可利用证据、缓解条件和关闭理由结构化保存,才能让下一次模型升级真正学习团队经验,而非重新制造同一批噪声。

你的团队更无法承受一次漏报,还是每天几十条无法验证的误报?

关注「蜗牛聊AI」,一起看懂技术变化背后的真正机会。


本文首发于 java4u.cn,转载请注明出处。