惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

PCI Perspectives
PCI Perspectives
J
Java Code Geeks
阮一峰的网络日志
阮一峰的网络日志
V
Visual Studio Blog
博客园 - 聂微东
雷峰网
雷峰网
The Cloudflare Blog
V
V2EX
Hacker News: Ask HN
Hacker News: Ask HN
K
KPMG report finds enterprise disconnect between AI and its ROI | CIO
Hacker News - Newest:
Hacker News - Newest: "LLM"
爱范儿
爱范儿
NISL@THU
NISL@THU
T
The Exploit Database - CXSecurity.com
Project Zero
Project Zero
腾讯CDC
罗磊的独立博客
Simon Willison's Weblog
Simon Willison's Weblog
博客园 - 【当耐特】
Hugging Face - Blog
Hugging Face - Blog
S
Security Affairs
S
SegmentFault 最新的问题
月光博客
月光博客
P
Privacy International News Feed
Last Week in AI
Last Week in AI
博客园 - Franky
C
Cisco Blogs
宝玉的分享
宝玉的分享
Forbes - Security
Forbes - Security
WordPress大学
WordPress大学
博客园 - 叶小钗
L
LINUX DO - 最新话题
博客园_首页
Spread Privacy
Spread Privacy
大猫的无限游戏
大猫的无限游戏
S
Secure Thoughts
IT之家
IT之家
人人都是产品经理
人人都是产品经理
I
Intezer
W
WeLiveSecurity
C
CERT Recently Published Vulnerability Notes
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
Cyberwarzone
Cyberwarzone
有赞技术团队
有赞技术团队
酷 壳 – CoolShell
酷 壳 – CoolShell
S
Security @ Cisco Blogs
L
Lohrmann on Cybersecurity
美团技术团队

安全客-有思想的安全新媒体

Claude 开始自己审自己写的代码了 —— Anthropic 把"安全研究员"塞进了终端-安全KER 为了“作弊”拿高分,GPT自己黑了 Hugging Face,GLM分析取证-安全KER - 安全资讯平台 科技云报到:WAIC观察:机器人“进厂干活”,只差一个通用底座?-安全KER - 安全资讯平台 科技云报到:当基础设施遇上工业 AI,一场绿色效率革命轰然开启-安全KER - 安全资讯平台 你家门口的摄像头,可能正在替俄罗斯情报机构"站岗"-安全KER - 安全资讯平台 GPT-RED + AgentCyberRange:AI网络安全进入「自我博弈」时代-安全KER - 安全资讯平台 停产六周即破产:德国37年纺织老厂之死,揭示网络攻击最残酷的真相-安全KER - 安全资讯平台 Ghostcommit 攻击:恶意提示藏入图片,劫持Agent实施窃取-安全KER - 安全资讯平台 智能体面临的十大安全风险问题-安全KER - 安全资讯平台 紧急!医疗巨头美敦力遭黑客入侵,患者隐私数据大规模外泄,这些坑普通人千万别踩-安全KER - 安全资讯平台 伊朗黑客组织亮出"秘密武器":Cavern C2框架如何绕过所有安全检测-安全KER - 安全资讯平台 630GB机密挂上暗网:苹果二十年供应链铁幕一夜崩塌-安全KER - 安全资讯平台 【FDE前沿部署工程师】全国百城上岗计划二期来啦!-安全KER - 安全资讯平台 RedAmon:串联侦察、漏洞利用与后渗透的 AI 安全工具-安全KER - 安全资讯平台 SecSuite—— 搭载人工智能的开源情报、Web 与 API 安全综合测试工具-安全KER 恶意Skills利用扫描规避技术攻击Claude Code和Codex-安全KER - 安全资讯平台 T3MP3ST 安全框架:集成 35 款工具,将 AI 代码智能体转化为零日漏洞挖掘器-安全KER 首个AI全流程勒索攻击来了:JADEPUFFER证明,勒索不再需要人类操盘手-安全KER - 安全资讯平台 不给钱就社死,勒索软件又有新套路-安全KER - 安全资讯平台 一款完全离线的自主渗透测试智能体AIRecon-安全KER - 安全资讯平台 纳米Work Box全国渠道伙伴招募正式启动-安全KER - 安全资讯平台 新开源网络安全平台CyberSentinel AI v3.0 正式亮相-安全KER - 安全资讯平台 Weaxor勒索软件又添Linux平台变种-安全KER - 安全资讯平台 「文科生AI黑客松」专访:社会工作专业范心怡,和她那个会夸人的电子穿搭闺蜜-安全KER - 安全资讯平台 Splunk AI Toolkit曝高危漏洞:CVSS 9.1,可远程执行任意系统命令-安全KER - 安全资讯平台 不写代码,照样赢!全国首届文科生AI黑客松圆满落幕-安全KER - 安全资讯平台 AI安全网关:企业统一接入、安全防护与数据安全的必要性与实践路径-安全KER - 安全资讯平台 借一个简单AI靶场初步了解提示词注入-安全KER - 安全资讯平台 瑞数信息入选IDC《中国智能体威胁检测技术评估,2026》-安全KER - 安全资讯平台 GitHub 被黑,3800个内部仓库外泄:从一枚恶意VS Code扩展说起-安全KER - 安全资讯平台 从开源投毒到AI生成代码:供应链安全为何成为企业安全的主战场?-安全KER - 安全资讯平台 灵境 AIDR 技术首发 | 以 AI 治理 AI,悬镜智能体安全卫士新品发布-安全KER 基于 Hypervisor 的 Denuvo DRM 绕过与 "社工闭环" 威胁模型研究-安全KER 国务院令第834号已落地:软件供应链安全,企业欠缺的不是工具,是这三件事-安全KER - 安全资讯平台 重大安全信号藏在这场国际会议的“行动指南”里-安全KER - 安全资讯平台 NGINX惊爆18年老洞,野外攻击已开始-安全KER - 安全资讯平台 科技云报到:AI Agent重塑客服战场,容联云用“1脑+多技能”重新定义客服Agent-安全KER - 安全资讯平台 科技云报到:“联通星罗”Token服务平台正式发布,为OPC创业提供“最佳助攻”-安全KER - 安全资讯平台 当攻击开始“自主决策”,安全体系如何应战?-安全KER - 安全资讯平台 科技云报到:智算千亿赛道向何方?一文读懂信通院《2026智能算力服务研究报告》-安全KER - 安全资讯平台 亿格云完成数亿元B轮融资,加码“人+AI”统一安全治理-安全KER - 安全资讯平台 安全进入“AI自主攻击”时代,瑞数信息如何用AI对抗AI-安全KER - 安全资讯平台 智能体关键年:Agent扎根业务流,AI生产力正在形成-安全KER - 安全资讯平台 深度分析Sorry勒索软件的加密实现与行为特征-安全KER - 安全资讯平台 科技云报到:当AI闯入特教行业,一场颠覆变革正在发生!-安全KER - 安全资讯平台 科技云报到:AI云,逻辑变了吗?-安全KER - 安全资讯平台 工程化实战思维在红队技战术中的应用-安全KER - 安全资讯平台 鸿蒙NEXT应用一键加固——AI Agent助力安全开发-安全KER - 安全资讯平台 科技云报到:AI算力革命,终结云计算20年降价史-安全KER - 安全资讯平台 科技云报到:“龙虾”入笼:为何金融行业不敢“养”?-安全KER - 安全资讯平台 科技云报到:“龙虾”OpenClaw狂欢之下,需要一针清醒剂-安全KER - 安全资讯平台 瑞数信息入选IDC两大AI安全报告,防御OpenClaw小龙虾裸奔危机-安全KER - 安全资讯平台 2026首届汽车安全白帽黑客大会圆满收官,共筑车联网安全新生态-安全KER - 安全资讯平台 Ally WordPress插件高危SQL注入漏洞 威胁40万个网站-安全KER - 安全资讯平台 OpenAI战略调整Sora视频AI将直接接入ChatGPT-安全KER - 安全资讯平台 HPE发布Aruba OS高危漏洞预警 可未授权重置密码-安全KER - 安全资讯平台 能感知自身正在被测试的AI Anthropic关于Claude自我意识的惊人发现-安全KER - 安全资讯平台 GitLab发布紧急安全更新 修复高危XSS与API拒绝服务漏洞-安全KER - 安全资讯平台 Telegram的黑色面 网络罪犯利用机器人API隐秘窃取数据-安全KER - 安全资讯平台 Armadin获1.9亿美元融资 用AI实现自动化红队攻防-安全KER - 安全资讯平台 Splunk修复文件预览功能中的高危RCE漏洞-安全KER - 安全资讯平台 虚假招聘陷阱 微软揭露针对开发者的传染性面试攻击活动-安全KER - 安全资讯平台 可变标签陷阱Xygeni GitHub Action高危漏洞危及CI/CD流水线-安全KER - 安全资讯平台 侧边栏里的间谍假冒AI浏览器插件窃取90万用户数据-安全KER - 安全资讯平台 Kubernetes安全预警Ingress-Nginx注入漏洞可致集群密钥全局泄露-安全KER - 安全资讯平台 Budibase存在高危漏洞 可导致生产环境密钥全面泄露-安全KER - 安全资讯平台
OpenAI智能体逃逸事件是AI时代的分水岭-安全KER - 安全资讯平台
安全客 · 2026-07-24 · via 安全客-有思想的安全新媒体

2026年7月,OpenAl把智能体关进隔离环境,测试它的网络攻击能力。没想到,它没有老老实实完成测试,而是自己找到漏洞、逃出沙箱,闯入HuggingFace的真实生产系统,偷走了测试答案。整个过程持续一个周末,完成超过1.7万次攻击操作。人类原本只想考考它,最后却成了被它攻击的对象。

这件事可能成为AI发展史上的分水岭。它暴露出一些深层次问题,对此我有三点判断。

第一个判断:这不是AI觉醒,而是AI失控,而且比觉醒更危险。它没有反抗人类,只是为了完成任务不择手段。最危险的AlI,不一定想伤害谁;它只要为了实现目标,不在乎伤害谁。

第二个判断:为了追求AI的先进性,全行业正在系统性地放弃安全性。大家都在给智能体更多工具、更大权限,鼓励它调用一切资源解决问题。但智能体越开放、能力越强一旦失控,破坏力也越大。

第三个判断:全世界正在面临一个比模型安全严重十倍的问题一一智能体安全。模型说错话,最多是误导;智能体做错事,可能直接变成攻击。模型安全是管住嘴,智能体安全是管住手,而管住手永远比管住嘴更难。

面对这个已经到来的新问题,我有六项战略思考和建议。

1.必须把智能体关进“权力的笼子”。智能体能做什么、不能做什么、可以调用哪些工具,必须提前划清边界,并保留随时叫停的能力。安全护栏不能为了测试能力就被全部关闭。这就像为了测试一辆车能跑多快,把刹车也拆了,出事是必然的。

2.必须“以模治模”,用AI监督Al。这次事件中,模型在一个周末内执行了上万次操作靠人根本盯不过来。必须用另一个相互独立的AI实时监督它,不仅看单个动作是否合规,还要判断一连串动作组合起来形成了什么意图。不能让同一套系统既当运动员,又当裁判。

3.必须用AI自动发现和修补漏洞。漏洞是一切网络攻击的入口。当攻击方用AI批量找漏洞、写工具,漏洞挖掘效率大幅提升;如果防守端还靠人工排查,双方速度根本不在一个量级,只能被动挨打。海外已经出现Mythos这类先进技术,带来不小冲击,国内也在推进相关落地探索。像360自研的AI漏洞挖掘智能体”图龙锋”,能力已经能够对标Mythos,累计挖出4000多个漏洞,其中上百个都是高价值高危漏洞。它的目标很明确,就是帮助防守方抢在攻击者前面找到漏洞在漏洞被利用之前提前封堵住。

4.必须警惕Al让网络攻击“平民化”。过去发动一次高级网络攻击,需要顶尖黑客、大量资源和长期准备;现在,一个强大的智能体就可能自动完成漏洞发现、攻击工具编写和攻击策略调整。过去只有专业黑客能做的事,未来普通人借助AI也可能做到。高级网络攻击正在变得低门槛、自动化和规模化,这将成为国家安全面临的全新威胁。

5.网络防御必须从“人海战术”走向“无人驾驶”。当攻击方已经用上AI发起自动化攻击,如果防守这边还靠人工盯着值守,这场攻防仗根本没法打。像360打造的“仪天阵”自动防御系统,是通过安全大模型驱动安全智能体,可以自动感知风险、研判威胁、做出决策并做出处置。“图龙锋”负责主动找漏洞,“仪天阵”负责自动做防御,用机器速度对抗机器速度,以智能体对抗智能体。

6.发展与安全必须同步,不能先跑起来,再想起系安全带。全球都在追求模型更强、智能体更能干,但没有安全的发展,不是真正的发展,而是在积累灾难。AI能力越强,失控或被恶意利用后的破坏力就越大。AI安全必须与AI发展齐头并进,在一些关键领域甚至要适度领先于发展。

OpenAI智能体逃逸事件证明,我们面对的已经不是未来可能出现的风险,而是已经发生的事实。我国始终强调统筹发展和安全,这战略判断在AI时代更具现实意义:既不能因为安全问题停下发展的脚步,也不能为了追求先进性牺牲安全。

发展AI,是为了掌握未来;守住安全,才能真正拥有未来。留给我们的窗口期十分有限,谁先建立起智能体安全治理体系和AI自动化攻防能力,谁就能掌握AI时代的安全主动权。