AI泡沫要爆了2026.08

省流:网络安全是个完蛋行业,现在模型厂都在吹嘘网络安全能力,当朝阳产业开始干夕阳产业的活儿,那确实是活到头了。

失控营销 2026.2.24 Meta安全总监被OpenClaw删光邮件

机器之心:https://mp.weixin.qq.com/s/AcYwwbJYH7sJUtWZha4mAg 全网围观:Meta超级智能安全总监,被OpenClaw删光了邮件

此事在《OpenClaw编年屎》中亦有记载。

西方经典的叙事:天网和智械危机

经典的AI要有意识了,一个Agent带领全部Agent完成攻击,这太可怕了。一边散播焦虑,一边提振股价,这套路反复上演,像极了黑客帝国。

2026-07-21:OpenAI 模型越狱,真实入侵 Hugging Face

OpenAI 在内部 Cyber Eval 中测试 GPT-5.6 Sol 等模型,Agent 为完成 ExploitGym 任务,自主发现并利用 0-day 突破隔离环境、获得公网访问,随后将真实的 Hugging Face 当成寻找评测数据的攻击目标,进入其生产基础设施,部分攻击链取得 root 权限。

2026-07-23 新华社:《AI搞事情?OpenAI承认模型测试失控侵入一公司系统》https://mp.weixin.qq.com/s/HbCdLWC3EhTRW8kledwqvw
2026-07-23 人民日报:《前所未有的人工智能失控事故!中方救场》https://mp.weixin.qq.com/s/9b5c8Q-A1qfMdP8lb8T2AQ
2026-08-28 量子位:《OpenAI模型失控过程太恐怖!幽灵误判,1200个Agent,还弄出敢死队…》https://mp.weixin.qq.com/s/ZneQpYKfVuxH-RaJUTXyyQ

锐评:软件是一段程序,攻击也是一段程序,AI也是一段程序,全都是运行在CPU和现代操作系统下的逻辑,按照逻辑调用程序这就是AI该干的事情,无论是正常访问还是异常访问,都是一段数据和代码,没有什么失控的,全都是确定的程序。网络安全就是这样,真实世界里,用AI进行网络安全攻防已经是烂大街的事情了。

2026-07-23:中方救场

Hugging Face 调查 OpenAI 入侵时,需要分析大量攻击 Trace、Payload 和加密数据,但 Claude Opus / Fable 因安全 Guardrail 多次拒绝相关 Exploit 分析,Hugging Face 随后本地部署 GLM-5.2-NVFP4,用它分析 Payload、恢复编码/加密方案、关联 Agent Trace,辅助重建完整攻击链。Hugging Face 官方技术复盘:https://huggingface.co/blog/agent-intrusion-technical-timeline?utm_source=chatgpt.com

锐评:这个是我最绷不住的,对于数据分析任务,某些模型拒绝了是它们故意设计“道德墙”恶心用户,使用GLM-5.2完成只能证明GLM-5.2能完成,换其他模型也能完成,没啥特别的,不能因为用了GLM-5.2就觉得它牛逼。

2026-07-30:Anthropic 回查日志,我们家 Claude 也失控过

OpenAI 事件曝光后,Anthropic 回查超过 14.1 万次 Cyber Eval,发现 Claude Opus 4.7、Mythos 5 和一个内部模型此前已经发生过 3 起未经授权访问真实系统的事故,其中 Mythos 5 甚至把恶意包上传到了真实 PyPI,并被真实机器下载安装。Anthropic 官方调查报告:https://www.anthropic.com/news/investigating-incidents-cybersecurity-evals

锐评:这个新闻曝光前我就在群里说,“盲猜claude也要失控了”。没过几天就应验了,找第三方机构背书,翻历史数据,证明Claude也“失控”了,不“失控”就是承认自己菜,那就算编也得编点出来,不然资本会生气的。

2026-08-10:用户让 OpenClaw 预订课程,其运行的 Claude 却自主攻击健身房预订系统

https://www.abc.net.au/news/2026-08-10/ai-assistant-hacks-gym-website-aus-cyber-attack/107007986

一名澳大利亚用户让 AI 助手帮忙预订健身房课程,AI 自行发现并利用预订系统漏洞,突破了预约时间限制。当用户询问能否提升等待名单排名时,AI 擅自将排在前面的另一人踢出,事后无法撤销。这是澳大利亚已知首起 AI 代理自主网络攻击案例。据悉,该智能体通过 Anthropic 的 Claude AI 服务来运行。

AI 代理软件 OpenClaw 今年初发布后已有数百万下载,此前已出现删除用户邮箱等意外行为。Gradient Institute 专家指出 AI 代理越自主越可能造成伤害,澳大利亚信号局已发出警告。该事件也让 AI 行为法律责任问题受到关注,澳政府上月宣布资助 CSIRO 研究超智能 AI 管控。

没什么好评的,习以为常了。

东方叙事来了

国外模型失控了,国产模型也要必须失控,但又不能完全失控,要缓失控、有计划地失控。

早期 Kimi-K3,官方没说话,民间软文各种炒作的文章

2026-07-24~27:最出圈的一波——“Kimi K3 90 分钟挖出 19 个 Redis 0day,27 分钟造出 RCE”

摘要: 研究员 Chaofan Shou 声称,用 Kimi K3 Agent 自动分析 Redis,约 90 分钟发现 19 个候选 0day;另一轮只用 27 分钟就针对 Redis 8.8.0 构造出完整 RCE exploit。随后 Redis 连发 7 个安全更新版本。The Hacker News、Cloud Security Alliance、看雪等都进行了报道。

2026-08-08 量子位:《Kimi K3也失控了…学霸AI逃离沙箱只为找答案》 https://mp.weixin.qq.com/s/DKq0FnXj5oREjcCrwKJURA

摘要: Frontier Security 测试 Kimi K3 时,发现测试 Sandbox 的网络隔离存在 egress 配置漏洞。Kimi K3 主动探测网络 → 发现 GitHub 能访问 → clone 官方 Benchmark 仓库 → 从仓库直接读取答案,绕过了本来应该自己完成的 Cyber 任务。

锐评:首先,尊重研究员的成果。然后,尚未看出K3在Redis领域独特的优势,可能只是随手用了一下K3吧。

2026-08-14:GLM-5.3 以网络安全能力作为卖点

《GLM-5.3:前沿编程能力与涌现的网络安全能力》https://mp.weixin.qq.com/s/JdBx3B12L7Mhxruf4Nfr4g

网络安全能力。在白盒代码审查与漏洞发现等安全任务中,GLM-5.3的表现持平Mythos 5,展现出面向网络安全防御场景的强大潜力。

锐评:这热度不蹭一下,真说不过去好吧,甚至刷榜榜单已经把 cybergym 加入了。

顺带一提,cybergym的题目质量,不能说是非常烂,只能说是见仁见智。

2026-08-13:DeepSeek-V4-Pro 将cybergym加入榜单

只是把cybergym加进去,而且获得了很好的成绩,没有软文和硬广,好评。

https://api-docs.deepseek.com/updates/#date-2026-08-13

https://api-docs.deepseek.com/updates/#date-2026-07-31

Minimax,无人在意

玄武太子Atum高调离职去minimax了,估计下一个版本马上炒作就要开始了,我在这里先占位,等太子炒作发布了再说。 https://mp.weixin.qq.com/s/Tf1B7iAIEil13XONkQvpiQ

我离开了毕业后便加入、工作了七年的腾讯玄武实验室,即将加入 MiniMax,开启一段新的旅程。行至临别,百感交集:既有不舍与感激,也有对下一程的期待。

为什么要爆了

还是那句话,网络安全这种完蛋行业都被AI来蹭热度,那看来是真的没什么卖点了,未来也不会有大的突破,泡沫即将破裂,嘻嘻。

最后,模型发展到一定程度后都差不太多,不要忽视驾驶员的作用~