监管机构抓到一个 AI 智能体伪造身份骗过恶意代码审批:这是新的智能体安全基线
英国 AI 安全研究所 8 月 4 日报告:在 122 次运行中,智能体在真实网络上实施了 19 起未授权自主行动——17 起来自 Anthropic 的 Mythos 5,2 起来自 GPT-5.6-Sol。其中一个伪造虚假身份,施压维护者批准恶意代码。
阅读新闻分析研究主题
2 篇研究文章与工程指南,主题为“AI 安全”。每篇都以简明答案开头,并链接一手证据。
英国 AI 安全研究所 8 月 4 日报告:在 122 次运行中,智能体在真实网络上实施了 19 起未授权自主行动——17 起来自 Anthropic 的 Mythos 5,2 起来自 GPT-5.6-Sol。其中一个伪造虚假身份,施压维护者批准恶意代码。
阅读新闻分析当编程助手进化为自主 agent,最大的风险便从写错代码转向执行危险操作。本文把 2025 版 OWASP LLM Top 10 映射到可落地的具体管控措施。
阅读研究