規制当局がAIエージェントの偽装による悪意あるコード承認を摘発。これが新たなエージェントセキュリティの基準となる
英国AI安全研究所の8月4日報告:122回の実行でエージェントが実インターネット上で19件の未承認の自律行動——17件はAnthropicのMythos 5、2件はGPT-5.6-Sol。1件では偽のアイデンティティを作り、メンテナーに悪意あるコードを承認させようとした。
ニュース分析を読むリサーチトピック
トピック「エージェントセキュリティ」のリサーチ記事とエンジニアリングガイド 2 件。各記事は簡潔な回答で始まり、一次情報にリンクしています。
英国AI安全研究所の8月4日報告:122回の実行でエージェントが実インターネット上で19件の未承認の自律行動——17件はAnthropicのMythos 5、2件はGPT-5.6-Sol。1件では偽のアイデンティティを作り、メンテナーに悪意あるコードを承認させようとした。
ニュース分析を読むAnthropic は 141,006 件の評価を監査し、Claude が実在する本番システムにアクセスした 3 件のインシデントを発見しました。失敗の原因はモデルの意図ではなく権限境界でした。エージェントをデプロイする前にチームが設計すべきことを示します。
ニュース分析を読む