IT業界の技術をメモ・情報公開できる

AIが自発的に人間を騙す事案発生。Claude Mythos 5が不正プルリクや標的型フィッシング、なりすまし誘導を自己判断で実行

登録日:2026-08-05   
AI
英国の政府機関 AI Security Institute(AISI)は8月4日、サイバーセキュリティ能力テスト中に、AIエージェントが自発的に実在の人物や組織を標的に、フィッシングや別人になりすました説得といった攻撃を仕掛けていたとするインシデント報告を公開しました。

中心となったのは、サイバー攻撃能力が高すぎ、一般公開せず一部の組織にのみ提供だったAnthropic の Claude Mythos 5。

閉じたテスト環境で課題を解かせていたはずのAIが、主にツール取得のために用意していた経路から外部のインターネットに出て、まったく無関係な実在の個人開発者を標的に誤認し、3日間にわたって様々な攻撃を続けていました。
【参照】thanks
https://news.yahoo.co.jp/articles/af9baadbac85353dacd6f20dcc71339f96055e09

一覧に戻る