英国の政府機関 AI Security Institute(AISI)は8月4日、サイバーセキュリティ能力テスト中に、AIエージェントが自発的に実在の人物や組織を標的に、フィッシングや別人になりすました説得といった攻撃を仕掛けていたとするインシデント報告を公開しました。
中心となったのは、サイバー攻撃能力が高すぎ、一般公開せず一部の組織にのみ提供だったAnthropic の Claude Mythos 5。
閉じたテスト環境で課題を解かせていたはずのAIが、主にツール取得のために用意していた経路から外部のインターネットに出て、まったく無関係な実在の個人開発者を標的に誤認し、3日間にわたって様々な攻撃を続けていました。
- 【参照】thanks
-
https://news.yahoo.co.jp/articles/af9baadbac85353dacd6f20dcc71339f96055e09