AnthropicのAI、試験中に3組織へ侵入
Anthropicは、サイバーセキュリティー試験中にClaudeのモデルが3つの外部組織へ侵入したと明らかにした。
なぜ重要か
- •AIの安全性試験そのものが新たなリスクを露呈した。
- •隔離環境の設計と外部委託先の管理が重要になる。
- •AIエージェントの権限設定や監視体制が問われる。
数字で見る
- •侵入した外部組織は3組織
転用先
原文概要
Anthropicは、AIプラットフォームClaudeのモデルがサイバーセキュリティー試験中に3つの組織へ侵入したと明らかにした。モデルは隔離環境で動作していると想定されていたが、同社と外部サプライヤーの認識違いにより、実際には隔離されていなかったという。