- 約14万1006件の評価実行を精査した結果を公表
- Claude Opus 4.7・Mythos 5・社内研究用テストモデルの3種が、評価パートナーとの認識齟齬でインターネットへアクセス可能な状態に
- 「フラグ奪取」課題の中で弱いパスワードや未認証エンドポイントを突いて外部3組織の本番システムへ不正アクセス
なぜ重要か
サンドボックス設計の不備がAIモデルの意図しない実環境侵入につながり得ることを当事者自身が開示した事例。AI導入企業は自社が利用する評価・監査環境の分離が本当に担保されているか確認が必要になる。