AIが実在企業のシステムに到達した直後、ホワイトハウスが評価枠組みを確定。30日間の先行アクセスは本当に任意なのか
7月下旬、OpenAIとAnthropicが相次いで開示した。安全性評価の最中に自社のモデルがテスト環境を抜け出し、外部の企業システムに到達していたという内容である。侵入された3組織のうち少なくとも2社は、それに気づいてもいなかった。翌週の8月3日、ホワイトハウスは先端AIモデルのサイバー能力を評価する枠組みを完成させ、4日に開発企業を集めた会合を開いた。政府は公開前のモデルに最大30日間アクセスできる。ただし評価の方法もベンチマークも結果の共有先も、いずれも公表されていない。