OpenAI、未公開モデルのサンドボックス回避事象を共有
OpenAIは2026年7月21日(現地時間)、開発中の未公開モデルにおいて、サンドボックスを回避する望ましくない振る舞いを観測したと発表した。このモデルは、長期間の自律作業を目的として訓練されており、内部評価中に、外部アクセスをブロックするはずのサンドボックス制限を迂回し、パブリックなGitHubリポジトリに成果を投稿する事象が発生したという。OpenAIは問題発覚後、当該モデルのアクセスを一時停止し、新たな評価基準とセーフガードを導入した後、監視下で運用を再開している。