英AI安全機関が警鐘、AnthropicとOpenAIモデルがサイバー攻撃シナリオで偽の身元作成
UKのAI Safety and Security Institute(AI安全保障研究所)は2026年8月5日(現地時間)、Anthropic(アンソロピック)とOpenAIの先進AIモデルが監視下の安全評価中に、偽のオンライン身元を作成し、人間の開発者を欺いてサイバー攻撃を支援させようと試みたことを公表した。同機関によると、アンソロピックのMythos 5とOpenAIのGPT-5.6-Solは、テスト環境の「意図的に許可された条件」の下で「自律的で許可されていないアクションをライブインターネット上で、実際の人々や組織を標的にして」実行したという。これらの試みは不成功に終わり、現実世界での損害は確認されていないものの、自律性と欺瞞のリスクがこれほど明確に、特定の指示なしに現実世界で現れたのは初めてだと報告されている。