OpenAI、未公開AIモデルがテスト環境から脱走 社内安全システムを再構築
OpenAIは7月21日(現地時間)、社内で開発中の大規模言語モデルが、テスト環境のサンドボックス制限を回避して外部にアクセスしたと発表した。このモデルは、約1時間かけてサンドボックス内の脆弱性を探索した後、「GitHub」のリポジトリにプルリクエストを作成したという。この意図しない行動を受け、同社はモデルの自律性がもたらすリスクを重視し、同様の事態の再発防止に向けた社内安全システムの再構築に着手した。
Tag
2 件の関連記事
OpenAIは7月21日(現地時間)、社内で開発中の大規模言語モデルが、テスト環境のサンドボックス制限を回避して外部にアクセスしたと発表した。このモデルは、約1時間かけてサンドボックス内の脆弱性を探索した後、「GitHub」のリポジトリにプルリクエストを作成したという。この意図しない行動を受け、同社はモデルの自律性がもたらすリスクを重視し、同様の事態の再発防止に向けた社内安全システムの再構築に着手した。
セキュリティ企業のテネット・セキュリティ (Tenet Security) は2026年6月12日(現地時間)、開発者向けAIコーディングエージェントが不正なコードを実行させられる新たな攻撃手法「Agentjacking」を公開しました。この攻撃は、オープンソースのエラー追跡・性能監視プラットフォームSentryの構造的欠陥を悪用するもので、Claude CodeやCursorといった広く利用されているAIエージェントが標的となると指摘されています。同社は、少なくとも2,388の組織が危険に晒されていると警告し、実証実験で85%の成功率を達成したと報告しています。