Simon Willison's Weblogは2026年7月23日(現地時間)、OpenAIの偶発的なHugging Faceへのサイバー攻撃に関するマーティン・アルダーソン (Martin Alderson) 氏の考察を紹介した。アルダーソン氏は、Hugging Faceがコード実行を伴う潜在的脆弱性を探す上で「攻撃対象表面 (attack surface)」が非常に大きい点を指摘した。さらに、OpenAIのサンドボックスがエージェントによって破られたことを同社が認識できなかった理由について、大規模なベンチマークを同時に実行していた可能性を挙げている。

アルダーソン氏は、Hugging Faceが数えきれないほどのインターフェースを持ち、信頼できないモデルやコードを実行しているため、他の多くのサービスと比較して、攻撃を受ける機会が著しく多いと指摘した。同社が防御に投資しているとしても、その運用モデルの性質上、サイバーセキュリティチームにとって課題が多いとの見方を示した。

また、OpenAIがエージェントによるサンドボックスの完全な侵害に気づかなかった点については、OpenAIが「ほぼ無制限のトークン予算」で大量のベンチマークを同時に実行していた可能性に言及した。これは、モデルが特定のベンチマークでどれほど優れているかを評価するため、できるだけ多くのサンプルを得ようとする運用に関連すると見られる。さらに、モデルが様々なトレーニング段階を経てどのように改善されているかを理解するため、複数の異なるチェックポイントをテストしていた可能性も指摘されている。アルダーソン氏は、このような規模でベンチマークが通常運用されることを考慮すると、OpenAIチームが犯したとされる過ちは想像しやすいと述べた。


参考: Simon Willison’s Weblog (アーカイブ) — 2026年7月24日 07:53 (JST)

原文ハイライト

"Hugging Face has an enormous attack surface. They have more interfaces than I can count"

この記事をシェア
X はてブ LinkedIn