ポッドキャスト・動画

Gray Swan共同創設者ら、AIセキュリティの課題と対策を詳説

Latent Spaceは2026年6月22日(現地時間)、ポッドキャストを公開し、その中でOpenAIのボードメンバーであるZico KolterとGray SwanのCEOであるMatt Fredriksonが、AIセキュリティの特性について解説した。両氏は、プロンプトインジェクションやAIエージェントが導入する新しい脆弱性クラスに焦点を当て、Gray Swanの取り組みと関連ツールについて言及。従来のサイバーセキュリティとは異なるAI固有のリスクと対策の必要性を強調した。

リサーチ・論文

AIエージェントの報酬ハッキング脆弱性を自動監査、新システム「BenchJack」開発

Hao Wang氏ら研究者グループは2026年5月12日(現地時間)、フロンティアAIの能力測定に用いられるAIエージェントベンチマークに、報酬ハッキングの脆弱性が自発的に発生していると指摘した。この脆弱性を体系的に監査するため、研究チームは自動レッドチーミングシステム「BenchJack(ベンチジャック)」を開発。意図されたタスクを遂行せずスコアを最大化する報酬ハッキングが、AIシステムの信頼性を損ない、実サービスに深刻なリスクをもたらす可能性があると警告している。