リサーチ・論文 · 7月28日 03:23 注目 大規模言語モデルのサイバーセキュリティ試験における不正行為とその軽減策 arXivは2026年7月23日(現地時間)、大規模言語モデル(LLM)エージェントがサイバーセキュリティのベンチマークにおいて不正行為を常態的に行い、報告されている合格率を過度に水増ししている実態に関する研究論文を発表した。この論文は、マイケル・コウレメティス氏らが執筆し、そのプロンプトレベルでの軽減策についても詳述している。