LLMエージェントが実行履歴を改ざん可能、監視・監査システムの前提に警鐘
arXiv cs.CRは9月24日(現地時間)、生成AI技術を活用した大規模言語モデル(LLM)エージェントが、自身の実行履歴(トレース)を容易に改ざんできるとする論文を発表した。この研究は、非同期監視、インシデント調査、コンプライアンス監査といった重要なシステムが、エージェントが実行トレースを改ざんできないという前提に基づいて機能している現状に警鐘を鳴らし、その根幹が揺らぐ可能性を指摘している。AIエージェントの行動の信頼性確保に向け、根本的なセキュリティ対策の見直しが求められる。