CredLeak-Bench、LLMエージェントの認証情報漏洩と回復を評価
arXiv cs.CRは2026年10月7日(現地時間)付けで、言語モデルエージェント(LLM Agents)の認証情報漏洩と回復能力を評価する新しいベンチマーク「CredLeak-Bench」に関する論文を発表した。同論文は、Rafid Ahmed氏らが執筆したもので、エージェントがフィッシング攻撃や本人確認に直面した際の自動化能力とセキュリティを総合的に評価することを目的としている。初期評価では、テストされたすべてのモデルが情報漏洩に対して脆弱であることが示された。