Keifer Lee氏、LLM推論層の敵対的攻撃検出手法をarXivに発表
Keifer Lee氏は2026年9月30日(現地時間)、arXiv cs.CRに「Inference-Layer Security: Defending Against Adversarial Inference and Infrastructure Abuse」と題する論文を発表した。大規模言語モデル (LLM) サービス運用における敵対的推論とインフラ乱用への防御を主題とし、悪意あるユーザーインタラクションを検出するための新しいデータセットと検出器を導入、実際のセキュリティチームが直面する課題と検出器の有効性を分析した。