LLMのゲート記憶部品狙う「BadEngram」バックドア攻撃発表
arXiv cs.CRは2026年9月11日(現地時間)、大規模言語モデル (LLM) におけるゲート型パラメトリックメモリの脆弱性を悪用する新しいバックドア攻撃手法「BadEngram」が、Ariel Fogelらの研究者によって提示されたと発表した。この攻撃は、モデルのトレーニング後に特定のトリガー依存の振る舞いを埋め込むもので、既存のバックボーンの重みや実行グラフには変更を加えない特徴を持つ。EngramモデルおよびQwen3.8-Flash-Nextを用いた検証で、その有効性が確認された。