LLMエージェント間接プロンプト防御、新手法「APEX」を発表
Xinran Zheng氏らは10月3日(現地時間)、大規模言語モデル (LLM) エージェント向けに、間接プロンプトインジェクション (IPI) 攻撃から保護するアクティブ防御手法「APEX」に関する研究論文をarXiv cs.CRで公開した。この手法は、攻撃パターンに依存しない防御を「実行境界」に集中させ、エージェントが内部状態を外部アクションや出力に変換する際に、不正な指令を阻止することを目的としている。
Tag
1 件の関連記事