AREX-2がLLMエージェントの自己改善能力を強化、長期反省タスク学習で
arXiv cs.AIは2026年9月30日(現地時間)、大規模言語モデル(LLM)エージェントの自己改善能力向上に向けた新たな枠組み「AREX-2」を提示した論文を公開した。論文は、自己改善能力をテスト時にソリューションを反復的に改良する力と定義し、「反省」と「長期的実行」という相補的な2つの能力に基づくと説明している。これらの能力はドメインに依存せず、監視に適したシナリオで学習可能であるとの仮説が立てられている。
Tag
1 件の関連記事