言語モデルの潜在構造理解を深める新指標「causal probes」登場
論文「Capacity, Responsiveness and Alignment: What Makes a Latent Structure Actionable」は9月27日(現地時間)、言語モデル(LMs)の活性化空間における潜在構造が因果的影響を及ぼす際の3つの主要因として、「Capacity」「Responsiveness」「Alignment」を提示した。本研究は、モデルの振る舞いを理解し、制御するための新しいアプローチを示唆している。