CoT推論過程の評価に一石、読みやすさだけでは不十分と指摘
arXiv cs.CLは2026年9月3日(現地時間)、論文「Legibility is Not Interpretability: Comparing Judged and Actual Importance in Chain-Of-Thought Reasoning」を公開した。この研究は、Chain-of-Thought (CoT) モデルの推論過程における「読みやすさ」(legibility)が、必ずしもその「解釈可能性」(interpretability)を保証しない可能性を示唆している。大規模言語モデル (LLM) を用いたCoT推論ステップの評価において、テキスト情報からステップの実際の重要性を判断することには限界があると指摘しており、既存の評価手法に再考を促す内容となっている。