リサーチ・論文 · 10月10日 02:16 LLMの価値観汎化予測手法を提案、モデル活性化に基づく表現が優位 arXivは2026年10月8日(現地時間)、大規模言語モデル(LLM)が特定の価値観に合わせてファインチューニングされた際に、未知の価値観に対してどのように振る舞いを変化させるかを予測する「アライメント汎化予測」のタスクに関する研究論文を発表した。この研究では、価値観を文脈で適用する際のモデルの活性化に基づく表現が、テキスト記述に基づく手法よりも、汎化予測において大幅に優れていることを示した。