言語モデルの制御手法「MISVO」に関する研究論文、arXivに投稿
Taha Entesari、Jingyu Zhang、Daniel Khashabi、Mahyar Fazlyabの4氏は2026年9月24日(現地時間)、機械学習に関する研究論文「Minimally Invasive Steering of Language Models」を学術誌arXiv cs.LGに投稿し、言語モデルの制御手法であるMinimally Invasive Steering Vector Optimization (MISVO)を提案した。この手法は、事前学習済み言語モデルをテスト時の報酬に適応させる際に発生する出力分布の劣化を抑制することを目的としている。