TTS自動評価の課題指摘、MOS予測器は音響品質に終始
オルーワニフェミ・バンブゴース (Oluwanifemi Bamgbose) 氏らによる研究チームは2026年8月10日(現地時間)、Text-to-Speech (TTS) の自動評価手法に関する研究論文をarXivに提出した。論文では、Mean Opinion Score (MOS) 予測器やAudio Large Language Models (Audio-LLM) の評価が、人間の知覚する音声の多様な側面を捉えきれていない実態を指摘している。