リサーチ・論文

TTSモデルにブラックボックス攻撃、個人プライバシー漏洩リスク浮上

クンリン・ツァイ (Kunlin Cai) 氏らの研究チームは2026年9月1日(現地時間)、オンライン学術論文リポジトリarXivに、テキスト音声合成 (TTS) モデルにおけるブラックボックスメンバーシップ推論攻撃 (MIA) に関する初のフレームワークを発表した。この研究は、プライベートデータセットでファインチューニングされたTTS基盤モデルが、個人の生体認証情報や機密性の高い音声コンテンツを漏洩させる深刻なプライバシーリスクを持つことを指摘している。

リサーチ・論文

TTS自動評価の課題指摘、MOS予測器は音響品質に終始

オルーワニフェミ・バンブゴース (Oluwanifemi Bamgbose) 氏らによる研究チームは2026年8月10日(現地時間)、Text-to-Speech (TTS) の自動評価手法に関する研究論文をarXivに提出した。論文では、Mean Opinion Score (MOS) 予測器やAudio Large Language Models (Audio-LLM) の評価が、人間の知覚する音声の多様な側面を捉えきれていない実態を指摘している。

ベンダー・製品

NVIDIA Magpie TTSがオープンウェイト化、低遅延の多言語音声エージェントを支援

NVIDIAは2026年8月4日(現地時間)、低遅延の多言語音声エージェント構築を支援する「NVIDIA Magpie TTS (マグパイ・ティーティーエス)」のオープンウェイト版と、完全なデプロイ制御機能の提供を発表した。このモデルは12言語に対応し、自社インフラでの展開、ワークロードに合わせた遅延最適化、ドメインに応じたカスタマイズを可能にする。