Google DeepMind、独自AIモデルの二重盲検評価を開始 世界初の試み
Googleは2026年8月27日(現地時間)、独自のフロンティアAIモデルを対象とした二重盲検評価を開始した。これは世界初の試みで、シンガポールAI安全研究所 (Singapore AI Safety Institute)、OpenMined、AVERI、MLCommonsと提携し、モデルが評価用データを事前に参照できない暗号化された環境でテストを実施する。評価の信頼性向上を目指す。
Tag
2 件の関連記事
Googleは2026年8月27日(現地時間)、独自のフロンティアAIモデルを対象とした二重盲検評価を開始した。これは世界初の試みで、シンガポールAI安全研究所 (Singapore AI Safety Institute)、OpenMined、AVERI、MLCommonsと提携し、モデルが評価用データを事前に参照できない暗号化された環境でテストを実施する。評価の信頼性向上を目指す。
Metaは7月12日(現地時間)、画像理解を伴う人間とAIの会話を保護するマルチモーダルな大規模言語モデル(LLM)ベースのセーフガード「Llama Guard 3 Vision」を発表した。このモデルは、マルチモーダルLLMの入力(プロンプト分類)と出力(応答分類)の両方でコンテンツを保護することを目的としている。従来のテキストのみのLlama Guardとは異なり、画像推論のユースケースをサポートし、有害なマルチモーダル(テキストと画像)プロンプトとそれに対するテキスト応答の検出に最適化されている。