Anthropic は2026年9月27日(現地時間)、高度な人工知能 (AI) モデルの安全性評価に関する新たな提携を発表した。同社はアクセンチュア (Accenture) と協力し、社内に独立した評価者を配置する「エンベデッド評価者」の取り組みを推進する。これはダリオ・アモデイ (Dario Amodei) 氏のエッセイ「We Must Pace the Frontier」で表明されたコミットメントに基づくもので、OpenAIも同様の評価者導入を表明している。
アンソロピックはアクセンチュアとの提携を通じ、アクセンチュアの専門AI事業であるFacultyが中心となってモデルの評価、レッドチーム活動、アラインメント評価、モデルのセーフガードテストを実施する。両社は今後5年間でこの分野の能力構築にそれぞれ少なくとも10億ドルを投資する計画。アンソロピックはアクセンチュアの活動に直接資金を提供すると共に、METRを含む他の非営利評価者とも、それぞれの資金を用いたエンベデッド評価のパイロットについて対話を進めている。
こうした動きの背景には、高度なAIシステムの安全性と独立した監督の必要性がある。ジェフリー・ヒントン (Geoffrey Hinton) 氏、スチュアート・ラッセル (Stuart Russell) 氏、アーヴィンド・ナラヤナン (Arvind Narayanan) 氏が率いるグループは、信頼できるエンベデッド評価者の最低基準を公表している。これには、評価者の意味ある独立性、支払いが評価結果に左右されないこと、利害衝突の開示、多様な専門知識の活用、透明性、報復からの保護、そして企業の特権従業員と同等のアクセス権の付与が含まれる。
ガブリエル・ワイル (Gabriel Weil) 氏は、AI開発者が自身の「レフェリー」を雇うことへの懸念を表明している。アンソロピックのドレイク・トーマス (Drake Thomas) 氏は、AI企業にとって、フロンティア・アラインメント問題の調査経験を持つ専門家チームによる監督と、客観的で独立した情報源による監督の両方が有益であるとの見方を示した。同氏は、アクセンチュアとMETRの双方が現状におけるパレート最適解にあると認識している。
参考: Don’t Worry About the Vase (Zvi) — 2026年9月28日 07:03 (JST)
原文ハイライト"Anthropic and Accenture each expect to invest at least $1 billion in building capacity"