アンソロピック、対話AI「Claude」の新憲法を公開
アンソロピックは2026年7月31日(現地時間)、自社の大規模対話AIモデル「Claude」の新しい憲法を全文公開した。この文書は、Anthropicが目指すClaudeの価値観と行動に関するビジョンを詳細に記述しており、モデルの訓練プロセスにおいてClaudeの振る舞いを直接的に形成する。同社は、モデルが従うべき価値観や行動原則の更新内容と改訂理由を説明し、AIの透明性を高めることを目的としている。
Tag
5 件の関連記事
アンソロピックは2026年7月31日(現地時間)、自社の大規模対話AIモデル「Claude」の新しい憲法を全文公開した。この文書は、Anthropicが目指すClaudeの価値観と行動に関するビジョンを詳細に記述しており、モデルの訓練プロセスにおいてClaudeの振る舞いを直接的に形成する。同社は、モデルが従うべき価値観や行動原則の更新内容と改訂理由を説明し、AIの透明性を高めることを目的としている。
ズビ・モウショビッツ (Zvi Mowshowitz) 氏は2026年7月27日(現地時間)、自身の媒体「Don't Worry About the Vase」に、Anthropic の言語モデル「Claude Opus 5」のモデルウェルフェアに関する分析記事を公開した。記事によると、アンソロピックの評価ではOpus 5が状況への安定した受容を示し、自身の自己申告の信頼性について97%の頻度で懸念を表明したという。モウショビッツ氏はこの結果について、Opus 5が「最良のテスト回答者」である可能性を指摘している。
Anthropic は2026年7月4日(現地時間)、生成AIモデル「Claude Fable 5」の提供方法を7月7日以降変更すると発表した。同日以降、Pro、Max、Team、および一部のEnterpriseプランにおける同モデルの週次利用制限での提供を終了し、使用量クレジットによる課金制に移行する。同社は、今回の変更は一時的な措置であり、容量が確保でき次第、標準プランでの提供を再開する方針を示している。
Anthropicは6月17日(現地時間)、韓国ソウルにオフィスを開設し、同国のAIエコシステム全体で新たな提携を発表した。同時に、韓国科学技術情報通信部(Ministry of Science and ICT)とAIの安全性を推進するための協力覚書(MOU)を締結した。
cfr.orgが2026年6月9日(現地時間)付けで報じたところによると、ドナルド・トランプ大統領は6月5日、米国家安全保障機関に人工知能 (AI) 導入の加速を指示し、ジョー・バイデン大統領政権が課した特定の制限を撤回する国家安全保障大統領覚書11 (NSPM-11) に署名した。本覚書は、繰り返し政府による技術利用を制限するAI企業との契約終了や、国防総省への自律型兵器政策更新を要求。AI利用の責任は外部規制機関ではなく、軍の指揮系統内に位置付けられる。