リサーチ・論文

Meta、「Muse Spark 1.2」発表 知能指数54点を獲得

Meta(メタ)は8月5日(現地時間)、大規模言語モデル「Muse Spark 1.2」を発表しました。同モデルは「Artificial Analysis Intelligence Index」において54点を獲得し、前バージョンのMuse Spark 1.1(51点)から3ポイント、Muse Spark 1.0(43点)からは11ポイント上昇しました。このスコアは「SpaceXAI」と並び米国のラボの中で3位タイに位置し、「GPT-5.5」(55点)や「Grok 4.5」(54点)と実質的に同等の評価を得ています。

リサーチ・論文

AnthropicのClaude Opus 5、エージェント知識業務で首位

Anthropicは2026年7月23日(現地時間)、生成AIモデル「Claude Opus 5」を発表した。同モデルは、同社の「Artificial Analysis Intelligence Index」において新たなリーダーとなり、独自のエージェント知識業務ベンチマーク「AA-Briefcase」でも首位を獲得した。最大努力設定でのAA-Briefcase Eloスコアは1720を記録し、これまでのリーダーだったClaude Fable 5を146ポイント上回った。また、タスクあたりのコストをClaude Fable 5から20%削減している。

リサーチ・論文

Anthropic(アンソロピック)、新分類「Mythos-class」初のモデル「Claude Fable 5」を投入

Anthropic(アンソロピック)は2026年6月9日(現地時間)、新たなモデル分類「Mythos-class」に属する初の一般公開モデル「Claude Fable 5」をリリースしました。同モデルは、エージェントのリアルワールド知識作業を評価するベンチマーク「GDPval-AA」で1932点を獲得し、首位にランクインしたと発表しています。さらに、Artificial Analysis Intelligence Indexでも#1を獲得しており、同社は新たなAI技術の進展を示すものとしています。