Anthropicは2026年7月25日(現地時間)、最新の言語モデル「Claude Opus 5」を発表しました。同社によると、このモデルは既存の「Fable 5」に匹敵する性能を公式ベンチマークで示しています。価格は従来の「Opus」レベルを維持し、Fable 5と比較して約半分の水準で提供されます。
Anthropicの最新モデル「Claude Opus 5」は、Artificial Analysis Intelligence Indexにおいて新たなリーダーとして登場しました。特に「AA-Briefcase」ベンチマークでは、「Claude Fable 5」を約150 Eloポイント上回り、タスクあたりのコストを20%削減したと報告されています。一方で、Epoch Capabilities Index (ECI) ではClaude Opus 5が159、Fable 5が161とわずかにFable 5を下回る結果となりました。しかし、ソフトウェアエンジニアリングに関するSWE-ECIでは、両モデルともに161と同等のスコアを記録し、高い能力を示しています。
一部のユーザーからは、ECIスコアがClaude Opus 5の実際の性能向上を過小評価しているとの指摘が上がっています。ユーザーは、旧モデルである「Opus 4.8」と比較して、Opus 5は実践的な利用において格段に優れていると評価する声も多いです。また、「FrontierCode」ベンチマークにおいては、中程度の労力で高程度の労力よりも良い結果を示すなど、評価の一貫性に関する議論も生じており、ベンチマーク結果の解釈に多角的な視点が必要とされています。
コーディング性能に関しては、Mikhail Parakhin氏はClaude Opus 5が「Fable 5」に対し、「数学やあらゆる面で明確な勝利」を収めたと評価しています。さらに、ユーザーの報告では、ブラウザ操作やエージェント的なツール利用能力が強調されています。具体的なデモンストレーションとして、実際にブラウザを開いてa ChatGPT Pro subscriptionをキャンセルする例も示されました。Nous Researchは、Nous Portalを通じてClaude Opus 5へのアクセス提供を開始しており、Claude Opus 5を含む全モデルに20%割引が適用されています。
参考: Latent Space (アーカイブ) — 2026年7月25日 16:25 (JST)
原文ハイライト"Claude Opus 5: Fable-level performance at Opus price (half Fable)"