リサーチ・論文

GPT-5.6 Sol、Agent Arenaリーダーボード2位に浮上、フロンティアモデル性能差を縮小

アリーナ (Arena) は2026年7月13日(現地時間)、最新の言語モデルGPT-5.6 Solがエージェントアリーナ (Agent Arena) リーダーボードで2位に浮上したと発表した。これは7,800件の実世界エージェントセッションに基づき、旧モデルであるGPT-5.5 (xHigh)からネットで1.6%の性能向上を示し、フロンティアモデルのクロード・フェーブル5 (Claude Fable 5)との差を縮めた。特に「称賛 vs 批判」タスクにおいて、両モデル間の性能差が最も顕著であったと指摘されている。

ベンダー・製品

Anthropic、「Claude Fable 5」を7月7日からクレジット課金制へ移行

Anthropic は2026年7月4日(現地時間)、生成AIモデル「Claude Fable 5」の提供方法を7月7日以降変更すると発表した。同日以降、Pro、Max、Team、および一部のEnterpriseプランにおける同モデルの週次利用制限での提供を終了し、使用量クレジットによる課金制に移行する。同社は、今回の変更は一時的な措置であり、容量が確保でき次第、標準プランでの提供を再開する方針を示している。

リサーチ・論文

Anthropic(アンソロピック)、新分類「Mythos-class」初のモデル「Claude Fable 5」を投入

Anthropic(アンソロピック)は2026年6月9日(現地時間)、新たなモデル分類「Mythos-class」に属する初の一般公開モデル「Claude Fable 5」をリリースしました。同モデルは、エージェントのリアルワールド知識作業を評価するベンチマーク「GDPval-AA」で1932点を獲得し、首位にランクインしたと発表しています。さらに、Artificial Analysis Intelligence Indexでも#1を獲得しており、同社は新たなAI技術の進展を示すものとしています。

リサーチ・論文

Claude Fable 5、AIインテリジェンス分析で首位に

Anthropic (アンソロピック) の独自モデル Claude Fable 5 (Adaptive Reasoning, Max Effort, Opus 4.8 Fallback) は2026年6月(現地時間)、Artificial Analysis (アーティフィシャル・アナリシス) が公開した分析において、「Artificial Analysis Intelligence Index v4.0」で152モデル中1位となる65点を獲得した。同モデルはインテリジェンス評価で際立った性能を示した一方、高い運用コストと平均を下回る処理速度が課題として指摘されている。