ベンダー・製品

Together AI、DeepSWEでGLM-5.3とClaude Fable 5を比較評価:性能とコストで分析

Together AIは2026年8月21日(現地時間)、ソフトウェアエンジニアリング能力を評価するベンチマーク「DeepSWE」を用いて、同社のモデルであるGLM-5.3とClaude Fable 5の比較評価結果を公開しました。この評価により、両モデルのpass@1スコアはほぼ同等であるものの、複数回試行を許容するpass@kの指標ではGLM-5.3が優位に立ち、かつロールアウトあたりのコストがClaude Fable 5より大幅に低いことが明らかになりました。

ベンダー・製品

Together AI、DeepSWEでGLM-5.3とGPT-5.6 Solを比較 – 性能と費用対効果を検証

Together AI(トゥゲザーエーアイ)は2026年8月21日(現地時間)、同社のブログ記事を通じて、大規模言語モデル「GLM-5.3(ジーエルエム5.3)」と「GPT-5.6 Sol(ジーピーティー5.6ソル)」を、ソフトウェアエンジニアリングベンチマーク「DeepSWE(ディープスウィー)」で比較した結果を公開した。この検証では、単一試行におけるGPT-5.6 Solの優位性と、複数試行および費用対効果におけるGLM-5.3の強みが明らかになった。さらに、両者を組み合わせたカスケード方式が、性能と費用効率の双方で最も優れた結果を示すことが示された。