Kimi K3とGPT-5.6 Sol、ソフトウェア能力で比較 Together AIがベンチマーク結果発表
Together AIは2026年7月25日(現地時間)付けのブログ記事で、大規模言語モデルKimi K3とGPT-5.6 SolのDeepSWEベンチマークにおける性能比較結果を発表した。単一試行での解決率(pass@1)ではGPT-5.6 Solが72.7%でKimi K3の68.5%を上回ったが、複数試行での解決率(pass@k with k > 1)ではKimi K3が優位性を示した。