Artificial Analysis、LiveCodeBench最新版でGemini 3 Pro Preview首位
Artificial Analysisは8月20日(現地時間)、大規模言語モデル (LLM) のコード生成能力を評価するベンチマーク「LiveCodeBench」の最新リーダーボードを発表した。この更新で、Gemini 3 Pro Preview (high)が91.7%のスコアで首位を獲得した。同ベンチマークは、LeetCode、AtCoder、CodeForcesといった競技プログラミングプラットフォームから継続的に新しい問題を取り込み、コード生成、自己修復、実行予測といった総合的な能力を評価している。