LLM推論重要度 ★8
最高のオープンソースLLM:2026年7月リーダーボード(更新)
Best Open-Source LLMs: July 2026 Leaderboard (Updated)
Elo Rating for LLMs·2026/7/20
AI要約
7月19日時点の最新情報によると、GLM-5.2がエージェントコーディングと推論においてオープンソースLLMリーダーボードのトップに躍り出た。Kimi K3は、7月27日にウェイトが公開される予定だが、生能力では僅差で2位につけている。DeepSeek V4とQwen3.6がフロンティア近辺のティアを形成している。GLM-5.2は、SWE-bench Proで62.1%、Terminal-Bench 2.1で81.0%のスコアを達成し、Claude Opus 4.8に迫る性能を示している。Kimi K3は、SWE Marathonでトップとなり、ArenaのFrontend CodeリーダーボードでもClaude Fable 5を上回った。しかし、ウェイト公開は7月27日まで待つ必要がある。
AI要点
- 2026年7月時点のオープンソースLLMリーダーボードでは、GLM-5.2がコーディングと推論でトップに立ちました。
- Kimi K3は性能で僅差の2位ですが、7月27日にウェイト公開予定で、オープンソースモデルの可能性を示しています。
- DeepSeek V4とQwen3.6がフロンティア近辺の性能を示しており、競争が激化しています。
- GLM-5.2はSWE-bench Proで62.1%、Terminal-Bench 2.1で81.0%を達成し、商用モデルに迫る性能です。
- Kimi K3はSWE Marathonでトップ、Arena Frontend CodeリーダーボードでもClaude Fable 5を上回りました。
なぜ重要か
GLM-5.2やKimi K3のような高性能オープンソースLLMの登場は、研究開発の民主化を促進し、AI分野におけるイノベーションの速度を加速させる上で極めて重要です。