Tag
最高のオープンソースLLM:2026年7月リーダーボード(更新)
7月19日時点の最新情報によると、GLM-5.2がエージェントコーディングと推論においてオープンソースLLMリーダーボードのトップに躍り出た。Kimi K3は、7月27日にウェイトが公開される予定だが、生能力では僅差で2位につけている。DeepSeek V4とQwen3.6がフロンティア近辺のティアを形成している。GLM-5.2は、SWE-bench Proで62.1%、Terminal-Bench 2.1で81.0%のスコアを達成し、Claude Opus 4.8に迫る性能を示している。Kimi K3は、SWE Marathonでトップとなり、ArenaのFrontend CodeリーダーボードでもClaude Fable 5を上回った。しかし、ウェイト公開は7月27日まで待つ必要がある。
中国製AIモデル、ClaudeやChatGPTに匹敵する能力で米テック業界を驚かせる
中国のスタートアップMoonshotが開発したKimi K3モデルは、AnthropicのClaudeやOpenAIのChatGPTといった米国の最先端AIモデルに匹敵する能力を示し、米国テック業界に衝撃を与えています。特に、AIシステムの評価プラットフォームArenaでは、「フロントエンドコーディング能力」においてKimi K3がトップクラスの評価を獲得しており、オープンソースの中国製AIモデルが、クローズドな米国製モデルを凌駕する可能性が示唆されています。これは、米国の技術的制限が中国のAI技術開発を加速させている現状を浮き彫りにしています。