LLM推論初出 9/8 06:05
AlibabaのQwen3.8-Maxモデル、コーディングリーダーボードでClaude Opus 5を上回る
Alibaba's Qwen3.8-Max Model Overtakes Claude Opus 5 on Coding Leaderboard
https://startupfortune.com/feed/2026/9/8
AI要約
AlibabaのQwen3.8-Maxモデルが、コーディング能力のベンチマークであるCode ArenaのWebDevリーダーボードでClaude Opus 5を僅差で上回り1位を獲得しました。これにより、中国製モデルが業界で最も厳しいエージェントコーディングのベンチマークでトップとなり、競合モデルと比較して大幅に安価な価格設定も維持しています。
AI要点
- AlibabaのQwen3.8-Maxモデルが、コーディングリーダーボード「Code Arena」のWebDev部門でClaude Opus 5を上回った。
- Qwen3.8-Max-0902は、Claude Opus 5 Maxより3ポイント高く、1,691ポイントで首位に立った。
- 価格は据え置きで、100万トークンあたり入力2ドル、出力6ドルとなっている。
- このモデルは、エージェンティックコーディングやフルアプリ生成といった複雑なタスクに強い。
- 中国製AIモデルが、厳格なベンチマークでトップクラスの性能を示したことは注目に値する。
なぜ重要か
AIモデルの性能と価格のバランスを示す重要な指標において、中国製モデルがトップを獲得したことは、AI開発競争のグローバルな様相を変化させる可能性を示唆しており、コストパフォーマンスの高いAIソリューションの普及を加速させるかもしれません。