LLM推論初出 8/3 11:50
Alibaba、新Qwen3.8-MaxモデルはAnthropicのClaudeに次ぐと発表
Alibaba Says Its New Qwen3.8-Max Model Trails Only Anthropic's Claude
https://startupfortune.com/feed/2026/8/3
AI要約
Alibabaは新しいQwen3.8-MaxモデルがコーディングとエージェントタスクでClaudeに次ぐ性能だと主張していますが、これはAlibaba独自のテスト結果に基づいています。独立したテストでは競合モデルが優位とされ、Alibabaの株価は無関係なAppleとの契約で上昇しました。
AI要点
- Alibabaは、新モデル「Qwen3.8-Max」がAnthropicのClaudeに次ぐ性能を持つと発表した。
- この主張はAlibaba独自のテスト結果に基づくもので、独立した第三者機関による検証はまだない。
- Qwen3.8-Maxは2.4兆パラメータを持つマルチモーダルモデルであり、テキスト、画像、動画などを扱える。
- モデルの性能評価における、ベンダー独自のテスト結果の信頼性について疑問を呈している。
なぜ重要か
大規模言語モデルの性能競争が激化する中、ベンダー発表の性能指標の信頼性や、客観的な評価基準の重要性を示唆するため。