LLM推論初出 7/26 01:27
Grok 4.5はベンチマークでは勝利せずも、創業者らが実際に支払う金額で勝利
Grok 4.5 doesn't win on benchmarks but it wins on the number founders actually pay
https://startupfortune.com/feed/2026/7/26
AI要約
xAIのGrok 4.5はベンチマークでは劣るものの、コストパフォーマンスに優れています。特にコーディングタスクにおいては、競合モデルよりも大幅に安価であり、製品開発におけるAIモデル選択の基準が、性能だけでなくコスト効率へとシフトしていることを示しています。
AI要点
- xAIのGrok 4.5は、ベンチマークでは4位だが、コーディングタスクあたりのコストが約2.49ドルと、Claude Opus 4.8の10ドル以上と比較して大幅に安い。
- Grok 4.5は、Claude Opus 4.8の約4分の1のトークン数で同等のコーディングタスクを完了できる。
- AIモデル選択において、性能だけでなく、API利用料といった運用コストがスタートアップの収益性に直結する重要な指標となっている。
- トークン効率の差は、AIモデルを大規模に利用する際の製品開発コストに大きな影響を与える。
- フロンティアAIの運用コストが現実的なものとなり、コスト効率の高いモデルへの移行が進む可能性がある。
なぜ重要か
AIモデルの性能だけでなく、運用コストが製品の収益性を左右する時代になり、特にスタートアップはコスト効率を重視したモデル選択を迫られるため、AIエコシステム全体の価格設定に影響を与える。