ハードウェア初出 8/14 23:50
KogはGPUからの推論をさらに絞り出すために深く掘り下げている
Kog is going deeper to squeeze more inference out of GPUs
https://techcrunch.com/category/artificial-intelligence/feed/2026/8/14
AI要約
フランスのスタートアップKogは、GPUでエージェントワークフローからより多くの推論を引き出すための技術を開発しています。GPUはエージェントワークフローには不向きという見方があるかもしれませんが、Kogはそれを誤解だと主張し、効率化の可能性を示唆しています。
AI要点
- スタートアップKogは、既存のGPUからAI推論のパフォーマンスをさらに引き出すためのソフトウェア最適化に注力している。
- Kogは、特に大規模モデル(LLM)の推論速度を向上させることで、既存ハードウェアの活用とコスト削減を目指している。
- 同社は、プロフェッショナルなタスクでAIを利用する顧客や、ゲーム・アプリ開発者など、高速な結果が収益に直結する層をターゲットとしている。
- Kogの推論エンジン(KIE)は、30億パラメータの小規模モデルで毎秒3000トークンという高い性能を示しており、LLMへの適用も目指している。
なぜ重要か
Kog社が既存GPUの性能をソフトウェアで最大限に引き出すアプローチは、AI推論のコストと速度のボトルネック解消に貢献し、AIのさらなる普及と実用化を促進する可能性があるため重要である。