LLM推論初出 9/12 02:58
DeepSeek が V4.1-Flash を公開
https://qiita.com/tags/AI/feed.atom·2026/9/11
AI要約
DeepSeekがV4.1-Flashを公開したというニュース。性能、コスト、速度、総実行時間における改善を主張しており、LLMの進化と効率化に関する重要な情報である。
AI要点
- DeepSeekは、性能・コスト・速度でフラッグシップV4-Proを上回ると主張する新モデルV4.1-Flashを公開しました。
- 新モデルは、パラメータ数を倍増させたものの、トークンあたりの活性化量を抑え、KVキャッシュを4ビット浮動小数で保持することで低コストを実現しています。
- コーディングやターミナル操作ではV4-Proを上回る一方、知識系のタスクでは僅かに下回るベンチマーク結果が示されています。
- 当初V4-ProからV4.1-Flashへの強制移行を予定していましたが、24時間以内に撤回し、旧モデルのAPI提供継続を決定しました。
- API価格はV4-Proの3割に設定されており、高性能と低価格の両立をアピールしています。
なぜ重要か
DeepSeek V4.1-Flashは、性能向上と大幅なコスト削減を両立させ、AIモデルの経済性と実用性を高める可能性を示唆しています。特に、顧客がAPIの強制移行を嫌ったという事実は、AIモデル提供における予測可能性と透明性の重要性を浮き彫りにしました。