ハードウェア4本の記事が同じ件を報じた初出 8/24 17:44
DeepSeek V4-Flash-Vision-Exp:APIに画像入力がついに登場
DeepSeek V4-Flash-Vision-Exp: Image Input Finally Hits the API
https://zenn.dev/topics/ai/feed2026/8/24
AI要約
DeepSeekのAPI対応ビジョンモデル「DeepSeek V4-Flash-Vision-Exp」が登場。画像入力が384トークンに制限され、V4-Flashの価格設定がエージェント開発者に与える影響を分析しています。
AI要点
- DeepSeek V4-Flash-Vision-Expは、API経由で画像入力を受け付ける初のモデルである。
- 画像は最大384トークンとして扱われ、V4-Flashの料金体系が適用される。
- APIから直接画像を入力できることで、追加のモデルやテキスト変換による遅延・ロスがなくなる。
- このモデルは、既存のAPIエンドポイントで利用可能であり、エージェント構築者にとって便利である。
- 画像トークン化、請求方法、ベンチマークの解釈、Claudeとの比較などが解説されている。
なぜ重要か
DeepSeekが画像入力対応APIモデルをリリースしたことにより、AIエージェントが画像情報を直接処理できるようになり、マルチモーダルAIの応用範囲が拡大し、より高度なタスク実行が可能になるからです。