LLM推論初出 7/18 03:00
DeepSeek V4 Flash | IQ3_XXS-AS & IQ2_S Bench | mainline b10064 vs fairydreaming | 1xRTX 3090 + 128GB DDR4 | 50K CTXで250PP/11TG
DeepSeek V4 Flash | IQ3_XXS-AS & IQ2_S Bench | mainline b10064 vs fairydreaming | 1xRTX 3090 + 128GB DDR4 | 250PP/11TG on 50K CTX
https://www.reddit.com/r/LocalLLaMA/.rss2026/7/18
AI要約
DeepSeek V4 FlashモデルのIQ3_XXS-ASおよびIQ2_S量子化版のベンチマーク結果です。llama.cppのフォーク版ではなく、メインライン版で良好な性能が出ることが示されています。
AI要点
- DeepSeek V4 FlashモデルのIQ3_XXS-ASおよびIQ2_S量子化版のベンチマーク結果が示されている。
- llama.cppのメインライン版で良好な性能が確認され、フォーク版との比較で優位性を示唆している。
- 50Kコンテキスト長で250PP/11TGという具体的な性能指標が報告されている。
なぜ重要か
DeepSeek V4 Flashモデルの性能を具体的に示すベンチマーク結果は、モデル選択や活用の判断材料となり、AI開発の進展に寄与するため、重要です。