LLM推論初出 6/6 23:22
Gemma 4 QAT Q4_0 Strix Haloでのベンチマーク
Gemma 4 QAT Q4_0 Bench on Strix Halo
https://www.reddit.com/r/LocalLLaMA/.rss2026/6/6
AI要約
Strix Halo APU上で、Gemma 4 QAT Q4_0 GGUFモデルをllama.cpp Vulkan/RADV経由で実行したベンチマーク。QAT(Quantization-Aware Training)により、量子化されたモデルの精度とパフォーマンスを評価している。