LLM推論初出 5/23 16:44
Gemma4 26b a4b Apex quantはかなり良い
Gemma4 26b a4b Apex quant is quite good
https://www.reddit.com/r/LocalLLaMA/.rss2026/5/23
AI要約
Gemma4 26B A4B の Apex quant を llama.cpp Vulkan を用いて RX 9060 XT 16GB GPU で実行した結果、高コンテキスト長(90k)で38TPSを記録し、品質劣化もなかったという報告。効率的な量子化手法の有効性を示唆。