ツール/フレームワーク初出 6/9 11:41
ggml-webgpu: k-quantsのプリフィル速度を向上 + Q4/Q5/Q8およびk-quantsのmatmulをリファクタリング by yomaytk · Pull Request #24225 · ggml-org/llama.cpp
ggml-webgpu: Improve prefill speeds for k-quants + refactor matmul for Q4/Q5/Q8 and k-quants by yomaytk · Pull Request #24225 · ggml-org/llama.cpp
https://www.reddit.com/r/LocalLLaMA/.rss2026/6/9
AI要約
llama.cppのggml-webgpuにおいて、k-quantsのprefill速度を向上させ、Q4/Q5/Q8およびk-quantsのmatmulをリファクタリングするプルリクエストについての報告。