LLM推論2本の記事が同じ件を報じた初出 6/5 11:38
proveKV – LLMのための正直な36倍ロスレス(f32比、fp16比18倍)KVキャッシュ圧縮(PPL回帰ゼロ)
proveKV – Honest 36× lossless (vs f32, 18x vs fp16) KV‑cache compression for LLMs (zero PPL regression)
https://www.reddit.com/r/LocalLLaMA/.rss2026/6/5
AI要約
proveKV – LLMのための損失なしKVキャッシュ圧縮技術の紹介。36倍のメモリ削減(f32比)を達成し、PPL回帰ゼロという結果は、LLMの効率化に大きく貢献する可能性があり、重要度が高い。