LLM推論初出 5/29 02:59
VideoMLA:1分規模の自己回帰ビデオ拡散のための低ランク潜在KVキャッシュ
VideoMLA: Low-Rank Latent KV Cache for Minute-Scale Autoregressive Video Diffusion
https://export.arxiv.org/api/query2026/5/29
AI要約
長時間のビデオ拡散モデルにおけるKVキャッシュの低ランク化手法「VideoMLA」を提案。従来のヘッドごとのKVキャッシュに代わり、共有された低ランク表現を用いることで、ストリーミングメモリとレイテンシを改善する可能性を示す。