LLM推論初出 6/1 04:32
モデルがVRAMからシステムメモリに溢れ出すとき、実際に何が起こっているのか?
Whats actually happening when a model spills out of VRAM into system memory?
https://www.reddit.com/r/LocalLLaMA/.rss2026/6/1
AI要約
モデルがVRAMからシステムメモリに溢れる際の挙動についての質問。llama.cppでの複数GPU/CPU/GPU+CPUの利用方法と最適化に関する話題。