LLM推論初出 6/6 05:25
RTX 4060 (8GB) ラップトップで Qwen3.6-35B-A3B を実行 — 何がうまくいき、何がうまくいかなかったか、そして驚くべき予測デコーディングの結果
Running Qwen3.6-35B-A3B on a laptop RTX 4060 (8GB) — what worked, what didn't, and a surprising speculative-decoding result
https://www.reddit.com/r/LocalLLaMA/.rss2026/6/6
AI要約
ラップトップのRTX 4060 (8GB)でQwen3.6-35B-A3Bモデルを実行した際の経験談。VRAM制限下でのチューニングのポイントや、コミュニティベンチマークと異なる結果(特に投機的デコーディング)について報告しています。