ハードウェア初出 5/27 09:27
Q4 Qwen 27B搭載Single 3090、MTP有効でコンテキストが137kから14kに減少。これは正常ですか?
Single 3090 with Q4 Qwen 27B, context dropped from 137k to 14k with MTP enabled. Is it normal?
https://www.reddit.com/r/LocalLLaMA/.rss2026/5/27
AI要約
Single 3090 GPUと最新のllama.cppを使用した場合、MTP(Multi-Turn Conversation)有効時にコンテキスト長が137kから14kに大幅に短縮される現象についての質問。この現象が正常な範囲内であるかどうかの確認を求めている。