メインコンテンツへスキップ
Qwen3.8-Flash-Next、4台のR9700でローカルAIパワーハウス化!最適化されたvLLMで単一リクエスト120 t/s TG、12k t/s PP — Cernoval