ハードウェア初出 8/26 13:12
AMD MI350XにおけるQwen3.6-35B-A3Bのオープンソースカーネル:8GPUで78,498出力トークン/秒
Open Source Kernel in Qwen3.6-35B-A3B for AMD MI350X: 78,498 output tok/s on 8 GPUs
https://www.reddit.com/r/LocalLLaMA/.rss2026/8/26
AI要約
Qwen3.6-35B-A3B モデルを AMD MI350X GPU 8基で動作させ、78,498 output tok/s を達成した事例です。NVIDIA GPU が主流の中、AMD GPU の性能と ROCm の成熟度が比較されています。
AI要点
- AMD MI350X GPU 8基でQwen3.6-35B-A3Bモデルを動作させ、78,498 output tok/sを達成。
- NVIDIA GPUが主流の中で、AMD GPUの性能が比較されている。
- ROCmの成熟度もAIワークロードにおけるAMD GPUの利用において重要視されている。
なぜ重要か
NVIDIA製GPUが主流となっているAI分野において、AMD製GPUとROCmエコシステムの性能が示され、GPU選択肢の多様化と性能競争の可能性を示唆するためです。