LLM推論2本の記事が同じ件を報じた初出 7/18 06:30
ローカルLLM study1-a: gemma4:e2b/e4bのMLX版はどれだけ速いか
https://zenn.dev/topics/ai/feed2026/7/18
AI要約
Googleが公開したGemma 4ファミリーのMLX版(gemma4:e2b-mlx, gemma4:e4b-mlx)の速度を、通常版と比較検証。4タスクでの実測結果を基に、MLX版の性能向上について詳述する。
AI要点
- ローカルLLMのgemma4:e2b/e4bのMLX版は、通常版と比較して2〜5倍高速である。
- MLX版はApple Siliconに最適化されており、特に短いタスクで速度向上が顕著である。
- コードレビューやバグ検出タスクでは、通常版と同等以上の精度を示した。
- デコレーター説明タスクにおいて、通常版と異なる解釈をする挙動が確認された。
- MLX版は通常版よりもディスクサイズが小さいという利点もある。
なぜ重要か
Apple Silicon環境でのLLM利用において、MLX版の導入は大幅な高速化とリソース削減をもたらし、ローカルAI開発の効率を向上させる可能性がある。