ツール · Apple シリコンM1からM6まで
私のマシンで実行可能な LLM は? Mac ?
チップとメモリ容量を選択してください。このツールは、その構成のメモリに収まるカタログ掲載モデルを、使用する量子化形式と予想速度とともに一覧表示します。
あなたのMac
カタログの読み込み中…
Macのメモリ容量ごとに実行できるモデル
統一メモリはmacOSとモデルの間で共有されます。デフォルトでは、GPUは最大32 GBまで全体の約3分の2、それを超える場合は約4分の3を使用できます。提案: Q4で8Kコンテキストに収まる最大かつ最新のモデル。
| メモリ | 利用可能 | 推奨 (Q4) |
|---|---|---|
| 8 GB | ≈ 5.4 GB | LFM2.5 7B · 8 GB 向けランキング |
| 16 GB | 約11GB | Nemotron 3 Super 12B · 16GB向けランキング |
| 24 GB | 約 16 GB | Devstral Small 2 24B · 24 GB向けランキング |
| 32 GB | ≈ 21 GB | Laguna XS.2 · 32 GB向けランキング |
| 36 GB | ≈ 27 GB | Qwen 3.6 35B-A3B |
| 48 GB | ≈ 36 GB | Qwen 3.6 35B-A3B · 48GB向けランキング |
| 64 GB | 約48GB | Nemotron 3 Puzzle 75B-A9B · 64 GB向けランキング |
| 96 GB | ≈ 72 GB | Laguna S 2.1 · 96 GB向けランキング |
| 128 GB | ≈ 96 GB | Mistral Medium 3.5 128B · 128 GB向けランキング |
| 192GB | ≈144GB | MiniMax-M2.7 |
| 256 GB | ≈ 192 GB | GLM 5.3 Flash 320B-A18B |
| 512GB | ≈ 384 GB | Nemotron 3 Ultra (BF16) |
速度はチップによって異なります
Macは単語を生成するたびに、メモリ上のモデル全体を読み直します。そのため、メモリ帯域幅が速度の上限を決めます。メモリ容量が同じなら、MaxやUltraチップはベースモデルのチップより数倍高速です。
| チップ | 帯域幅 | 選択可能なメモリ容量 |
|---|---|---|
| M1 | 68 GB/s | 8, 16 GB |
| M1 Pro | 200 GB/s | 16, 32 GB |
| M1 Max | 400 GB/s | 32、64 GB |
| M1 Ultra | 800 GB/s | 64、128 GB |
| M2 | 100 GB/s | 8, 16, 24 GB |
| M2 Pro | 200 GB/s | 16, 32 GB |
| M2 Max | 400 GB/s | 32, 64, 96 GB |
| M2 Ultra | 800 GB/s | 64, 128, 192 GB |
| M3 | 100 GB/s | 8, 16, 24 GB |
| M3 Pro | 150 GB/s | 18, 36 GB |
| M3 Max | 300から400 GB/s | 36, 48, 64, 96, 128 GB |
| M3 Ultra | 819 GB/s | 96、256、512 GB |
| M4 | 120 GB/s | 16、24、32GB |
| M4 Pro | 273 GB/s | 24, 48, 64 GB |
| M4 Max | 410から546 GB/s | 36, 48, 64, 128 GB |
| M5 | 153 GB/s | 16、24、32GB |
| M5 Pro | 307 GB/s | 24, 48, 64 GB |
| M5 Max | 460 から 614 GB/s | 36, 48, 64, 96, 128 GB |
| M5 Ultra | 1200 GB/s | 96、256、512 GB |
| M6 | 170 GB/s | 16、24、32GB |
2つの値:GPUコア数が少ない(メモリ容量も少ない)バージョンは、帯域幅が低くなります。出典:Appleの技術仕様。M5とM6については、当サイトの製品紹介ページ: Mac Studio M5 et Mac mini M6.
よくある質問
8GBのMacでLLMを実行することは可能ですか?
はい、ただし小規模なモデルに限ります。モデルに割り当てられるのは約 5 GB であり、Q4 で 30 億から 40 億パラメータのモデル(Qwen 3 4B、Gemma 3 4B)を収容できます。16 GB 以上あれば、7B〜8B のモデルが快適に動作します。
GPUは統合メモリのうち、どの程度を使用できますか?
デフォルトでは、macOSは32 GBまでのMacではメモリのおよそ3分の1をシステムに確保し、それを超える場合は4分の1を確保します。したがって、24 GBのMacではモデルに約16 GB、96 GBのMacでは約72 GBが利用可能になります。sysctl iogpu.wired_limit_mbコマンドでこの上限を確認できますが、macOSに十分なメモリを確保してください。
同じメモリ容量の2台の Mac が、なぜ同じ速度にならないのですか?
生成速度は主にメモリ帯域幅に依存するためです。M4は120 GB/s、M4 Proは273 GB/s、M4 Maxは546 GB/sです。各単語の生成において、マシンはモデル全体を再読します。したがって、両方に収まるモデルでは、M4 MaxはM4の約4倍の速度で動作します。
MacではMLX、Ollama、LM Studioのどれを選ぶべきですか?
3つとも使えます。AppleのフレームワークであるMLXは、Apple Siliconで最も高速なことが多く、LM StudioではMLXをグラフィカルインターフェースから利用できます。Ollamaはコマンドラインで最も手軽に使え、多くのツールと連携できます。