◆ Mac — MacでローカルAIを最大限に活用 — ユニファイドメモリ、MLX、お使いのチップに適したモデル · 24 € · または全キットを49 €で →

ツール · Apple シリコンM1からM6まで

私のマシンで実行可能な LLM は? Mac ?

チップとメモリ容量を選択してください。このツールは、その構成のメモリに収まるカタログ掲載モデルを、使用する量子化形式と予想速度とともに一覧表示します。

あなたのMac

カタログの読み込み中…

Macのメモリ容量ごとに実行できるモデル

統一メモリはmacOSとモデルの間で共有されます。デフォルトでは、GPUは最大32 GBまで全体の約3分の2、それを超える場合は約4分の3を使用できます。提案: Q4で8Kコンテキストに収まる最大かつ最新のモデル。

速度はチップによって異なります

Macは単語を生成するたびに、メモリ上のモデル全体を読み直します。そのため、メモリ帯域幅が速度の上限を決めます。メモリ容量が同じなら、MaxやUltraチップはベースモデルのチップより数倍高速です。

チップ帯域幅選択可能なメモリ容量
M168 GB/s8, 16 GB
M1 Pro200 GB/s16, 32 GB
M1 Max400 GB/s32、64 GB
M1 Ultra800 GB/s64、128 GB
M2100 GB/s8, 16, 24 GB
M2 Pro200 GB/s16, 32 GB
M2 Max400 GB/s32, 64, 96 GB
M2 Ultra800 GB/s64, 128, 192 GB
M3100 GB/s8, 16, 24 GB
M3 Pro150 GB/s18, 36 GB
M3 Max300から400 GB/s36, 48, 64, 96, 128 GB
M3 Ultra819 GB/s96、256、512 GB
M4120 GB/s16、24、32GB
M4 Pro273 GB/s24, 48, 64 GB
M4 Max410から546 GB/s36, 48, 64, 128 GB
M5153 GB/s16、24、32GB
M5 Pro307 GB/s24, 48, 64 GB
M5 Max460 から 614 GB/s36, 48, 64, 96, 128 GB
M5 Ultra1200 GB/s96、256、512 GB
M6170 GB/s16、24、32GB

2つの値:GPUコア数が少ない(メモリ容量も少ない)バージョンは、帯域幅が低くなります。出典:Appleの技術仕様。M5とM6については、当サイトの製品紹介ページ: Mac Studio M5 et Mac mini M6.

よくある質問

8GBのMacでLLMを実行することは可能ですか?

はい、ただし小規模なモデルに限ります。モデルに割り当てられるのは約 5 GB であり、Q4 で 30 億から 40 億パラメータのモデル(Qwen 3 4B、Gemma 3 4B)を収容できます。16 GB 以上あれば、7B〜8B のモデルが快適に動作します。

GPUは統合メモリのうち、どの程度を使用できますか?

デフォルトでは、macOSは32 GBまでのMacではメモリのおよそ3分の1をシステムに確保し、それを超える場合は4分の1を確保します。したがって、24 GBのMacではモデルに約16 GB、96 GBのMacでは約72 GBが利用可能になります。sysctl iogpu.wired_limit_mbコマンドでこの上限を確認できますが、macOSに十分なメモリを確保してください。

同じメモリ容量の2台の Mac が、なぜ同じ速度にならないのですか?

生成速度は主にメモリ帯域幅に依存するためです。M4は120 GB/s、M4 Proは273 GB/s、M4 Maxは546 GB/sです。各単語の生成において、マシンはモデル全体を再読します。したがって、両方に収まるモデルでは、M4 MaxはM4の約4倍の速度で動作します。

MacではMLX、Ollama、LM Studioのどれを選ぶべきですか?

3つとも使えます。AppleのフレームワークであるMLXは、Apple Siliconで最も高速なことが多く、LM StudioではMLXをグラフィカルインターフェースから利用できます。Ollamaはコマンドラインで最も手軽に使え、多くのツールと連携できます。

その他の無料ツール