Mac Studio M5 Max / M5 Ultra:ローカルAIのテストと評価
フロンティアモデルをローカルで実行できる初の一般消費者向けマシンです。LLMを実行するうえで何が重要かを検証します ローカルで :メモリ、帯域幅、速度、価格、そしてどんな人にとって購入に適しているのか、あるいは適していないのか。
更新日:2026年10月5日
購入先
ボタンで案内している構成は、購入時に提示されるものです。ミニPCでは、システム用のメモリを残し、推論エンジンを確認してください。macOS/MLXとCUDAは相互に置き換えて使うことはできません。
アフィリエイトリンク — リンク経由で購入すると、QuelLLM が紹介料を受け取る場合があります。購入者に追加費用はかかりません。また、紹介料の有無は、独立した立場で選定したこれらのおすすめには影響しません。Amazon アソシエイトとして、QuelLLM は条件を満たす購入から利益を得ています。
技術仕様
- メモリM5 Max:36~128 GB · M5 Ultra:96~512 GB の統合メモリ(512 GB 構成は10月下旬に登場)
- 帯域幅M5 Max:460 GB/s(32コアGPU)/ 614 GB/s(40コアGPU)・M5 Ultra:最大1.2 TB/s(前世代比+50%)
- 計算M5 Max:CPU 18コア、GPU最大40コア・M5 Ultra:CPU 36コア、GPU 80コア、Neural Engine 32コア — 各GPUコアにNeural Acceleratorsを搭載、Thunderbolt 5、PCIe Gen 6 SSD
- 消費電力据え置き型、静音冷却
- 参考価格2,999 €(M5 Max 36GB / 512GB)· 6,599 €(M5 Ultra 96GB / 1TB)— 512GB / 16TB構成では最大約20,000 €
- 最大のモデル36 GB:30Bクラス · 64~96 GB:Q4の70B · 128 GB:GPT-OSS-120Bを余裕を持って動かせる · 256 GB:Qwen3-235B(MoE)· 512 GB:Q4で約600Bの最先端MoE、DeepSeekクラス — メモリ容量別の表を参照
どのような方に向いていますか?
メリットと限界
✓ 強み
- 1.2 TB/s の 512 GB ユニファイドメモリ:約 600B パラメータのモデル(Q4)を完全にローカルに収容可能——サーバー以外では前例がありません
- Appleは、前世代に比べてAI性能が最大4.3倍になると発表しています(GPUコアごとのNeural Accelerators)
- macOS + MLX:Apple環境で最も最適化されたローカルLLMエコシステム(LM Studio、Ollama、mlx-lm)
- 静かでコンパクト、容量の割に消費電力も少ない — 512 GBのVRAMを搭載できるマルチGPUタワーはありません
- Thunderbolt 5およびSSD PCIe Gen 6:重みの読み込みが著しく速くなる
✗ 限界
- 512GBのレベルは2026年10月までに配信され、その他のものは9月22日から開始されます
- Appleの価格:512GB構成は10,000ユーロを大幅に超えるため、本格的な業務用途向け
- 96 GB 未満の場合、ミニ PC Strix Halo 128 GB(約 3,300〜4,000 ユーロ)の方がユーロあたり多くのメモリを提供します
- CUDAは利用できません。負荷の高いファインチューニングや一部のツールは、引き続きNVIDIA環境のほうが扱いやすいです。
どのメモリ容量で、どのモデルが使えますか?
ルール: メモリ モデルの読み込み可能なサイズを固定し、 帯域幅 が生成速度を決めます。速度は、MLX/llama.cppを使用したQ4量子化でのテキスト生成(デコード)について、おおよその目安として示しています。MoEではアクティブなパラメータだけが使われるため、高い生成速度が得られます。
| 構成 | 帯域幅 | 実行できるモデル(Q4) | 推定速度 |
|---|---|---|---|
| M5 Max 36 GB | 460 GB/s | 30Bクラス:Qwen3-32B、GLM-4.7-Flash | ~25-35 tok/s |
| M5 Max 64GB | 614 GB/s(40コアGPU) | 70B(Q4で約40GB);MoE 30B-A3Bは非常に高速です | ~13-16 tok/s (70B) · 80+ tok/s (MoE A3B) |
| M5 Max 128 GB | 614 GB/s | Q8量子化の70B、GPT-OSS-120B(MXFP4)、長いコンテキスト | ~40-60 tok/s (GPT-OSS-120B) |
| M5 Ultra 96GB | 1.2 TB/s | 70B モデル Q4 で、コンテキストの余裕あり | ~25-30 tok/s |
| M5 Ultra 256GB | 1.2 TB/s | Qwen3-235B-A22B (Q4) (~135 GB) | ~25-35 tok/s |
| M5 Ultra 512GB | 1.2 TB/s | Q4の最先端MoEモデル、約600B(DeepSeekクラス、約380〜400 GB) | 約15〜20トークン/秒 |
プリフィル(プロンプトの読み取り)は、さらにM5 GPUのNeural Acceleratorsの恩恵も受けます。長いコンテキストでのプリフィルは、従来MacがNVIDIA GPUに比べて苦手としていた部分です。
M5 MaxとM5 Ultra、どちらを選ぶ?
Le M5 Max (36GBで2,999€、BTOで最大128GB) 70BクラスまでおよびMoE ~120Bクラスまでをカバーしており、開発・コピーロール・RAGなど高度な用途に最適な選択です。必ず選択してください GPU 40コア 36 GB を超えたらすぐです:帯域幅が 460 GB/s から 614 GB/s に向上し、トークンごとに約三分の一の速度向上が得られます。
Le M5 Ultra (6 599 €、96 GB) はメモリの点でしか正当化されません。96 GBでは、価格が安いM5 Max 128 GBよりもわずかに優れません。本製品の本質的な価値は、パラメータの段階です 256GBおよび512GB — 2350億から約6000億パラメータのMoEモデルを動作できる唯一の製品です。これらのモデルに明確な用途がない場合、Ultraは不適切な購入です。明確な用途がある場合、それを可能にするデスクトップ機器はこれだけです。
他の選択肢との比較
| マシン | メモリ | 帯域幅 | 価格 | 適切な使用法 |
|---|---|---|---|---|
| Mac Studio M5 Max | 36-128 GB | 460〜614 GB/s | 2,999 € から | 70Bモデルと約120BのMoEモデルが高速、MLXエコシステム |
| Mac Studio M5 Ultra | 96-512 GB | 1.2 TB/s | 6,599€から | MoE 235-600B:同等のデスクトップ機はありません |
| Strix Halo ミニPC | 64〜128 GB | 212 GB/s | ≈ 2 000-4 000 € | メモリ対金額の最適な比率(70B は遅いがアクセス可能) |
| NVIDIA DGX Spark | 128 GB | 273 GB/s | ≈ 6 100 – 6 600 € | CUDAエコシステムが必須、ファインチューニング |
| RTX 5090 | 32 GB | 1.79 TB/s | ≈ 5 700 € | 純粋な処理速度は約32Bまで。それ以上の規模には当てはまらない |
まとめ:小規模モデルでの純粋な速度 → 専用GPU;1ユーロあたりの最大容量 → Strix Halo;総合的な最大容量 → M5 Ultra。
入手性:知っておきたいこと
- 販売開始から 2026年9月22日 (8月25日に予約注文を開始しました。)
- パラメータの段階 512 GBモデルの出荷は10月下旬からです — この構成を狙っているなら、早めに注文してください。
- フランスの販売店では、DartyでM5 Max 36 GB / 512 GB、Materiel.netでM5 Max 96 GB / 512 GBが販売されています。それ以外のメモリ容量を選ぶ場合は、Apple StoreのBTO構成ツールを利用します。
- Mac Studio M4 Max 36GB / 512GBは、当サイトで紹介している販売店では新品の在庫がなくなっています(2026年9月末に確認)— 当サイトのM4 Max紹介ページ 比較のため。
判定
よくある質問
Mac Studio M5 Max / M5 Ultra は、ローカルで 70B LLM を実行できますか?
36GB:30Bクラス · 64〜96GB:70BをQ4で実行 · 128GB:GPT-OSS-120Bを余裕を持って実行 · 256GB:Qwen3-235B(MoE) · 512GB:DeepSeekクラスの最先端MoEモデル、約600BをQ4で実行 — 容量別の目安表を参照。
Mac Studio M5 Max / M5 Ultraの価格はいくらですか?
価格の目安は2,999 €(M5 Max 36 GB / 512 GB)、6,599 €(M5 Ultra 96 GB / 1 TB)です。512 GB / 16 TB構成では最大約20,000 €になります(米ドルではM5 Maxが2,499 $から、M5 Ultraが5,499 $から)。価格は短期間で変動するため、購入リンクからその日の価格を確認してください。
Mac Studio M5 Max / M5 Ultraは誰のために設計されていますか?
据え置き環境で大規模LLMを使いたいmacOSの開発者やクリエイター向けです。対象は30Bクラス(36GB)から、Q4で約600Bの最先端MoEモデル(512GB)までです。
Mac Studio M5上でDeepSeekクラスのモデルをローカルで実行することは可能でしょうか?
はい、これがまさに新機軸です。512 GB の統一メモリにより、約 6,000 億パラメータの MoE フロンティアモデルを Q4 で量子化した場合(重みのサイズは約 380-400 GB)、全体を収容できます。MoE アーキテクチャのおかげで(各トークンごとにアクティブなパラメータのみが読み取られるため)、生成速度は 15-20 tok/s と推定されます。関連項目 当サイトのDeepSeek V4 Flashガイド.
M5 ではなく Mac Studio M4 Max を選ぶことは、今でも可能ですか?
提携販売店では新品の取り扱いが終了: M4 Max 36GB / 512GBは夏に在庫処分価格の2,219ユーロで販売されていましたが、2026年9月末時点では在庫がありません。M5 Maxが2,999ユーロで後を引き継ぎます。帯域幅が広く、Neural Acceleratorsを備え、M4 Maxでは選べなくなった最大128 GBまでのメモリ容量を選択できます。
なぜ統合メモリが大きなモデルに対してGPUを上回るのか?
専用GPUのVRAMは最大32GB(RTX 5090)です。それを超えると、PCIeバス経由でモデルの一部をシステムRAMにオフロードする必要があり、速度が大幅に低下します。Appleのユニファイドメモリでは、GPUが96〜512GBのメモリ全体に直接アクセスできるため、モデル全体を最大のメモリ帯域幅で処理できます。同じ容量のGDDR7 VRAMよりは遅いものの、巨大なモデルを「収められる」唯一のデスクトップ向け方式です。