ホーム›AI ハードウェア›Mac Studio M5 Max / M5 Ultra

Mac Studio M5 Max / M5 Ultra:ローカルAIのテストと評価

フロンティアモデルをローカルで実行できる初の一般消費者向けマシンです。LLMを実行するうえで何が重要かを検証します ローカルで :メモリ、帯域幅、速度、価格、そしてどんな人にとって購入に適しているのか、あるいは適していないのか。

更新日:2026年10月5日

購入先

Mac Studio M5 Max(36 GB / 512 GB)
Materiel.netMac Studio M5 Max (96 GB / 512 GB) →Darty価格を見る →AmazonPC の別の選択肢:GMKtec EVO-X2 64 GB / 1 TB(Ryzen AI Max+ 395)→

ボタンで案内している構成は、購入時に提示されるものです。ミニPCでは、システム用のメモリを残し、推論エンジンを確認してください。macOS/MLXとCUDAは相互に置き換えて使うことはできません。

アフィリエイトリンク — リンク経由で購入すると、QuelLLM が紹介料を受け取る場合があります。購入者に追加費用はかかりません。また、紹介料の有無は、独立した立場で選定したこれらのおすすめには影響しません。Amazon アソシエイトとして、QuelLLM は条件を満たす購入から利益を得ています。

技術仕様

どのような方に向いていますか?

据え置き環境で大規模LLMを使いたいmacOSの開発者やクリエイター向けです。対象は30Bクラス(36GB)から、Q4で約600Bの最先端MoEモデル(512GB)までです。

メリットと限界

✓ 強み

  • 1.2 TB/s の 512 GB ユニファイドメモリ:約 600B パラメータのモデル(Q4)を完全にローカルに収容可能——サーバー以外では前例がありません
  • Appleは、前世代に比べてAI性能が最大4.3倍になると発表しています(GPUコアごとのNeural Accelerators)
  • macOS + MLX:Apple環境で最も最適化されたローカルLLMエコシステム(LM Studio、Ollama、mlx-lm)
  • 静かでコンパクト、容量の割に消費電力も少ない — 512 GBのVRAMを搭載できるマルチGPUタワーはありません
  • Thunderbolt 5およびSSD PCIe Gen 6:重みの読み込みが著しく速くなる

✗ 限界

  • 512GBのレベルは2026年10月までに配信され、その他のものは9月22日から開始されます
  • Appleの価格:512GB構成は10,000ユーロを大幅に超えるため、本格的な業務用途向け
  • 96 GB 未満の場合、ミニ PC Strix Halo 128 GB(約 3,300〜4,000 ユーロ)の方がユーロあたり多くのメモリを提供します
  • CUDAは利用できません。負荷の高いファインチューニングや一部のツールは、引き続きNVIDIA環境のほうが扱いやすいです。

どのメモリ容量で、どのモデルが使えますか?

ルール: メモリ モデルの読み込み可能なサイズを固定し、 帯域幅 が生成速度を決めます。速度は、MLX/llama.cppを使用したQ4量子化でのテキスト生成(デコード)について、おおよその目安として示しています。MoEではアクティブなパラメータだけが使われるため、高い生成速度が得られます。

構成帯域幅実行できるモデル(Q4)推定速度
M5 Max 36 GB460 GB/s30Bクラス:Qwen3-32B、GLM-4.7-Flash~25-35 tok/s
M5 Max 64GB614 GB/s(40コアGPU)70B(Q4で約40GB);MoE 30B-A3Bは非常に高速です~13-16 tok/s (70B) · 80+ tok/s (MoE A3B)
M5 Max 128 GB614 GB/sQ8量子化の70B、GPT-OSS-120B(MXFP4)、長いコンテキスト~40-60 tok/s (GPT-OSS-120B)
M5 Ultra 96GB1.2 TB/s70B モデル Q4 で、コンテキストの余裕あり~25-30 tok/s
M5 Ultra 256GB1.2 TB/sQwen3-235B-A22B (Q4) (~135 GB)~25-35 tok/s
M5 Ultra 512GB1.2 TB/sQ4の最先端MoEモデル、約600B(DeepSeekクラス、約380〜400 GB)約15〜20トークン/秒

プリフィル(プロンプトの読み取り)は、さらにM5 GPUのNeural Acceleratorsの恩恵も受けます。長いコンテキストでのプリフィルは、従来MacがNVIDIA GPUに比べて苦手としていた部分です。

M5 MaxとM5 Ultra、どちらを選ぶ?

Le M5 Max (36GBで2,999€、BTOで最大128GB) 70BクラスまでおよびMoE ~120Bクラスまでをカバーしており、開発・コピーロール・RAGなど高度な用途に最適な選択です。必ず選択してください GPU 40コア 36 GB を超えたらすぐです:帯域幅が 460 GB/s から 614 GB/s に向上し、トークンごとに約三分の一の速度向上が得られます。

Le M5 Ultra (6 599 €、96 GB) はメモリの点でしか正当化されません。96 GBでは、価格が安いM5 Max 128 GBよりもわずかに優れません。本製品の本質的な価値は、パラメータの段階です 256GBおよび512GB — 2350億から約6000億パラメータのMoEモデルを動作できる唯一の製品です。これらのモデルに明確な用途がない場合、Ultraは不適切な購入です。明確な用途がある場合、それを可能にするデスクトップ機器はこれだけです。

他の選択肢との比較

マシンメモリ帯域幅価格適切な使用法
Mac Studio M5 Max36-128 GB460〜614 GB/s2,999 € から70Bモデルと約120BのMoEモデルが高速、MLXエコシステム
Mac Studio M5 Ultra96-512 GB1.2 TB/s6,599€からMoE 235-600B:同等のデスクトップ機はありません
Strix Halo ミニPC64〜128 GB212 GB/s≈ 2 000-4 000 €メモリ対金額の最適な比率(70B は遅いがアクセス可能)
NVIDIA DGX Spark128 GB273 GB/s≈ 6 100 – 6 600 €CUDAエコシステムが必須、ファインチューニング
RTX 509032 GB1.79 TB/s≈ 5 700 €純粋な処理速度は約32Bまで。それ以上の規模には当てはまらない

まとめ:小規模モデルでの純粋な速度 → 専用GPU;1ユーロあたりの最大容量 → Strix Halo;総合的な最大容量 → M5 Ultra。

入手性:知っておきたいこと

判定

Mac Studio M5はカテゴリを変える:これまで、「フロントラインモデルを実行する」とは、高価なマルチGPUサーバーを意味していました。M5 Ultra 512GBは、その性能をデスクトップで静かに実現します。2,999€のM5 Max 36GBは30Bクラスを十分にカバーします。128GB(614GB/s)からM5はその意味を真正に発揮し、256GB~512GBでは世界で唯一の性能を実現します。70Bの使用量であれば、Strix Halo 128GB(約3,300€~4,000€)はM5 Maxに近い価格でより多くのメモリを提供しますが、生成速度は2~3倍ほど遅くなります。ローカルでDeepSeekクラスを実現したい場合、他に選択肢は一切ありません。

よくある質問

Mac Studio M5 Max / M5 Ultra は、ローカルで 70B LLM を実行できますか?

36GB:30Bクラス · 64〜96GB:70BをQ4で実行 · 128GB:GPT-OSS-120Bを余裕を持って実行 · 256GB:Qwen3-235B(MoE) · 512GB:DeepSeekクラスの最先端MoEモデル、約600BをQ4で実行 — 容量別の目安表を参照。

Mac Studio M5 Max / M5 Ultraの価格はいくらですか?

価格の目安は2,999 €(M5 Max 36 GB / 512 GB)、6,599 €(M5 Ultra 96 GB / 1 TB)です。512 GB / 16 TB構成では最大約20,000 €になります(米ドルではM5 Maxが2,499 $から、M5 Ultraが5,499 $から)。価格は短期間で変動するため、購入リンクからその日の価格を確認してください。

Mac Studio M5 Max / M5 Ultraは誰のために設計されていますか?

据え置き環境で大規模LLMを使いたいmacOSの開発者やクリエイター向けです。対象は30Bクラス(36GB)から、Q4で約600Bの最先端MoEモデル(512GB)までです。

Mac Studio M5上でDeepSeekクラスのモデルをローカルで実行することは可能でしょうか?

はい、これがまさに新機軸です。512 GB の統一メモリにより、約 6,000 億パラメータの MoE フロンティアモデルを Q4 で量子化した場合(重みのサイズは約 380-400 GB)、全体を収容できます。MoE アーキテクチャのおかげで(各トークンごとにアクティブなパラメータのみが読み取られるため)、生成速度は 15-20 tok/s と推定されます。関連項目 当サイトのDeepSeek V4 Flashガイド.

M5 ではなく Mac Studio M4 Max を選ぶことは、今でも可能ですか?

提携販売店では新品の取り扱いが終了: M4 Max 36GB / 512GBは夏に在庫処分価格の2,219ユーロで販売されていましたが、2026年9月末時点では在庫がありません。M5 Maxが2,999ユーロで後を引き継ぎます。帯域幅が広く、Neural Acceleratorsを備え、M4 Maxでは選べなくなった最大128 GBまでのメモリ容量を選択できます。

なぜ統合メモリが大きなモデルに対してGPUを上回るのか?

専用GPUのVRAMは最大32GB(RTX 5090)です。それを超えると、PCIeバス経由でモデルの一部をシステムRAMにオフロードする必要があり、速度が大幅に低下します。Appleのユニファイドメモリでは、GPUが96〜512GBのメモリ全体に直接アクセスできるため、モデル全体を最大のメモリ帯域幅で処理できます。同じ容量のGDDR7 VRAMよりは遅いものの、巨大なモデルを「収められる」唯一のデスクトップ向け方式です。

さらに詳しく