中級 12 分Ollama

Ollama + AMD GPU(ROCm):Radeon RX 6000〜の設定 9000

AMDは長らくCUDAに後れを取っていましたが、ROCm 6で十分に差を縮め、Radeon RX 6000、7000、9000シリーズをLLM推論に十分活用できるようになりました。このガイドでは、適切なインストール手順、Ollamaの設定、公式リストに載っていないカードを動かすためのオーバーライドを解説します。

著者 Mohamed Meguedmi·更新 2026-08-27·Windows・macOS・Linuxでテスト済み

#なぜROCmを使うのか

AMDのGPUを使うには、llama.cppを利用するOllamaは、AMDにおけるCUDA相当の仕組みであるROCmを経由する必要があります。ROCmがなければ、推論時にGPUが認識されず、すべてCPUで動作します。

i
代替案:Vulkan
ROCmがうまく動作しない場合は、Vulkan対応でコンパイルしたllama.cppもAMDで動作します。Intel Arcでも使えます。少し遅くなりますが、設定はより簡単です。llama.cppをVulkanで使うガイドを参照してください。

#公式に互換性が確認されているカード

ローカルAIキット

お使いのマシンで、プライベートかつ無料のChatGPTを1時間で構築 — LM Studio、Ollama、Open WebUI、ご自身のドキュメント、クラウド不要。

  • 永久に利用できるオンラインスペース
  • PDF + ファイル
  • 生涯アップデート
RX 7900 XTX / XT / GRE
gfx1100。公式サポート。RTX 4080の性能の約80%です。
RX 7800 / 7700 XT
gfx1101。ROCm 6.1以降で公式サポートされています。
RX 6900 / 6800 / 6700 XT
gfx1030/1031。大容量カードには公式サポート、小型カードにはオーバーライド対応。
Instinct MI200 / MI300
データセンター向けカード。完全なネイティブサポート。
!
RX 6600、6500、5700
公式にはサポートされていません。HSA_OVERRIDE_GFX_VERSION変数(後述)を使えばあらゆる可能性がありますが、自己責任となります。

#1. ROCmをインストールする

最も手厚くサポートされている2つのディストリビューションは、Ubuntu 22.04/24.04とRHEL/Fedoraです。Debian、Archなどでは、追加の工夫や調整が必要です。

Ubuntu 24.04
# Dépôt officiel
wget https://repo.radeon.com/amdgpu-install/6.1/ubuntu/noble/amdgpu-install_6.1.60100-1_all.deb
sudo apt install ./amdgpu-install_6.1.60100-1_all.deb

# ROCm + drivers GPU
sudo amdgpu-install --usecase=rocm,graphics

# Droits utilisateur
sudo usermod -aG render,video $USER

# Reboot obligatoire
sudo reboot
再起動後の確認
rocminfo | grep gfx
# Doit afficher votre architecture, ex : gfx1100

rocm-smi
# Résumé VRAM, température, conso

#2. Ollama および ROCm

Ollama 0.3以降ではROCmが自動的に検出されます。ROCmより先にOllamaをインストールした場合は、Ollamaを再インストールしてください。その際、スクリプトがAMDのGPUを検出し、適切なライブラリをインストールします。

ROCmのインストール後に再インストールする
curl -fsSL https://ollama.com/install.sh | sh
systemctl restart ollama
テストする
ollama run qwen3.5:9b "Test GPU"
# Puis dans un autre terminal :
rocm-smi --showuse
# La ligne GPU[0] doit bouger

#3. 対応していないカードを強制的に使用

rocminfoに使用しているGPUが表示されない場合、またはOllamaがCPUを使い続ける場合、変数 HSA_OVERRIDE_GFX_VERSION を使うと、ROCmにGPUの情報を偽装させることができます。

RX 6600 / 6700
HSA_OVERRIDE_GFX_VERSION=10.3.0
RX 5700 XT
HSA_OVERRIDE_GFX_VERSION=10.1.0(サポートは不安定)
RX 6800 / 6900
ネイティブでサポートされており、オーバーライドは不要です。
Ollamaのsystemdオーバーライド内
sudo systemctl edit ollama

# Ajouter :
[Service]
Environment="HSA_OVERRIDE_GFX_VERSION=10.3.0"

sudo systemctl daemon-reload
sudo systemctl restart ollama

#4. 期待されるパフォーマンス

Qwen 3.5 9B Q4_K_M(6.6 GB、2026年における8 GB環境の定番モデル)での、推論時の速度の目安をトークン/秒で示します。

RX 7900 XTX (24 GB)
~90 tok/s。RTX 4080と同等のパフォーマンスです。
RX 7800 XT (16 GB)
約62トークン/秒。性能はRTX 4070と4070 Tiの中間です。
RX 6900 XT(16 GB)
~52 tok/s。RTX 3080 10 GB相当です。
RX 6700 XT (12 GB, override)
約33 tok/s。RTX 3060と3060 Tiの中間です。
→
VRAMが最重要
AMD でも NVIDIA でも、大規模なモデルを動かせるかどうかの鍵は VRAM 容量です。RX 7900 XTX 24 GB は Qwen 3.6 35B-A3B(Q4 で 23 GB)を実行できますが、RTX 4070 12 GB にはこのモデルを読み込めません。RTX 4070 のほうが純粋な計算速度では速くても、この点は変わりません。

#トラブルシューティング

rocminfoは空です
ドライバーがインストールされていないか、ユーザーが render グループに属していない場合があります。groups $USER を確認してください。
ROCmがあるのにOllamaがCPUを使用する
アーキテクチャの互換性が原因であることがよくあります。1つ上の世代に対応するHSA_OVERRIDEを試してください。
大きなモデルでのクラッシュ(メモリ不足)
rocm-smiでVRAM使用量を確認できます。容量を超える場合は、num_ctxを減らすか、Q3_K_Mに切り替えてください。
ROCmのバージョンがOllamaと互換性がない
OllamaはROCm 6.x向けにパッケージ化されています。ROCm 5では動作しません。更新してください。
このガイドは役に立ちましたか?

ご意見、誤りのご指摘、補足はありますか?ぜひお知らせください。皆さんにとってより良いガイドにするために役立ちます。