Windows 11 への Ollama インストール:完全ガイド (2026)
Windows 11では、公式サイトからダウンロードした通常のインストーラーでOllamaをインストールできます。GPUは自動検出されます(NVIDIA CUDAをネイティブサポート)。ターミナルで一つのコマンド(ollama run qwen3.5:4b)を実行するだけで、約5分で最初のモデルをダウンロードして起動できます。手動設定や複雑なコマンドは不要です。
Windows PCをお持ちで、ChatGPTを使わずにLLMをローカルで動かしたいとお考えなら、Ollamaがおそらく最も簡単なツールです。一般的なインストーラーと、コマンド1つ、モデル1つだけ。わずか3分で、お使いのマシン上でQwen 3.5が動きます。
#なぜ Ollama を使うのか?
Ollamaは、モデルのダウンロード、量子化、VRAMへのロード、GPUの検出、ローカルHTTP APIの管理など、すべての手間を代わりにしてくれます。内部ではllama.cppが使われていますが、コンパイルは必要ありません。
このツールは無料であり、オープンソースです。モデルがダウンロードされた後は、完全にオフラインで動作します。遠隔サーバーにデータが送信されることはありません。
#前提条件
お使いのマシンで、プライベートかつ無料のChatGPTを1時間で構築 — LM Studio、Ollama、Open WebUI、ご自身のドキュメント、クラウド不要。
- 永久に利用できるオンラインスペース
- PDF + ファイル
- 生涯アップデート
- Windows 10 または 11
- 64ビット。Ollamaには32ビット版はありません。
- 最低 8 GBのRAM
- Q4で量子化した8〜9Bのモデルなら、16 GBのメモリで余裕を持って使えます。
- 10 GB のディスクスペース
- 4〜9Bのモデルは約3〜7GBのサイズです。複数のモデルをテストする場合は、十分な余裕を確保してください。
- NVIDIA GPU(オプション)
- 最新ドライバー、RTX 20/30/40/50 または GTX 16。Ollama は GPU を自動検出します。
#1. ダウンロード
公式サイトにアクセスし、Windowsインストーラーをダウンロードしてください。
インストーラーは約700MBです。これは正常で、CUDAサポートを含むllama.cppのプリコンパイルバイナリが含まれているためです。
#2. インストール
- 01OllamaSetup.exe を実行してくださいダウンロードしたインストーラーをダブルクリックしてください。Windows DefenderがSmartScreenの警告を表示することがあります。その場合は「詳細情報」をクリックし、続いて「実行」をクリックしてください。
- 02サイレントインストール設定ウィンドウは一切ありません。インストーラは %LOCALAPPDATA%\Programs\Ollama にインストールされ、自動的にバックグラウンドサービスを起動します
- 03システムアイコンを確認してください画面右下の時計の近くに、小さな Ollama アイコンが表示されます。このアイコンは、デーモンが動作していることを示します。
- 04ターミナルを開いてくださいPowerShell、Windows Terminal、または cmd.exe — どれでも構いません。以下の確認コマンドを入力してください
ollama version is 0.5.xのような表示が出るはずです。コマンドが認識されない場合は、ターミナルを閉じて開き直してください。PATHが変更されたばかりだからです。
#3. 初めて使うモデル
Qwen 3.5 4Bは、最初に選ぶモデルとしておすすめです。多言語に対応し、フランス語も非常に得意で、軽量かつ非常に高速です。モデルのサイズを考えると、品質も優れています。Apache 2.0ライセンスで提供されています。
初回はOllamaがモデルをダウンロードします(Q4で約3.4GB)。次回以降はすぐに起動します。プロンプト >>> が表示されたら、会話を始められます。
#4. GPUが使用されているか確認
デフォルトでOllamaはNVIDIA GPUを検出し、その上にモデルをロードします。確認するには、会話が進行中のときに次のコマンドを実行してください:
PROCESSOR列で100%GPUが表示されるべきです。CPUまたは部分的なパーセンテージが表示される場合は、モデルがRAMにオーバーフローしていることを意味します。
GPU使用状況をリアルタイムで監視するには、別のPowerShellウィンドウを開いてください :
#5. Open WebUI で整ったインターフェースを
ターミナルはテストに適しています。日常使用には Open WebUI が ChatGPT に似ており、履歴、Markdown、添付ファイルなどすべて対応しています。最も簡単な方法は Docker Desktop を使うことです。
次に、ブラウザでhttp://localhost:3000を開いてください。アカウントを作成すると、Ollamaのモデルが一覧に表示されます。このアカウントはローカルのもので、お使いのマシンから外部に情報が出ることはありません。
#トラブルシューティング
- 「ollama : コマンドが見つかりません」
- PATHが再読み込みされていません。すべてのターミナルを閉じて、開き直してください。最後の手段として、Windowsのセッションを再起動してください。
- ダウンロードが0%で止まる
- 企業のファイアウォールがOllamaをブロックすることがあります。別のネットワークから試してみてください。もしくはHTTPS_PROXY環境変数を設定してプロキシを構成してください。
- モデルは動作しているが遅い
- ollama ps で確認してください。100% CPUと表示される場合、GPUのメモリ容量が足りないか、GPUが正しく検出されていません。NVIDIAのドライバーを更新してください。
- 回答が数行で途切れる
- デフォルトのコンテキストウィンドウは2048トークンです。対話中に /set parameter num_ctx 8192 と入力して大きさを増やすことができます。
#さらに詳しく
Ollamaが動作するようになりました。次に進むなら、以下のステップが自然です。
ご意見、誤りのご指摘、補足はありますか?ぜひお知らせください。皆さんにとってより良いガイドにするために役立ちます。