初心者 8 分VRAM別

4GBのVRAMで利用可能なLLMはどれですか? ?

4GBのVRAMは、2026年にローカルでLLMを動かすための最低限の容量です。GTX 1650、GTX 1050 Ti、RTX 3050 Mobileなど、古いカードや最廉価クラスのカードが該当します。それでも、Ollamaをインストールすれば、Qwen 3.5 2BやGranite 4.2 3Bと対話できます。このガイドでは、どのモデルが動き、どのモデルが動かないのか、そしてこの4GBを最大限に活用する方法を具体的に説明します。

マシンを選んでいるところですか? 予算別のおすすめ →

著者 Mohamed Meguedmi·更新 2026-08-27·Windows・macOS・Linuxでテスト済み
推奨ハードウェア

16GBのVRAMにアップグレードするには: RTX 5060 Ti 16 GB.

800 €から3,500 €まで、予算別にすべてのオプションを比較 →

外出先では: ローカル AI 向けのノートパソコンはどれ? →

アフィリエイトリンク — お客様の追加負担なしで、当サイトが紹介料を受け取る場合があります。Amazonのパートナーとして、QuelLLMは所定の条件を満たす購入から収益を得ます。

#2026年の4GB VRAM

i
最低限の必要条件
VRAMが4GBあればローカルでLLMを試せますが、かなり制約があります。2026年の8BモデルであるGranite 4.2 8B Q4(5.3GB)などはVRAMに収まりません。余裕を持って動かせる2B〜4Bのモデルを選んでください。

#1. 4GBのGPUはどれですか?

GTX 1650 (4 GB)
Pascal-Turing 2019。現在、新品は見つけるのが難しいです。中古品の価格は変動します。
GTX 1050 Ti (4 GB)
2016年のPascal。古いカードですが、今でも使えます。中古で入手でき、価格はさまざまです。
RTX 3050 Mobile 4 GB
ノートPC向けのエントリークラスのモデル。
GTX 1630 (4 GB)
最廉価クラスで、避けたほうがよいでしょう。軽量な LLM でも性能が不十分です。

#2. 利用可能なモデル

4GBのVRAM — 2026年のLLMモデル
モデルQuantVRAMOKですか?
Gemma 4 2BQ5_K_M1.4 GB★★★★★ 快適
Qwen 3.5 2BQ4_K_M1.9 GB★★★★★ 快適
Granite 4.2 3BQ4_K_M2.2GB★★★★★
Qwen 3.5 4BQ4_K_M2.3 GB★★★★
Gemma 4 E2BQAT4.3 GB⚠️ ぎりぎり(4 GBの上限)
Granite 4.2 8BQ4_K_M5.3 GB❌ VRAM容量を超過

#3. 4 GBを効果的に活用するヒント

KVキャッシュ Q4
OLLAMA_KV_CACHE_TYPE=q4_0(q8_0の代わりに)。より強い量子化で、キャッシュのメモリ使用量を50%削減します。
文脈2kまで
それ以上になると、すべてがオーバーフローします。2kトークンは約5〜10文のフランス語に相当し、シンプルなチャットには十分です。
その他すべてを閉じる
GPU アクセラレーションを使う Chrome、Discord、OBS は、いずれも VRAM を消費します。必要最小限のアプリだけを動かすことが必須です。
RAGは使わない
埋め込みモデルとLLMを併用するには容量が足りません。ドキュメントを使わないシンプルなチャットにとどめてください。

#推奨アップグレード

RTX 3060 12GB(中古、価格は変動あり)
最も費用対効果の高いアップグレードです。VRAMが200%増え、14Bモデルを使えるようになります。LLM向けとしては、可能な限り最良のアップグレードです。
RTX 5050 8 GB(新品価格は要確認、追跡対象外)
新品を選びたい場合に。VRAM は 100%増、FP4 対応で将来にも備えられます。
Mac mini M4 16 GB(通常は M5/M6 に置き換えられていますが、要確認)
プラットフォームを変更する場合の選択肢。ユニファイドメモリを搭載し、静かに動作します。

#よくある質問

4GBのVRAMで7〜8Bモデルを実行することは可能ですか?+
快適には動かせません。Granite 4.2 8B Q4(5.3GB)のような2026年の8Bモデルは、VRAM容量を超えてしまいます。Granite 4.2 3B Q4(2.2GB)にとどめてください。品質も速度も十分です。
4GBのVRAMで最も適したLLMはどれですか?+
Granite 4.2 3B Q4_K_M または Qwen 3.5 4B Q4。2026年の優れた小型モデルで、2年前の7Bモデルと比べて品質がはるかに優れています。
GTX 1650 4GBでローカルAIを体験できるのでしょうか?+
はい、2B〜3Bのモデルなら十分です。Ollamaをインストールすれば、Granite 4.2 3Bと25〜30トークン/秒で対話できます。入門には十分です。
GPUは必ず必要ですか?CPUのみで十分でしょうか?+
最近のCPU(Ryzen 5 7600以上、Core i5第13世代以降)では、Granite 4.2 8B Q4は5~10トークン/秒で動作します。遅いですが実用にはなります。メモリ4GBのGPUでは3Bモデルで約20トークン/秒が得られるため、こちらのほうがお勧めです。
4 GBのVRAMでRAGは可能でしょうか?+
快適に使うのは難しいです。埋め込みモデルBGE-M3(約2GB)+3BのLLM(約2GB)でメモリ容量を使い切ります。シンプルなチャットにとどめるか、8GB以上に増やしてください。
このガイドは役に立ちましたか?

ご意見、誤りのご指摘、補足はありますか?ぜひお知らせください。皆さんにとってより良いガイドにするために役立ちます。