Qwen 3 235B-A22BvsDeepSeek R1 671B
徹底比較: Qwen 3 235B-A22B (235Bパラメータ、アリババ) および DeepSeek R1 671B (671B, DeepSeek). 量子化によるVRAM要件、4つの参照GPUで測定されたトークン/秒、使用ケースごとの評価、ライセンス、インストールコマンド。すべての数字はカタログデータから計算されています — ページ間のコピー貼り付けは行われていません。
要約
| 特徴 | Qwen 3 235B-A22B | DeepSeek R1 671B |
|---|---|---|
| パラメータ | 235B | 671B |
| ファミリー | Qwen | DeepSeek |
| 著者 | Alibaba | DeepSeek |
| 開発国 | CN | CN |
| ライセンス | Apache 2.0 | MIT |
| コンテキスト | 131,072トークン | 128 000 トークン |
| 公開日 | 2025年4月 | 2025年1月 |
メモリフットプリント
平均的なコンテキストウィンドウでの推論に必要なVRAMの概算値です。勝者(緑色)は消費量が 少なく、小規模モデルに有利です。
| 量子化 | Qwen 3 235B-A22B | DeepSeek R1 671B |
|---|---|---|
| Q4_K_M(軽量) | 142GB | 400GB |
| Q5_K_M(バランス型) | 170 GB | 480 GB |
| Q8(ほぼ無損失) | 250GB | 720GB |
| FP16(最高品質) | 470 GB | 1342 GB |
| CPUのみで実行する場合のRAM | 160 GB | 512 GB |
推定速度(トークン/秒)
各GPUで実行可能な最適な量子化に基づく推定値です。実際の数値はプロンプト、コンテキスト、エンジン(llama.cpp、vLLM、MLX)によって異なります。 方法論.
| 基準となるGPU | Qwen 3 235B-A22B | DeepSeek R1 671B |
|---|---|---|
| RTX 4090 (24 GB) | ✗ 重すぎる | ✗ 重すぎる |
| RTX 4080 (16 GB) | ✗ 重すぎる | ✗ 重すぎる |
| RTX 3060 12GB (12 GB) | ✗ 重すぎる | ✗ 重すぎる |
| Apple M4 Pro (48 GB) (36 GB) | ✗ 重すぎる | ✗ 重すぎる |
ユースケース別評価
一般的な用途ごとに、タグ、サイズ、専門性に基づいてどちらが最も適しているかを示します。
お使いのマシンで、プライベートかつ無料のChatGPTを1時間で構築 — LM Studio、Ollama、Open WebUI、ご自身のドキュメント、クラウド不要。
- 永久に利用できるオンラインスペース
- PDF + ファイル
- 生涯アップデート
強みと弱み
Qwen 3 235B-A22B
MoE 235B/稼働パラメータ22B(128エキスパート中8つが稼働)。AIME 2024 85.7、LiveCodeBench 70.7。
- 当時最も優れたオープンMoEモデル
- 有効パラメータ数22B → 規模の割に高速
- AIME 2024 85.7
- Q4で最低142GB
- 複数GPU構成またはMac Studioでの運用が必須
インストール
DeepSeek R1 671B
MoE 671B/37B、MIT。代表的なオープン推論モデル。MATH-500 97.3、AIME 79.8、MMLU 90.8。
- MITライセンス
- 代表的なオープン推論モデル
- MATH-500 97.3
- Q4では400GB以上必要となり、標準のラップトップやワークステーションでは扱えません
- 本格的なワークステーションまたはサーバー向け
インストール
よくある質問
RTX 4090(24 GB)でより快適に動作するのは、Qwen 3 235B-A22BとDeepSeek R1 671Bのどちらですか?
RTX 4090上で、Qwen 3 235B-A22Bは24GBでは動作せず、一部をCPUにオフロードする必要があります。DeepSeek R1 671Bも24GBでは動作せず、同様の対応が必要です。詳細は、 構成ツール で、お使いのGPUの機種を指定して試してみてください。
VRAM消費が最も少ないのはどれか?
Q4_K_M の場合、 Qwen 3 235B-A22B 収まる容量 142GB に対して、400GB の競合モデルとの差は258GBあり、RTX 3060または4060 Ti 8GBをターゲットにしている場合、これは顕著な差です。
これらのモデルは商用の本番環境で使用できますか?
Qwen 3 235B-A22B は Apache 2.0 ライセンスで公開されており、商用利用も自由です。 DeepSeek R1 671B はMITライセンスで、こちらも商用利用が自由です。SaaS用途では、Apache 2.0またはMITを優先してください。
2026 年にどれを選ぶべきか?
主な制約条件によります。 より小さい / より高速 : Qwen 3 235B-A22B (235B)です。 より高性能 : DeepSeek R1 671B (671B)。迷っている場合は、実行してください。 構成ツール お使いのGPUとユースケースに基づいて判断します。
検討すべき代替案
どちらもご希望に合わない場合は、検討できる類似モデルを以下に紹介します。