ホーム › 比較ツール › Qwen 3.6 35B-A3BとQwen 3 30B-A3Bの比較

Qwen 3.6 35B-A3BvsQwen 3 30B-A3B

徹底比較: Qwen 3.6 35B-A3B (35Bパラメータ、Alibaba) および Qwen 3 30B-A3B (30B、Alibaba)。量子化方式ごとの必要VRAM、4種類の基準GPUで測定したトークン/秒、用途別の評価、ライセンス、インストールコマンド。すべての数値はカタログデータから計算されており、ページ間のコピー&ペーストは一切ありません。

要約

特徴 Qwen 3.6 35B-A3B Qwen 3 30B-A3B
パラメータ 35B 30B
ファミリー Qwen Qwen
著者 Alibaba Alibaba
開発国 CN CN
ライセンス Apache 2.0 Apache 2.0
コンテキスト 262,000トークン 131,072トークン
公開日 2026年4月 2025年4月

メモリフットプリント

平均的なコンテキストウィンドウでの推論に必要なVRAMの概算値です。勝者(緑色)は消費量が 少なく、小規模モデルに有利です。

量子化 Qwen 3.6 35B-A3B Qwen 3 30B-A3B
Q4_K_M(軽量) 21 GB 19 GB
Q5_K_M(バランス型) 25 GB 23 GB
Q8(ほぼ無損失) 38GB 35 GB
FP16(最高品質) 70 GB 62 GB
CPUのみで実行する場合のRAM 28 GB 32 GB

推定速度(トークン/秒)

各GPUで実行可能な最適な量子化に基づく推定値です。実際の数値はプロンプト、コンテキスト、エンジン(llama.cpp、vLLM、MLX)によって異なります。 方法論.

基準となるGPU Qwen 3.6 35B-A3B Qwen 3 30B-A3B
RTX 4090 (24 GB) 60トークン/秒 · Q4_K_M 100 tok/s · Q5_K_M
RTX 4080 (16 GB) ✗ 重すぎる ✗ 重すぎる
RTX 3060 12GB (12 GB) ✗ 重すぎる ✗ 重すぎる
Apple M4 Pro (48 GB) (36 GB) 22トークン/秒 · Q5_K_M 40 tok/s · Q8

ユースケース別評価

一般的な用途ごとに、タグ、サイズ、専門性に基づいてどちらが最も適しているかを示します。

一般チャット
接戦 — 具体的な条件によって変わります。 この基準では両者同等です。VRAMやライセンスの制約に応じて判断してください。
開発 / コーディング
Qwen 3.6 35B-A3Bが勝ります。 コードに特化したモデルで、HumanEval と MBPP でより優れた成績。
推論 / 数学
接戦 — 具体的な条件によって変わります。 この基準では両者同等です。VRAMやライセンスの制約に応じて判断してください。
RAG / 長い文書
接戦 — 具体的な条件によって変わります。 この基準では両者同等です。VRAMやライセンスの制約に応じて判断してください。
エージェント & ツール使用
接戦 — 具体的な条件によって変わります。 この基準では両者同等です。VRAMやライセンスの制約に応じて判断してください。
ローカルAIキット

お使いのマシンで、プライベートかつ無料のChatGPTを1時間で構築 — LM Studio、Ollama、Open WebUI、ご自身のドキュメント、クラウド不要。

  • 永久に利用できるオンラインスペース
  • PDF + ファイル
  • 生涯アップデート

強みと弱み

Alibaba · 35B

Qwen 3.6 35B-A3B

エージェント型コーディング向けのMoE。総パラメータ35B、アクティブ3B。SWE-Bench 73.4%。2026年4月16日リリース。

  • 73.4% SWE-Bench
  • Q4で24 GBのGPU上で動作
  • Apache 2.0
  • Ollamaの公式タグはまだありません

インストール

ollama run qwen3.6:35b-a3b
Alibaba · 30B

Qwen 3 30B-A3B

MoE、総パラメータ数 30B/アクティブパラメータ数 3B、ハイブリッド思考。MMLU 81.4、AIME24 80.4。100以上の言語に対応。

  • アクティブパラメータが3Bなので高速
  • MMLU 81.4
  • AIME24 80.4
  • Apache 2.0
  • Q4で 19 GB

インストール

ollama run qwen3:30b-a3b

よくある質問

RTX 4090(24 GB)でより快適に動作するのは、Qwen 3.6 35B-A3BとQwen 3 30B-A3Bのどちらですか?

RTX 4090上でQwen 3.6 35B-A3Bは Q4_K_M (~60 tok/s)、Qwen 3 30B-A3B で Q5_K_M (約100 tok/s)。純粋なスループットでは、 Qwen 3 30B-A3B が優位です。 構成ツール で、お使いのGPUの機種を指定して試してみてください。

VRAM消費が最も少ないのはどれか?

Q4_K_M の場合、 Qwen 3 30B-A3B 収まる容量 19 GB に対して、21 GB の競合製品 — 2 GB の差。RTX 3060 や 4060 Ti 8 GB を目指すなら有意な差。

コーディングにはQwen 3.6 35B-A3BとQwen 3 30B-A3Bのどちらを選ぶべきですか?

Qwen 3.6 35B-A3B が最も適しています(コード特化、HumanEval 最高スコア)。IDE コパイロットとして使用する場合は、と組み合わせる Continue またはAider。

これらのモデルは商用の本番環境で使用できますか?

Qwen 3.6 35B-A3B は Apache 2.0 ライセンスで公開されており、商用利用も自由です。 Qwen 3 30B-A3B は Apache 2.0 ライセンスで公開されており、こちらも自由に利用できます。SaaS には Apache 2.0 または MIT を優先してください。

2026 年にどれを選ぶべきか?

主な制約条件によります。 より小さい / より高速 :Qwen 3 30B-A3B (30B)。 より高性能 : Qwen 3.6 35B-A3B (35B)。迷っている場合は、 構成ツール お使いのGPUとユースケースに基づいて判断します。

検討すべき代替案

どちらもご希望に合わない場合は、検討できる類似モデルを以下に紹介します。

さらに詳しく