Skip to main content
PromptQuorumBuilt for humans. Structured for AI.

Qwen 3 は Ollama で動かせますか?

Qwen 3 は Ollama で動かせますか?

クイック回答

はい — Ollama は Qwen 3 の全モデルサイズ(0.6B〜32B)と 30B-A3B MoE バリアントに対応しています。ollama run qwen3:8b で任意のサイズを実行できます。8B モデルは Q4 で ~6 GB VRAM が必要です。

  • ▸ollama run qwen3:0.6b — 1 GB VRAM に収まります
  • ▸ollama run qwen3:8b — ~6 GB VRAM が必要
  • ▸ollama run qwen3:32b — ~21 GB VRAM が必要
Ollama

重要なポイント

  • ✓Ollama は Qwen 3 の全サイズ(0.6B、1.7B、4B、8B、14B、32B)と 30B-A3B MoE バリアントをサポートしています
  • ✓<code>ollama run qwen3:8b</code> で任意のサイズを取得できます — タグを目的のサイズに置き換えてください
  • ✓8B モデルは Q4 で ~6 GB VRAM が必要で、ミドルレンジ GPU で ~20 tok/s で動作します
  • ✓Qwen 3 は標準 Ollama API 経由でネイティブにツール呼び出しをサポートしています — カスタム Modelfile は不要です

はい — 利用可能な内容

Ollama は Qwen 3 の全主要モデルサイズ(0.6B〜32B)と 30B-A3B MoE バリアントをサポートしています。 単一コマンドで任意のサイズをダウンロードできます:ollama run qwen3:8b。他のサイズには 8b を 0.6b、1.7b、4b、14b、32b、または 30b-a3b に置き換えてください。

各サイズは複数の量子化形式で利用可能です。Q4_K_M がデフォルトで推奨の出発点です — 品質とファイルサイズの最良のバランスを提供します。VRAM に余裕がある場合、8B と 14B では Q8_0 も利用できます。

ツール呼び出しは標準 Ollama API を通じて全 Qwen 3 サイズでネイティブにサポートされています。カスタム Modelfile や特別なプロンプトテンプレートは必要ありません。

ollama run qwen3:8b

Qwen 3 のサイズ選択

最適な Qwen 3 のサイズは利用可能な VRAM によって完全に決まります。ミドルレンジ GPU(6〜8 GB VRAM)を持つほとんどのユーザーには、Q4_K_M の 8B モデルが実用的な選択です — ~6 GB が必要で ~20 tok/s で動作します。

Q4 の 14B モデルはコーディング向けの推奨ティアです:コード生成において 8B を上回り、10〜12 GB VRAM に快適に収まります。Qwen 3 のコーディング性能と他のローカルモデルの完全な比較については、2026年版 Qwen をローカルで実行するガイドをご覧ください。

VRAMQwen 3 サイズ用途
< 4 GB0.6B / 1.7Bエッジデバイス、テスト、CPU 専用
4–6 GB4Bバジェット GPU または低 RAM CPU
6–12 GB8B / 14B汎用およびコーディング
12–24 GB32B / 30B-A3B(MoE)高品質コーディングと推論

Ollama 上の Qwen 3 に関するよくある質問

Ollama に Qwen 3 をインストールするには?▾
ターミナルで ollama run qwen3:8b を実行してください。Ollama は初回起動時に自動的にモデルをダウンロードします。8b を目的のサイズに置き換えてください:0.6b、1.7b、4b、14b、32b、または 30b-a3b。
Qwen 3 はコーディングで Llama 3 より優れていますか?▾
コーディングに関しては:はい、Qwen3 14B は HumanEval ベンチマークで Llama 3 8B を上回ります。8B ティアでの一般的な会話では、Llama 3 8B は競争力を維持しています。全タスクの現在のトップ Ollama 推奨については、現在の最適 Ollama モデルをご覧ください。
Qwen 3 は Ollama でツール呼び出しをサポートしていますか?▾
はい。Qwen 3 は標準 Ollama API 経由でファンクション呼び出しとツール呼び出しをネイティブにサポートしています。カスタム Modelfile や特別な設定は不要です — Ollama のツール使用形式をサポートする任意のクライアントで動作します。
ローカルで実行できる最大の Qwen 3 モデルは?▾
最大の密な Qwen 3 モデルは 32B で、Q4 で ~21 GB の VRAM が必要です — RTX 3090 または RTX 4090 一枚に収まります。同等の品質でより高速な推論を求める場合、30B-A3B MoE バリアントは ~19 GB の VRAM しか必要とせず、トークンごとにパラメータの一部しか活性化しないため明らかに高速に動作します。32GB 以上のユニファイドメモリを持つ Apple M-series Mac ならどちらも快適に実行できます。