重要なポイント
- Intel Arc B580 12GBが多くのユーザーに最適:12GB VRAM、約¥58,000〜67,000、Llama 3.1 8B Q4で約31トークン/秒 — $500相当以下で安定入手できる唯一の新品12GBカード
- 中古RTX 3060 12GB(約¥42,000〜47,000)が次点 — フルCUDAツールチェーンへの最安ルート
- ⚠️ 価格警告:前回1位のRTX 4060 Ti 16GBは希望小売価格$399で在庫がなく、入手可能な個体は約$562 — $500相当以下リストから除外
- ⚠️ 価格警告:新品RTX 3060 12GBは$474〜599(約¥74,000〜94,000)、再発売時から45%上昇 — このカードは中古市場が現実的
- ⚠️ 価格警告:中古RTX 3090は現在 約¥142,000〜162,000、RTX 4070 12GBは約¥90,000 — いずれも$500相当以下リストから除外
- ⚠️ 価格警告:RX 7800 XT 16GBは現在 約¥120,000 — $500相当以下リストから除外
- なぜ全部動いたのか:AIデータセンター需要が牽引する世界的なDRAM・GDDR7不足により、グラフィックスカードの実売価格が市場全体で定価を大きく上回りました。ハードウェアは何も変わっていません。変わったのは価格だけです。30Bモデルが必要なら中古RTX 3090(24GB)に¥150,000以上を見込んでください。
- リスト上の3機種はいずれもOllama・LM Studio・llama.cppをそのまま動作
500ドル以下LLM推論GPUランキング
📍 一文で説明
Intel Arc B580 12GBが500ドル以下のローカルLLM推論で最良のGPUです。2026年のメモリ不足の後、$500相当以下で安定して入手できる唯一の新品12GBカードだからです。
💬 簡潔に説明
GPU VRAMはどのAIモデルをローカルで実行できるかを決定します。16GBで14Bモデル対応。24GB(中古RTX 3090)で30Bモデル対応。12GB未満だと7Bモデルのみです。
Intel Arc B580 12GB — 総合1位 (約¥58,000〜67,000)
Intel Arc B580 12GBが$500以下のローカルLLM推論で最良のGPUです。理由の大部分は、この枠に確実に残った最後の1枚だからです。 米国では$249で発売され、いまも$250〜290で販売されています。一方、かつてこのリストを占めていたNVIDIAカードは、2026年のメモリ不足ですべて$500を超えました。SYCL/oneAPIバックエンドによりLinux・WindowsでOllamaが動作し、Llama 3.1 8B Q4で約28〜35トークン/秒です。12GB VRAMの上限により13B Q4までに制限され、14B Q8は収まりません。Intelのドライバーサポートは発売時から大きく改善しましたが、ツールの幅ではまだCUDAに及びません。Ollamaとllama.cppは問題なく動作し、LoRAファインチューニングは扱いにくいと考えてください。
中古RTX 3060 12GB — CUDA最良の選択肢 (約¥42,000〜47,000)
NVIDIA GeForce RTX 3060 12GBはフルCUDAツールチェーンへの最安ルートですが、中古で買ってください。¥52,980での小売復帰は続きませんでした。新品は約45%上昇して$474〜599(約¥74,000〜94,000)となり、このページが扱う$500の上限に並ぶか超えています。中古市場の動きははるかに小さく、約¥42,000〜47,000です。12GB GDDR6は7B–13BモデルをQ4/Q8で快適に動かします。14B Q8は収まりませんが、14B Q4(約8.5GB)なら入ります。ベンチマークはOllamaでLlama 3.1 8B Q4が約32〜40トークン/秒。フルCUDAツールチェーンにより、Ollama、LM Studio、vLLM、LoRAファインチューニングがWindows・Linuxでそのまま動作します——Arc B580に真似できない唯一の点です。
RTX 4060 Ti 16GB — 最良のカード、希望小売価格で見つかれば ($399希望小売、在庫時 約$562/約¥117,000)
RTX 4060 Ti 16GBはこのリストで最良の*ハードウェア*であり続けており、2026年のメモリ不足まではこのページの1位でした。16GB GDDR6はQwen3 14BとMistral 12BをQ4で完全にGPU内実行し、Q8でもスワップなしで動作します。Ollamaで7B Q4が45〜60トークン/秒、14B Q8が18〜25トークン/秒、TDPは165Wで650W電源なら余裕です。問題は買えないことです。希望小売価格$399の出品は大手小売で在庫切れで、確認できる最安の在庫品は約$562、定価より約41%高い水準です。希望小売価格かそれに近い値で見つかればこのページで断然best buyですが、$562ではこのページが想定する予算から外れます。
性能比較 — 現在価格 + テスト結果
ベンチマークはOllama 0.30.x、llama.cppサーバー、HuggingFaceのモデルで測定。テストシステム:Ryzen 9 7950X、64GB DDR5、NVMe SSD。速度は以前のテストから変わっていません。動いたのはハードウェアではなく価格です。$500相当超のため除外:中古RTX 3090($850〜1,050)、RTX 4070 12GB($560〜705)、RX 7800 XT 16GB(約$832)、新品RTX 3060 12GB($474〜599)。
GPU | VRAM | 価格 | Llama 3.1 8B Q4 トークン/秒 | Qwen3 14B Q8 トークン/秒 | 最大モデル(Q4) |
|---|---|---|---|---|---|
| Intel Arc B580 12GB ★ | 12GB | 約¥58,000〜67,000 | 31トークン/秒 | VRAM制限あり | — |
| RTX 3060 12GB(中古) | 12GB | 約¥42,000〜47,000 | 36トークン/秒 | VRAM制限あり | — |
| RTX 4060 Ti 16GB | 16GB | 在庫時 約¥117,000 | 55トークン/秒 | 22トークン/秒 | — |
これらのGPUを選定・テストした方法
選定基準:新品または中古で$500相当以下で購入可能なこと;主要な推論ランタイム(Ollama、LM Studio、llama.cpp)の少なくとも1つに対応していること;VRAM 12GB以上(8GBカードは除外)。価格を理由に複数のカードがリストから外れました。中古RTX 3090(24GB)は$850〜1,050、RTX 4070 12GBは$560〜705、RX 7800 XT 16GBは約$832、そして¥52,980で再発売された新品RTX 3060 12GBは約45%上昇して$474〜599です。RTX 4060 Ti 16GBは残していますが注意付きです——希望小売価格$399の出品は在庫切れで、入手可能な個体は約$562です。原因はすべて共通で、AIデータセンター需要が牽引する世界的なDRAM・GDDR7不足により、実売価格が市場全体で定価を大きく上回りました。NVIDIAのRTX 50シリーズは希望小売価格より約36〜39%高く取引され、AMDもRadeonを約10%引き上げています。ベンチマークはすべてバッチサイズ1で10回実行の平均トークン/秒、Ubuntu 22.04 LTS上のOllama 0.30.xで測定。
モデルサイズ別のVRAM要件
📍 一文で説明
VRAM要件:7Bモデルは約4〜5GB(Q4)または約7〜8GB(Q8);14Bモデルは約8〜9GB(Q4)または約14〜15GB(Q8);30Bモデルは約18〜20GB(Q4);70Bモデルは約40〜42GB(Q4)が必要です。
💬 簡潔に説明
VRAMはAIモデル用のRAMのようなものと考えてください。高速な推論には、モデル全体がVRAMに収まる必要があります。CPU RAMに溢れる場合(「オフロード」と呼ばれます)、速度が80〜95%低下します。Q4量子化はQ8と比べてサイズを半分にし、品質への影響はわずかです。
- 7BモデルのQ4:約4.5GB VRAM——このリストのどのGPUでも簡単に扱えます
- 7BモデルのQ8:約7.5GB VRAM——ここに挙げたすべてのGPUに収まります
- 13BモデルのQ4:約8.5GB VRAM——このリストのすべてのGPUに収まります
- 14BモデルのQ8:約14GB VRAM——RTX 4060 Ti 16GBと中古RTX 3090のみ対応。ただしどちらも$500相当以下ではありません
- 30BモデルのQ4:約18GB VRAM——RTX 3090(24GB)のみ余裕を持って対応
- 70BモデルのQ4:約40GB——GPU2枚またはCPUオフロードが必要
どのGPUを買うべきですか?
主な用途に応じてこの選択ガイドを活用してください:
- $500以下の総合ベスト → Intel Arc B580 12GB(約¥58,000〜67,000)。$500相当以下で安定して入手できる唯一の新品12GBカード。7B–13BモデルをQ4実行、Llama 3.1 8B Q4で約31トークン/秒、SYCL経由でWindows・LinuxのOllamaに対応。
- 動作する最安のCUDAカード → 中古RTX 3060 12GB(約¥42,000〜47,000)。Ollama、LM Studio、vLLM、LoRAファインチューニングを含むフルCUDAツールチェーンが使えます。中古で買ってください。新品は$474〜599です。
- 希望小売価格で見つかるなら最良のハードウェア → RTX 4060 Ti 16GB。希望小売価格$399ならここにある他のどれよりも優れ、14B Q8をGPU内実行できます。ただし希望小売価格の出品は在庫切れで、入手可能な個体は約$562とこのページの予算外です。
- 30Bモデル対応が必要ですか? → $500相当以下の枠は2026年半ばに閉じ、再び開いていません。中古RTX 3090(24GB)は現在約¥142,000〜162,000です。
- Windowsユーザーで手間をかけたくない場合 → 中古RTX 3060 12GB。NVIDIA CUDAはLLM・ファインチューニング・マルチモーダルランタイムで最も幅広いWindowsツールチェーンサポートを提供し、中古3060はその最安の入口です。
GPU別ソフトウェア互換性
3機種すべてOllamaとllama.cppで動作します。差が出るのは高度なツールです:
GPU | Ollama | LM Studio | vLLM | Text Gen WebUI | CUDAファインチューニング |
|---|---|---|---|---|---|
| Intel Arc B580 12GB | ✅ (SYCL) | ⚠️ ベータ | ❌ | ⚠️ 一部対応 | ❌ |
| RTX 3060 12GB | ✅ | ✅ | ✅ | ✅ | ✅ |
| RTX 4060 Ti 16GB | ✅ | ✅ | ✅ | ✅ | ✅ |
消費電力とシステム要件
GPUの消費電力によって必要な電源とケースが決まります。LLM実行中はGPUが80〜100%の使用率を継続します——ゲームと異なりアイドルフレームがありません。
- RTX 4060 Ti 16GB:165W——550W以上の電源で動作;8ピンコネクタ1本
- RTX 3060 12GB:170W——550W以上の電源で動作;8ピンコネクタ1本
- Intel Arc B580 12GB:190W——650W以上の電源;標準8ピン
8GB VRAMはローカルLLMに十分ですか?
8GB VRAMはQ4量子化で7Bモデルに限定されます。13Bモデルは完全にVRAMに収まらず、14BモデルはCPU RAMへのオフロードが発生し速度が80〜95%低下します。2026年の実用的なローカルLLM利用には12GBが最低限、16GBが推奨です。
中古RTX 3090は今でも$500以下で買えますか?
いいえ。中古RTX 3090は$850〜1,050(約¥142,000〜162,000)で取引されています。まずLLM愛好家が24GB VRAMの価値を認識したことで上がり、次いで2026年のメモリ不足で再び上がりました。もはや$500相当以下の選択肢ではなく、その状態がしばらく続いています。30Bモデル(24GB VRAMが必要)に対応したいなら、中古RTX 3090に$850以上、または14B Q8をより高速に動かすなら中古RTX 4080 SUPER(16GB、約$850。品薄後の新品は約$1,600)を検討してください。
AMD GPUはローカルAIに使えますか?
はい、条件付きで。Linux上のOllama(ROCm)はRX 7800 XTでうまく動作します。WindowsのROCmサポートは改善中ですが手動設定が必要です。LoRAファインチューニングはほとんどのツールでAMDをサポートしていません。価格に関する注意:RX 7800 XT 16GBは2026年7月時点で約¥120,000に上昇したため、もはや$500相当以下の予算には収まりません——その価格帯では、RTX 4060 Ti 16GBまたはRTX 3060 12GB(いずれもNVIDIA/CUDA)が推奨の選択肢です。Windowsやファインチューニングを行うならNVIDIAを選んでください。
AI用のIntel Arc GPUはどうですか?
Intel Arc B580 12GBは2026年のベストなArc選択肢であり、メモリ不足がNVIDIA勢を再価格付けした結果、このページ全体でも最良のカードになりました。SYCLバックエンドでWindowsとLinuxの両方でOllamaを実行でき、性能は生のトークン/秒でNVIDIAより30〜40%低くなります。コストパフォーマンスは「強い」を通り越して決定的です。同等のNVIDIAカードが$474〜599のところ、12GB VRAMが$250〜290です。主な制約はいまもソフトウェアで、vLLM、ファインチューニング系ツール、マルチモーダルランタイムはArcを十分にサポートしていません。LoRAファインチューニングが必要なら中古のRTX 3060 12GBを選んでください。
$500以下のGPU1枚で70Bモデルを実行できますか?
フル速度では不可能です。RTX 3090(24GB)でさえ、70B Q4(約40GB)を完全にVRAMに収めることはできません。llama.cppのCPUオフロードを使えばGPU VRAMとシステムRAMにモデルを分割できますが、速度は2〜5トークン/秒まで低下し、対話的な用途には遅すぎます。70Bモデルを実用的な速度で実行するには、GPU2枚(RTX 3090×2枚で計48GB)またはクラウド推論が必要です。
新しいGPU(RTX 5060 Ti)はこれらを時代遅れにしますか?
RTX 5060 Ti 16GBはすでに発売され、RTX 4060 Tiを下回るどころか逆になりました。希望小売価格$429で登場し、現在は約$800(直近の中央値$805)、定価より約88%高い水準で売られています。このリスト全体を再価格付けしたのと同じメモリ不足が、現行世代カードである同機を最も強く直撃したためです。16GB VRAMとより高速な推論を備え、ここにあるどれよりも実際に優れたGPUですが、$500以下のカードではなく、そうなるのを待つのは現実的な計画ではありません。いま買えるもので判断してください。Intel Arc B580 12GBが$250〜290、CUDAが必要なら中古RTX 3060 12GBが$270〜300です。
中古のRTX 4060 Ti 16GBはいくらですか?
中古のRTX 4060 Ti 16GBは新品の値上がりに追随しています。在庫のある新品が約$562のため、中古の出品はeBayで概ね$420〜480、状態や保証残存期間により変動します。希望小売価格の新品供給が枯れたため、中古で買っても大きな節約にならない数少ないカードの1つです。
