Skip to main content
PromptQuorum

RTX 3060 12GB: Beste GPU unter 300 € für lokale LLMs (2026)?

Die gebrauchte NVIDIA RTX 3060 12 GB ist die beste GPU unter 300 € für lokale LLMs. Ihre 12 GB VRAM führen jedes 7B-Modell und die meisten 14B-Modelle bei Q4 aus, und NVIDIA CUDA läuft mit Ollama sofort — keine Treibersuche. Prüfen Sie den aktuellen Gebrauchtpreis statt einer alten Zahl zu vertrauen: eine Speicherknappheit 2026 hat die GPU-Preise steigen lassen, und die AMD RX 6700 XT (die übliche Budget-Alternative) ist nicht mehr spürbar günstiger.

RTX 3060 12GB: Beste GPU unter 300 € für lokale LLMs (2026)?

Diese Seite enthält Verweislinks zu Produkten von Drittanbietern. PromptQuorum ist an keinem Partnerprogramm beteiligt — es sind reine Referenzlinks, die keine Provision erzielen. Das Anklicken von Links und Ihre nächsten Schritte liegen in Ihrer eigenen Verantwortung. Diese Links stellen keine Billigung oder Verifizierung durch PromptQuorum dar.

Schnelle Antwort

Eine gebrauchte RTX 3060 12 GB ist die beste GPU unter 300 € für lokale LLMs — 12 GB VRAM führt alle 7B- und die meisten 14B-Modelle aus, und CUDA läuft mit Ollama ohne Einrichtung. Prüfen Sie den aktuellen Gebrauchtpreis statt einer alten Zahl — die GPU-Preise haben sich 2026 stark bewegt.

  • RTX 3060 12 GB läuft Llama 3 8B Q4_K_M mit ~25 tok/s und Qwen 14B Q4_K_M mit ~15 tok/s.
  • RX 6700 XT 12 GB bietet dieselbe VRAM-Kapazität, benötigt aber ROCm unter Linux — und ist zum Zeitpunkt dieser Prüfung nicht mehr spürbar günstiger als die RTX 3060.
  • GPUs mit 8 GB bei diesem Budget vermeiden — die VRAM-Grenze blockiert 14B-Modelle vollständig.
Hardware-SpecificFortgeschritten

Wichtigste Punkte

  • Beste Wahl: gebrauchte NVIDIA RTX 3060 12 GB — CUDA arbeitet sofort mit Ollama und llama.cpp
  • Alternative: gebrauchte AMD RX 6700 XT — dieselben 12 GB VRAM, aber ROCm-Einrichtung kostet Stunden, und ist 2026 nicht mehr spürbar günstiger
  • Beide Karten führen jedes 7B-Modell und die meisten 13B–14B-Modelle bei Q4 aus; keine reicht für ein 70B-Modell
  • Kaufen Sie die RTX 3060 in der 12-GB-Version — die 6-GB-Variante führt nur 3B-Modelle aus und sieht in Anzeigen identisch aus

Beste Wahl: gebrauchte NVIDIA RTX 3060 12GB

Die gebrauchte NVIDIA RTX 3060 12 GB ist die beste GPU unter 300 € für lokale LLMs, weil 12 GB VRAM plus CUDA-Unterstützung ohne Einrichtungsaufwand in Minuten ein funktionierendes LLM-System ergeben. Sie führt Mistral Small, Llama 3 8B und Qwen3 8B mit 15-20 Token pro Sekunde aus und die meisten 13B–14B-Modelle bei Q4.

Die RTX 3060 gewinnt bei der Software, nicht nur beim VRAM. Ollama und llama.cpp erkennen NVIDIA-GPUs unter Windows und Linux automatisch über CUDA — keine Treibersuche, kein ROCm. Die AMD RX 6700 XT erreicht dieselbe 12-GB-Kapazität, doch ihr Gebrauchtpreis hat sich zum Zeitpunkt dieser Prüfung dem der RTX 3060 angenähert — die Speicherknappheit 2026 hat den Preisunterschied verkleinert, der sie früher zur Budget-Wahl machte. Wählen Sie sie nur, wenn Sie Linux/ROCm bereits bevorzugen; die Ersparnis, die sie früher rechtfertigte, ist größtenteils weg.

Egal welche Karte Sie kaufen: Vermeiden Sie die 6-GB-Variante der RTX 3060 — sie sieht in Anzeigen identisch aus, passt aber nur für 3B-Modelle.

RTX 3060 12GB vs RX 6700 XT für lokale LLMs

Beide Karten haben 12 GB VRAM, die Modellkapazität ist also identisch — die eigentliche Entscheidung lautet CUDA gegen ROCm. Prüfen Sie vor dem Kauf die aktuellen Preise beider Karten; die Speicherknappheit 2026 hält die Gebrauchtpreise volatil und hat den früheren Preisunterschied zwischen den beiden bereits größtenteils eingeebnet.

GPUVRAMEinrichtungGeeignet für
RTX 3060 12 GB12 GBCUDA, sofortBeste Wahl — keine Reibung
RX 6700 XT12 GBROCm, StundenNur bei Linux/AMD-Präferenz

Was können Sie ausführen?

Ein 70B-Modell bei Q4 benötigt rund 40 GB VRAM, daher ist eine 12-GB-Karte in dieser Preisklasse nicht die richtige Hardware dafür — siehe die vollständige GPU-Kaufberatung unten für die Klassen, die größere Modelle unterstützen.

ModellgrößeUrteil
7B–8B🟢 Ausgezeichnet
13B–14B (Q4)🟢 Sehr praktikabel
20B+🟡 Speicher wird knapp
70B🔴 Nein

Weiterführende Artikel

Kurze Antworten zu GPUs unter 300 € für lokale LLMs

Kann eine 300-€-GPU lokale LLMs gut ausführen?
Ja. Eine gebrauchte RTX 3060 12 GB oder RX 6700 XT führt jedes 7B-Modell mit 15-20 Token pro Sekunde aus und die meisten 13B–14B-Modelle bei Q4-Quantisierung. Beide haben 12 GB VRAM — genug für allgemeinen Chat, Coding-Unterstützung und Zusammenfassung.
Warum die RTX 3060 statt der RX 6700 XT, wenn beide etwa gleich viel kosten?
Die RTX 3060 nutzt NVIDIA CUDA, das Ollama und llama.cpp automatisch ohne Einrichtung erkennen. Die RX 6700 XT benötigt ROCm — typischerweise Stunden unter Linux und unter Windows für schnelle Inferenz nicht unterstützt. Wenn beide Karten etwa gleich viel kosten, gibt es keine Ersparnis mehr, die diesen Zeitaufwand ausgleicht.
Soll ich die 6-GB- oder 12-GB-RTX 3060 kaufen?
Kaufen Sie die 12-GB-Version. Die 6-GB-RTX 3060 passt nur für 3B-Modelle, weit unter der 7B-Klasse, auf die dieses Budget zielt. Die Varianten sehen in Anzeigen identisch aus — den VRAM vor dem Kauf prüfen.
Kann eine GPU unter 300 € ein 70B-Modell ausführen?
Nein. Ein 70B-Modell bei Q4 benötigt rund 40 GB VRAM. Eine 12-GB-Karte schafft maximal 14B-Modelle bei Q4. Für größere Modelle brauchen Sie eine höhere Klasse oder einen Multi-GPU-Aufbau — siehe die vollständige GPU-Kaufberatung unten.