Skip to main content
PromptQuorum
Startseite/Lokale LLMs Pro/Lokale KI-Bilder sind kostenlos. Cloud-KI-Bilder sind sofort da. Ihre GPU entscheidet.
Image & Video Generation

Lokale KI-Bilder sind kostenlos. Cloud-KI-Bilder sind sofort da. Ihre GPU entscheidet.

·10 Min. Lesezeit·Von Hans Kuepper · Gründer von PromptQuorum, Multi-Model-AI-Dispatch-Tool · PromptQuorum

Für die meisten Menschen mit einer GPU ab 8 GB ist Qwen-Image der sicherste lokale Einstieg — Apache 2.0, keine Umsatzgrenzen, keine Gebietsbeschränkungen und die stärkste Textwiedergabe innerhalb von Bildern unter allen offenen Modellen. FLUX.1 schnell ist am schnellsten und leichtesten (ebenfalls Apache 2.0), während FLUX.1/2 dev und Kontext für die kommerzielle Nutzung eine kostenpflichtige Lizenz von Black Forest Labs benötigen — offene Gewichte bedeuten bei diesen Varianten nicht automatisch kommerziell kostenlos. Stable Diffusion 3.5 hat das umfangreichste LoRA- und Style-Ökosystem, deckelt die kostenlose kommerzielle Nutzung aber bei 1 Million US-Dollar Jahresumsatz. Wenn Sie keine GPU besitzen oder für Kundenarbeit kommerziell sichere Garantien zu den Trainingsdaten benötigen, ist ein Cloud-Dienst wie Adobe Firefly die praktischere Wahl.

Offene Bildmodelle laufen mittlerweile problemlos auf handelsüblichen Consumer-GPUs — FLUX, Stable Diffusion 3.5 und Qwen-Image erzeugen Bilder lokal, ohne Abonnement und ohne Kosten pro Bild. Cloud-Dienste tauschen diesen Aufwand gegen einen browserbasierten Workflow mit kommerziellen Sicherheitsgarantien und ganz ohne Hardware-Anforderungen. Dieser Leitfaden vergleicht die führenden lokalen Modellfamilien nach Lizenzbedingungen, VRAM-Anforderungen und realen Anwendungsfällen und stellt anschließend zwei Cloud-Dienste vor, die ihr Geld wert sind — inklusive des Kleingedruckten zu Lizenzen und Preisen, das die meisten Vergleiche auslassen.

Diese Seite enthält Verweislinks zu Produkten von Drittanbietern. PromptQuorum ist an keinem Partnerprogramm beteiligt — es sind reine Referenzlinks, die keine Provision erzielen. Das Anklicken von Links und Ihre nächsten Schritte liegen in Ihrer eigenen Verantwortung. Diese Links stellen keine Billigung oder Verifizierung durch PromptQuorum dar.

Lokale KI-Bilder sind kostenlos. Cloud-KI-Bilder sind sofort da. Ihre GPU entscheidet.

Wichtigste Erkenntnisse

  • Qwen-Image ist das einzige lokale Spitzenmodell für Bilder ohne jede Lizenzeinschränkung und mit der besten Textwiedergabe. Apache 2.0, keine Umsatzgrenzen, keine Gebietsausschlüsse — und lokal führend bei lesbarem, korrekt geschriebenem Text innerhalb von Bildern.
  • Die Lizenz von FLUX ist je nach Variante unterschiedlich. FLUX.1 schnell steht unter Apache 2.0 (uneingeschränkte kommerzielle Nutzung); FLUX.1/2 dev und Kontext nutzen die nicht-kommerzielle Lizenz von Black Forest Labs — für die kommerzielle Nutzung ist eine kostenpflichtige Lizenz erforderlich.
  • Stable Diffusion 3.5 hat das umfangreichste lokale Ökosystem (LoRAs, ControlNets, Tutorials), deckelt die kostenlose kommerzielle Nutzung mit seiner Community License aber bei 1 Million US-Dollar Jahresumsatz.
  • 8 GB VRAM decken den Großteil des lokalen Angebots ab. Bilder brauchen deutlich weniger Hardware als Video — eine GPU, die bei der Videogenerierung an ihre Grenzen kommt, bewältigt die meisten Bildmodelle problemlos.
  • Adobe Firefly und getimg.ai sind die beiden Cloud-Dienste mit aktivem Partnerprogramm; Midjourney und ChatGPT betreiben keines — dieser Artikel kann durch ihre Empfehlung also nichts verdienen, unabhängig von ihrer Qualität.
  • Bei der Privatsphäre gibt es kein Gratis-Mittagessen. Der kostenlose Tarif von Ideogram veröffentlicht Bilder in einer öffentlichen Galerie; lokale Generierung ist standardmäßig privat.

Warum 2026 das Jahr ist, in dem lokale Bilder erwachsen wurden

Offene Bildmodelle haben aufgeholt — und in manchen Kategorien überholt. HiDream-O1, ein 8B-Modell, das im Mai 2026 unter der MIT-Lizenz veröffentlicht wurde, rangierte kurz nach Veröffentlichung unter den besten Open-Weight-Einträgen der Text-to-Image-Arena von Artificial Analysis — bei einem Bruchteil der Größe größerer Konkurrenten. Alibabas Qwen-Image gibt lesbaren Text innerhalb von Bildern besser wieder als die meisten Cloud-Tools. Und die Editing-Modelle — Qwen-Image-Edit, FLUX Kontext — ändern mittlerweile Objekte, Hintergründe und Text in bestehenden Fotos anhand einer einfachen Sprachanweisung, lokal und kostenlos.

Auch die Cloud-Seite hat ihre eigene 2026er-Geschichte: Der Markt konsolidierte sich auf wenige ernsthafte Anbieter, die Einstiegspreise fielen auf den Bereich von 8-10 $/Monat, und kommerziell sichere Trainingsdaten wurden für Geschäftskunden zu einem echten Unterscheidungsmerkmal. Beide Türen sind wirklich gut. Die Frage ist, welche zu Ihnen passt — und anders als bei Video ist die Hardware-Hürde bei Bildern niedrig genug, dass die lokale Tür für deutlich mehr Menschen realistisch ist.

Die lokale Tür: Drei kostenlose Modellfamilien

Alle drei laufen über ComfyUI (oder eine ähnliche lokale Oberfläche) auf Ihrer eigenen Maschine. Wie bei der Videogenerierung gilt: Dies sind Diffusionsmodelle, keine LLMs — sie laufen nicht in Ollama.

📍 In einem Satz

Qwen-Image ist 2026 das sicherste lokale Allround-Bildmodell — Apache 2.0, beste Textwiedergabe, keine Einschränkungen —, während FLUX bei Fotorealismus vorn liegt (mit Lizenz-Einschränkungen je nach Variante) und Stable Diffusion 3.5 bei der Ökosystemtiefe gewinnt.

💬 In einfachen Worten

Wenn Sie nur eine Antwort wollen: Besorgen Sie sich eine GPU ab 8 GB und nutzen Sie Qwen-Image. Es hat kein Lizenz-Kleingedrucktes und die beste Textwiedergabe unter allen offenen Modellen.

FamilieLizenzVRAMHerausragendes Merkmal
FLUX (Black Forest Labs)Gespalten — schnell ist Apache 2.0, dev/Kontext sind ohne kostenpflichtige Lizenz nicht-kommerziell8 GB (schnell) bis 24 GB (FLUX.2 dev)Fotorealismus-Benchmark; Kontext führt beim lokalen Editing
Stable Diffusion 3.5 + SDXL (Stability AI)Stability Community License — kostenlos unter 1 Mio. US-Dollar Umsatz8–12 GBUmfangreichstes lokales LoRA-/ControlNet-Ökosystem
Qwen-Image (Alibaba)Apache 2.0 — uneingeschränkt8 GB (GGUF) bis 24 GB (volle Präzision)Klassenbeste lesbare Textwiedergabe im Bild

Laden Sie diese Modelle nur aus den unten verlinkten offiziellen Repositories herunter — Drittanbieter-Seiten mit „kostenlosem Download" verpacken Modelle mit wer-weiß-was darin neu.

FLUX (Black Forest Labs) — der Fotorealismus-Benchmark, mit Lizenzstufen

Die FLUX-Familie ist der Standard für ernsthafte lokale Bildarbeit. FLUX.2 [dev] (32B) führt bei Fotorealismus und hoher Auflösung und kombiniert bis zu 10 Referenzbilder, während Charakter, Produkt und Stil konsistent bleiben. FLUX.1 [schnell] erzeugt Bilder in Qualität in 1–4 Schritten mit nur 8 GB VRAM. FLUX.1 Kontext ist lokal führend beim Bearbeiten bestehender Bilder.

Lizenz — lesen Sie diesen Teil sorgfältig: Die Familie ist gespalten. FLUX.1 [schnell] steht unter Apache 2.0 — uneingeschränkt, kommerzielle Nutzung eingeschlossen. FLUX.1/2 [dev] und Kontext nutzen die nicht-kommerzielle Lizenz von Black Forest Labs — der Einsatz in einem kommerziellen Produkt erfordert eine kostenpflichtige Lizenz von BFL. „Offene Gewichte" bedeutet hier nicht „kommerziell okay".

Hardware: 8 GB (schnell), 12–16 GB (dev/Kontext), 24 GB (FLUX.2 dev, GGUF Q4).

FLUX.1 schnell on Hugging FaceProduktlink · offengelegtFLUX.2 dev on Hugging FaceProduktlink · offengelegt

Stable Diffusion 3.5 + SDXL (Stability AI) — die Ökosystem-Karte

SD 3.5 (8B Large / 2.5B Medium) ist qualitativ nicht mehr die Nummer eins, hat aber etwas, das den anderen fehlt: das umfangreichste Ökosystem in der lokalen KI. Jahrelang gesammelte Community-LoRAs (kleine Zusatzdateien, die dem Modell einen Stil, einen Charakter oder einen Produkt-Look beibringen), ControlNets und Tutorials bedeuten: Was auch immer Sie erstellen wollen, jemand hat die Bausteine dafür wahrscheinlich schon gebaut.

Hardware: 8–12 GB je nach Variante; SDXL läuft problemlos mit 8 GB.

Lizenz: Stability Community License — kommerziell kostenlos, wenn Ihr Jahresumsatz unter 1 Million US-Dollar liegt; darüber benötigen Sie eine Enterprise License. Für Freiberufler und Kleinunternehmen kein Problem, in größerem Maßstab jedoch eine echte Einschränkung.

Stable Diffusion 3.5 on Hugging FaceProduktlink · offengelegt

Qwen-Image (Alibaba) — wirklich kostenlos und König der Textwiedergabe

Alibaba veröffentlichte Qwen-Image (20B) im August 2025 als Open Source unter Apache 2.0 — keine Umsatzschwellen, keine nicht-kommerziellen Klauseln, keine Gebietsspielchen. Seine Spezialität ist etwas, an dem die meisten Modelle noch scheitern: lesbarer, korrekt geschriebener Text innerhalb des Bildes, in mehreren Sprachen. Poster, Schilder, Infografiken, Thumbnails mit Überschriften — dafür ist dieses Modell gemacht.

Bonus: Qwen-Image-Edit führt präzise, promptbasierte Bearbeitungen an bestehenden Fotos durch — die Farbe eines Objekts ändern, einen Hintergrund austauschen, Text korrigieren — während alles andere erhalten bleibt.

Hardware: 8 GB (GGUF-quantisiert) bis 24 GB (volle Präzision). Lizenz: Apache 2.0 — das einzige Spitzenmodell für Bilder ohne jedes Kleingedruckte.

Qwen-Image on Hugging FaceProduktlink · offengelegtQwen-Image-Edit on Hugging FaceProduktlink · offengelegt

Einer zum Beobachten: HiDream-O1

Veröffentlicht im Mai 2026 unter der MIT-Lizenz — noch freizügiger als Apache 2.0 — rangierte HiDream-O1 (8B) kurz nach Erscheinen unter den besten Open-Weight-Einträgen der Text-to-Image-Arena von Artificial Analysis und konkurrierte dort mit Modellen, die ein Vielfaches seiner Größe haben. Es ist jung, das Ökosystem ist noch dünn, und langfristiger Support ist unbewiesen (dieses Ranking stammt zum Zeitpunkt des Schreibens aus einer einzigen Quelle — vor Übernahme als gesichert prüfen). Doch wenn sich der Trend fortsetzt, wird diese Liste innerhalb eines Jahres neu geschrieben.

HiDream-O1 on Hugging FaceProduktlink · offengelegt

Die Hardware-Hürde (niedriger als gedacht)

Falls unser Video-Artikel Sie von lokaler KI abgeschreckt hat, hier die gute Nachricht: Bilder sind schlicht ein deutlich leichteres Workload. Eine gebrauchte RTX 3060 12GB (ca. 250–300 €) deckt die ersten beiden Zeilen unten ab. Zum Vergleich: Bei der Videogenerierung gelten 24 GB als komfortable Einstiegsklasse.

Nicht sicher, wo Ihre Hardware einzuordnen ist? Diese Leitfäden rechnen es für Sie durch: VRAM-Rechner für exakte Anforderungen pro Modell, Wie viel VRAM brauchen Sie? für Übersichten über verschiedene Modellgrößen, Beste GPUs für lokale KI und Beste Budget-GPUs für Hardware-Empfehlungen sowie GPU vs. CPU vs. Apple Silicon für Plattformvergleiche.

Ihre GPUWas Sie ausführen können
8 GB VRAMFLUX.1 schnell, SD 3.5, SDXL, Qwen-Image (GGUF) — der Großteil des Angebots
12–16 GB VRAMFLUX.1 dev & Kontext, Qwen-Image in höherer Präzision
24 GB+ VRAMAlles, einschließlich FLUX.2 dev in voller Qualität

Grobe Hardwarekosten Stand August 2026: Eine gebrauchte RTX 3060 12GB kostet auf dem deutschen Gebrauchtmarkt (z. B. kleinanzeigen.de, eBay.de) etwa 250–300 €. GPU-Preise ändern sich — prüfen Sie die aktuellen Preise vor dem Kauf, statt sich über mehrere Monate hinweg auf diese Zahl zu verlassen.

Die DIY-Realität: Was „kostenlos" von Ihnen verlangt

Dieselbe Ehrlichkeit wie im Video-Artikel. Lokale Bildgenerierung bedeutet:

Die Einrichtung. ComfyUI oder eine ähnliche Oberfläche, Modelldateien in den richtigen Ordnern, gelegentliche Abhängigkeitsfehler. Ein Abend, keine Woche — Bild-Setups sind deutlich einfacher als Video —, aber trotzdem Ihr Abend.

Das Prompten. Kein eingebauter Prompt-Helfer, keine Stil-Presets, kein Content-Filter (volle Kontrolle — und volle Verantwortung). Sie schreiben die Prompts selbst. Unsere Leitfäden zu System-Prompts vs. User-Prompts und Prompt Engineering für lokale Modelle behandeln die Grundlagen, die sich direkt übertragen lassen.

Der Feinschliff. Upscaling, Gesichtskorrekturen, Batch-Organisation — separate Tools und Nodes, die Sie selbst auswählen. Wollen Sie einen konsistenten Charakter über 30 Bilder hinweg? Das ist LoRA-Training: machbar, dokumentiert, aber ein Projekt für sich.

Schwach (Ein-Satz-Prompt)

Eine Katze

Strukturiert (was Bildmodelle brauchen)

Studioporträt einer rothaarigen Katze mit einem winzigen gestrickten Schal, weiches Fensterlicht von links, geringe Schärfentiefe, Look eines 85mm-Objektivs, warme Herbsttöne, hohes Detail

Wofür KI-Bilder wirklich gut sind

Bevor Sie sich für eine Tür entscheiden, sollten Sie wissen, wofür Sie hindurchgehen. Die realistische Landkarte der Anwendungsfälle:

  • Content-Seiten und Blogs: Hero-Bilder, Artikel-Illustrationen, Social-Preview-Karten.
  • YouTube und Social Media: Thumbnails, Kanal-Grafiken, Post-Grafiken, Werbe-Creatives — inklusive schneller A/B-Varianten.
  • E-Commerce und Marketing: Produkt-Mockups, Lifestyle-Szenen, saisonale Varianten derselben Aufnahme.
  • Arbeitsmaterialien: Präsentationsgrafiken, Pitch-Deck-Grafiken, Konzept-Mockups.
  • Kreativprojekte: Buchcover, Konzeptkunst, Moodboards, Print-on-Demand-Designs.
  • Bearbeiten, nicht nur Erstellen: Mit Qwen-Image-Edit oder FLUX Kontext — Hintergründe austauschen, Objekte entfernen, Produktfotos umgestalten, Text in Grafiken korrigieren.

Zwei ehrliche Grenzen: KI-Bilder tun sich bei exakter Markenkonsistenz über große Stückzahlen hinweg noch schwer (lokale LoRAs helfen; Cloud-Tools holen auf), und alles, was echte Menschen, echte Produkte oder faktische Genauigkeit erfordert, braucht Fotografie statt Generierung.

Die Cloud-Tür: Zwei Dienste, die eine Überlegung wert sind

Wir haben Adobe Firefly und getimg.ai ausgewählt, weil sie die beiden häufigsten Cloud-Bedürfnisse wirklich abdecken: maximale kommerzielle Sicherheit und die einfachste Brücke von lokal zu Cloud. Midjourney und ChatGPT werden ebenfalls breit für Bildgenerierung genutzt, passen aber keinem der beiden Bedürfnisse so direkt — Firefly und getimg.ai sind für diesen Vergleich die nützlicheren Empfehlungen, kein Standard.

Adobe Firefly — die kommerziell sichere Wahl

Wollen Sie die kommerziell sichere Cloud-Option ausprobieren? Wenn Sie keine GPU haben oder keine lokalen Modelle verwalten wollen, probieren Sie Adobe Firefly, bevor Sie sich auf ein lokales Setup festlegen. Adobe Firefly ausprobieren →

Firefly wurde auf Adobe Stock und offen lizenzierten Inhalten trainiert — das heißt, Adobe hat es so konzipiert, dass Geschäftskunden kein Urheberrechtsrisiko erben — und integriert sich direkt in Photoshop und die übrige Creative Cloud. Wenn Kundenarbeit oder Markensicherheit Ihre Sorge ist, ist dies die Cloud-Tür. Eine kostenlose Testphase existiert, um es vor dem Kauf zu testen; kostenpflichtige Pläne starten bei $9.99/Monat für 2.000 generative Credits (Standard-Tarif). Am besten geeignet für: Profis, Agenturen und alle, deren Kunden fragen „ist das rechtlich sicher?"

Adobe FireflyProduktlink · offengelegt

getimg.ai — die Cloud-Version der lokalen Modelle

Wollen Sie lokale Modelle nutzen, ohne die GPU zu besitzen? getimg.ai gibt Ihnen über die Cloud Zugriff auf offene Modelle wie FLUX — ohne ComfyUI-Installation oder VRAM-Anforderungen. getimg.ai ausprobieren →

Hier die Wendung, die die meisten Vergleiche übersehen: getimg.ai betreibt dieselben offenen Modelle, die Sie lokal installieren würden — FLUX und Verwandte, über 20 Modelle in einer Oberfläche — nur eben auf deren GPUs statt auf Ihrer. Kein Setup, keine VRAM-Rechnerei, kommerzielle Rechte in jedem Tarif inbegriffen. Wenn Ihnen die lokale Tür gefällt, Ihre Hardware aber nicht mitspielt, ist dies die Brücke. Die Preisgestaltung ist seit Anfang 2026 ausschließlich kostenpflichtig (der kostenlose Tarif wurde eingestellt) — Einstieg ab $8/Monat bei jährlicher Abrechnung ($10/Monat bei monatlicher Abrechnung) für 3.000 Credits; höhere Tarife skalieren von dort aus weiter. Am besten geeignet für: lokal-interessierte Nutzer ohne GPU und alle, die Vielfalt bei offenen Modellen ohne die ComfyUI-Lernkurve wollen.

(Ehrenvolle Erwähnung: Ideogram — ein Cloud-Marktführer für Text im Bild, mit einem begrenzten kostenlosen Tarif, der Bilder in einer öffentlichen Galerie veröffentlicht, und kostenpflichtigen Plänen ab etwa $20/Monat.)

getimg.aiProduktlink · offengelegt

Cloud oder lokal: Welche Tür ist Ihre?

Keine GPU? Starten Sie mit der Cloud. Falls Sie sich immer noch unsicher sind, probieren Sie die kostenlose Testphase von Firefly oder nutzen Sie getimg.ai, um offene Modelle ohne Hardware-Kauf auszuprobieren. Adobe Firefly ausprobieren → · getimg.ai ausprobieren →

Die Kurzfassung, zugeordnet zu häufigen Situationen:

Ihre SituationEmpfehlung
Keine GPU oder unter 8 GB VRAMCloud: getimg.ai (offene Modelle, kein Setup) oder kostenlose Testphase von Adobe Firefly
Gelegentlich Bilder nötig, null Toleranz für SetupCloud: Adobe Firefly (am einfachsten) oder getimg.ai (größte Modellauswahl)
Text im Bild (Poster, Thumbnails)Lokal: Qwen-Image — oder Ideogram in der Cloud für Einzelaufträge
Kommerzielles Produkt im großen MaßstabLokal: Qwen-Image oder FLUX schnell (Apache 2.0) — vorher die 1-Mio.-Grenze von SD 3.5 und die nicht-kommerziellen Bedingungen von FLUX dev prüfen
Kundenarbeit, bei der rechtliche Sicherheit infrage stehtCloud: Adobe Firefly (kommerziell sichere Trainingsdaten)
Kundenarbeit, unveröffentlichte Produkte, datenschutzsensibelLokal — nichts verlässt Ihre Maschine
GPU ab 8 GB, hohes Volumen, 0 € GrenzkostenLokal: schnell für Geschwindigkeit, Qwen-Image für Text, SD 3.5 für Stile
Konsistenter Charakter/Stil über viele Bilder hinwegLokal mit LoRAs (SD 3.5/SDXL-Ökosystem)

In Aktion sehen

FAQ

Kann ich KI-Bilder mit 8 GB VRAM generieren?

Ja — problemlos. FLUX.1 schnell, SD 3.5, SDXL und quantisiertes Qwen-Image laufen alle mit 8 GB. Bilder sind deutlich leichter als Video; das ist der größte Unterschied zu unserem Video-Vergleich.

Welches lokale Bildmodell ist wirklich kostenlos für die kommerzielle Nutzung?

Qwen-Image und FLUX.1 schnell (beide Apache 2.0), plus HiDream-O1 (MIT). SD 3.5 ist nur unter 1 Million US-Dollar Jahresumsatz kommerziell kostenlos. Die Gewichte von FLUX dev/Kontext sind ohne kostenpflichtige Lizenz von Black Forest Labs nicht-kommerziell.

Welche Cloud-Bildtools haben einen kostenlosen Tarif?

Adobe Firefly bietet eine kostenlose Testphase (das genaue Credit-Kontingent variiert — prüfen Sie firefly.adobe.com für die aktuelle Zahl). Ideogram bietet einen begrenzten kostenlosen Tarif, bei dem Bilder in einer öffentlichen Galerie veröffentlicht werden. getimg.ai hat seinen kostenlosen Tarif Anfang 2026 eingestellt — es ist ausschließlich kostenpflichtig, ab $8/Monat bei jährlicher Abrechnung.

Können KI-Modelle lesbaren Text in Bilder einfügen?

Ja — das war einer der großen Durchbrüche 2025–2026. Qwen-Image führt lokal (mehrsprachig, unter anderem Englisch und Chinesisch); Ideogram ist eine starke Cloud-Option für textlastige Einzelaufträge.

Sind meine cloud-generierten Bilder privat?

Kommt auf den Dienst an. Manche kostenlosen Tarife (darunter der von Ideogram) veröffentlichen Generierungen standardmäßig in einer öffentlichen Galerie. Prüfen Sie vor der Generierung sensibler Inhalte die aktuellen Datenschutzbedingungen jedes Dienstes — lokale Generierung ist standardmäßig privat, da nichts Ihre Maschine verlässt.

Kann ich meine eigenen Fotos mit diesen Tools bearbeiten?

Ja. Lokal: Qwen-Image-Edit und FLUX Kontext ändern Objekte, Hintergründe, Farben und Text anhand einfacher Sprachanweisungen. In der Cloud leisten Adobe Fireflys Generative Fill (innerhalb von Photoshop) und die Editing-Endpunkte von getimg.ai dasselbe.

Muss ich Prompt Engineering beherrschen?

Bei Cloud-Tools nicht wirklich — konversationelle Anweisungen funktionieren. Bei lokalen Modellen verbessern strukturierte Prompts (Motiv, Stil, Licht, Bildaufbau) die Ergebnisse deutlich; das ist eine erlernbare Fähigkeit, kein Talent.

Lokal oder Cloud für ein kleines Unternehmen?

Wenn Sie unter etwa 200 Bilder im Monat generieren und keine GPU besitzen: Cloud — Adobe Firefly, wenn rechtliche Sicherheit zählt, getimg.ai für Modellvielfalt. Über diesem Volumen oder wenn Kundenvertraulichkeit eine Rolle spielt, kann sich eine gebrauchte GPU für rund 250-300 € zusammen mit Qwen-Image innerhalb weniger Monate amortisieren.

Muss ich bei der Verwendung dieser Tools die DSGVO beachten?

Bei Cloud-Diensten wie Adobe Firefly oder getimg.ai verlassen Ihre Prompts und Eingabebilder Ihr Gerät und werden auf fremden Servern verarbeitet — prüfen Sie vor der Nutzung mit personenbezogenen oder vertraulichen Daten die jeweiligen Datenverarbeitungsbedingungen der Anbieter (Auftragsverarbeitung nach Art. 28 DSGVO). Bei lokaler Generierung mit Qwen-Image, FLUX oder SD 3.5 verlässt nichts Ihre eigene Maschine — es gibt keine Datenübertragung an Dritte zu prüfen, was Datenresidenz-Anforderungen von vornherein erfüllt.

Eignet sich lokale KI-Bildgenerierung für den deutschen Mittelstand?

Ja, besonders für Kundenarbeit, unveröffentlichte Produkte oder datenschutzsensible Projekte, wie im Abschnitt zu Anwendungsfällen beschrieben. Eine gebrauchte GPU im Bereich von 250-300 € plus Qwen-Image (Apache 2.0, keine Umsatzgrenzen) deckt die meisten Anforderungen kleiner und mittlerer Unternehmen ab, ohne laufende Abo-Kosten oder die Notwendigkeit, Bilder zur Verarbeitung an einen Cloud-Anbieter zu senden.

Das Fazit

Gehen Sie den lokalen Weg, wenn Sie eine GPU ab 8 GB besitzen (oder kaufen werden), regelmäßig Bilder generieren und Wert auf Privatsphäre, keine Grenzkosten und volle kreative Kontrolle legen. Qwen-Image ist die sicherste Grundlage — Apache 2.0, klassenbeste Textwiedergabe — mit FLUX für Fotorealismus (auf die je nach Variante unterschiedliche Lizenz achten) und SD 3.5 für sein unerreichtes Style-Ökosystem.

Gehen Sie den Cloud-Weg, wenn Sie in den nächsten fünf Minuten ein Ergebnis wollen, nur gelegentlich generieren oder keine GPU besitzen. Adobe Firefly ist die sichere, professionelle Wahl mit kommerziell sicheren Trainingsdaten; getimg.ai ist die Brücke für alle, die die Idee offener Modelle mögen, aber nicht die Idee, sie selbst zu installieren.

Und wenn Video als Nächstes auf Ihrer Liste steht — das ist ein anderes Hardware-Gespräch. Lesen Sie den begleitenden Artikel: Lokale KI-Videogenerierung vs. Cloud.

Quellen

← Zurück zu Lokale LLMs Pro