Skip to main content
PromptQuorum
Inicio/LLM locales avanzados/Las imágenes con IA local son gratis. Las de la nube son instantáneas. Tu GPU decide.
Image & Video Generation

Las imágenes con IA local son gratis. Las de la nube son instantáneas. Tu GPU decide.

·10 min de lectura·Por Hans Kuepper · Fundador de PromptQuorum, herramienta de despacho multi-modelo · PromptQuorum

Para la mayoría de las personas con una GPU de 8GB o más, Qwen-Image es el punto de partida local más seguro — Apache 2.0, sin límites de ingresos, sin restricciones de territorio, y el mejor renderizado de texto dentro de la imagen de cualquier modelo abierto. FLUX.1 schnell es el más rápido y ligero (también Apache 2.0), mientras que FLUX.1/2 dev y Kontext requieren una licencia de pago de Black Forest Labs para uso comercial — pesos abiertos no significa comercialmente gratis para esas variantes. Stable Diffusion 3.5 tiene el ecosistema de LoRA y estilos más profundo, pero limita el uso comercial gratuito a $1M de ingresos anuales. Si no tienes GPU, o necesitas garantías de datos de entrenamiento comercialmente seguros para trabajo con clientes, un servicio en la nube como Adobe Firefly es la opción más práctica.

Los modelos de imagen abiertos ya funcionan cómodamente en GPU de consumo — FLUX, Stable Diffusion 3.5 y Qwen-Image generan imágenes localmente sin suscripción y sin coste por imagen. Los servicios en la nube cambian esa configuración por un flujo de trabajo desde el navegador, con garantías de seguridad comercial y sin requisitos de hardware. Esta guía compara las principales familias de modelos locales en términos de licencia, requisitos de VRAM y casos de uso reales, y luego repasa dos servicios en la nube que vale la pena pagar — con la letra pequeña de las licencias y los precios que la mayoría de comparativas se saltan.

Esta página contiene enlaces de referencia a productos de terceros. PromptQuorum no participa en ningún programa de afiliados — son enlaces simples que no generan comisión. Hacer clic en los enlaces y los pasos siguientes son de su entera responsabilidad. Estos enlaces no representan ningún respaldo ni verificación por parte de PromptQuorum.

Las imágenes con IA local son gratis. Las de la nube son instantáneas. Tu GPU decide.

Conclusiones clave

  • Qwen-Image es el único modelo de imagen local de primer nivel sin restricciones de licencia y con el mejor renderizado de texto. Apache 2.0, sin límites de ingresos, sin exclusiones de territorio — y el líder local en texto legible y correctamente escrito dentro de las imágenes.
  • La licencia de FLUX está dividida por variante. FLUX.1 schnell es Apache 2.0 (uso comercial sin restricciones); FLUX.1/2 dev y Kontext usan la licencia no comercial de Black Forest Labs — se necesita una licencia de pago para usarlos comercialmente.
  • Stable Diffusion 3.5 tiene el ecosistema local más profundo (LoRAs, ControlNets, tutoriales), pero su Licencia Comunitaria limita el uso comercial gratuito a $1M de ingresos anuales.
  • 8GB de VRAM cubre la mayor parte del menú local. Las imágenes necesitan mucho menos hardware que el vídeo — una GPU que tiene problemas con la generación de vídeo maneja la mayoría de los modelos de imagen sin dificultad.
  • Adobe Firefly y getimg.ai son los dos servicios en la nube con programas de afiliados activos; Midjourney y ChatGPT no tienen ninguno, así que este artículo no puede ganar nada recomendándolos, independientemente de sus méritos.
  • No hay almuerzo gratis en cuanto a privacidad. El nivel gratuito de Ideogram publica las imágenes en una galería pública; la generación local es privada por defecto.

Por qué 2026 es el año en que las imágenes locales se pusieron serias

Los modelos de imagen abiertos se han puesto al día — y en algunas categorías, se han adelantado. HiDream-O1, un modelo de 8B lanzado bajo licencia MIT en mayo de 2026, se situó entre las mejores entradas de pesos abiertos en la arena de texto a imagen de Artificial Analysis, con una fracción del tamaño de rivales más grandes. Qwen-Image de Alibaba renderiza texto legible dentro de las imágenes mejor que la mayoría de las herramientas en la nube. Y los modelos de edición — Qwen-Image-Edit, FLUX Kontext — ahora cambian objetos, fondos y texto dentro de fotos existentes a partir de una instrucción en lenguaje sencillo, localmente y sin coste.

El lado de la nube tiene su propia historia en 2026: el mercado se consolidó en torno a unos pocos actores serios, los precios de entrada bajaron al rango de $8-10/mes, y los datos de entrenamiento comercialmente seguros se convirtieron en un diferenciador real para usuarios empresariales. Ambas puertas son genuinamente buenas. La pregunta es cuál se ajusta a ti — y a diferencia del vídeo, la barrera de hardware para imágenes es lo bastante baja como para que la puerta local sea realista para muchas más personas.

La puerta local: tres familias de modelos gratuitos

Las tres funcionan a través de ComfyUI (o una interfaz local similar) en tu propia máquina. Igual que con la generación de vídeo: son modelos de difusión, no LLM — no funcionan en Ollama.

📍 En una frase

Qwen-Image es el modelo de imagen local más seguro y versátil en 2026 — Apache 2.0, el mejor renderizado de texto, sin restricciones — mientras que FLUX gana en fotorrealismo (con matices de licencia según la variante) y Stable Diffusion 3.5 gana en profundidad de ecosistema.

💬 En términos simples

Si solo quieres una respuesta: consigue una GPU de 8GB o más y ejecuta Qwen-Image. No tiene letra pequeña en la licencia y tiene el mejor renderizado de texto de cualquier modelo abierto.

FamiliaLicenciaVRAMCaracterística destacada
FLUX (Black Forest Labs)Dividida — schnell es Apache 2.0, dev/Kontext son no comerciales sin una licencia de pago8GB (schnell) hasta 24GB (FLUX.2 dev)Referencia en fotorrealismo; Kontext lidera la edición local
Stable Diffusion 3.5 + SDXL (Stability AI)Licencia Comunitaria de Stability — gratis por debajo de $1M de ingresos8–12GBEl ecosistema local de LoRA/ControlNet más profundo
Qwen-Image (Alibaba)Apache 2.0 — sin restricciones8GB (GGUF) hasta 24GB (precisión completa)El mejor renderizado de texto legible dentro de las imágenes

Descarga cualquiera de estos modelos únicamente desde los repositorios oficiales enlazados abajo — los sitios de terceros con "descarga gratis" reempaquetan modelos con quién sabe qué dentro.

FLUX (Black Forest Labs) — la referencia en fotorrealismo, con niveles de licencia

La familia FLUX es la opción por defecto para trabajo de imagen local serio. FLUX.2 [dev] (32B) lidera en fotorrealismo y alta resolución, combinando hasta 10 imágenes de referencia manteniendo la consistencia del personaje, producto y estilo. FLUX.1 [schnell] genera imágenes de calidad en 1–4 pasos con solo 8GB de VRAM. FLUX.1 Kontext es el líder local en edición de imágenes existentes.

Licencia — lee esta parte con atención: la familia está dividida. FLUX.1 [schnell] es Apache 2.0 — sin restricciones, uso comercial incluido. FLUX.1/2 [dev] y Kontext usan la licencia no comercial de Black Forest Labs — usarlos en un producto comercial requiere una licencia de pago de BFL. "Pesos abiertos" no significa "apto para uso comercial" en este caso.

Hardware: 8GB (schnell), 12–16GB (dev/Kontext), 24GB (FLUX.2 dev, GGUF Q4).

FLUX.1 schnell on Hugging Faceenlace de producto · divulgadoFLUX.2 dev on Hugging Faceenlace de producto · divulgado

Stable Diffusion 3.5 + SDXL (Stability AI) — la apuesta por el ecosistema

SD 3.5 (8B Large / 2.5B Medium) ya no es el líder en calidad, pero tiene algo que los demás no tienen: el ecosistema más profundo de la IA de imagen local. Años de LoRAs comunitarios (archivos complementarios pequeños que enseñan al modelo un estilo, un personaje o el aspecto de un producto), ControlNets y tutoriales significan que, sea lo que sea lo que quieras hacer, alguien ya ha construido las piezas.

Hardware: 8–12GB según la variante; SDXL funciona sin problemas con 8GB.

Licencia: Licencia Comunitaria de Stability — gratis para uso comercial si tus ingresos anuales son inferiores a $1M; por encima de eso necesitas una Licencia Enterprise. Adecuada para autónomos y pequeñas empresas; una limitación real a gran escala.

Stable Diffusion 3.5 on Hugging Faceenlace de producto · divulgado

Qwen-Image (Alibaba) — verdaderamente gratis, y el rey del renderizado de texto

Alibaba liberó el código de Qwen-Image (20B) en agosto de 2025 bajo Apache 2.0 — sin umbrales de ingresos, sin cláusulas no comerciales, sin juegos de territorio. Su especialidad es algo en lo que la mayoría de los modelos todavía fallan: texto legible y correctamente escrito dentro de la imagen, en varios idiomas. Carteles, letreros, infografías, miniaturas con titulares — este es el modelo.

Extra: Qwen-Image-Edit realiza ediciones precisas, basadas en instrucciones, sobre fotos existentes — cambia el color de un objeto, sustituye un fondo, corrige texto — preservando todo lo demás.

Hardware: 8GB (cuantizado en GGUF) hasta 24GB (precisión completa). Licencia: Apache 2.0 — el único modelo de imagen de primer nivel sin letra pequeña.

Qwen-Image on Hugging Faceenlace de producto · divulgadoQwen-Image-Edit on Hugging Faceenlace de producto · divulgado

Uno a seguir: HiDream-O1

Lanzado en mayo de 2026 bajo licencia MIT — incluso más permisiva que Apache 2.0 — HiDream-O1 (8B) se situó entre las mejores entradas de pesos abiertos en la arena de texto a imagen de Artificial Analysis poco después de su lanzamiento, compitiendo con modelos varias veces su tamaño. Es joven, el ecosistema es escaso y el soporte a largo plazo no está garantizado (esta clasificación tiene una única fuente en el momento de escribir esto — verifícala antes de darla por sentada). Pero si la trayectoria se mantiene, esta lista se reescribirá en menos de un año.

HiDream-O1 on Hugging Faceenlace de producto · divulgado

La barrera del hardware (más baja de lo que crees)

Si nuestro artículo sobre vídeo te asustó y te alejó de la IA local, esta es la tabla de buenas noticias: las imágenes son simplemente una carga de trabajo mucho más ligera. Una RTX 3060 12GB de segunda mano (~$170–220; los precios locales varían según el país y los impuestos) cubre las dos primeras filas de abajo. Compáralo con la generación de vídeo, donde 24GB es el nivel cómodo.

¿No sabes dónde se sitúa tu hardware? Estas guías hacen los cálculos: Calculadora de VRAM para requisitos exactos por modelo, ¿Cuánta VRAM necesitas? para tablas comparativas entre tamaños de modelo, Mejores GPU para IA local y Mejores GPU económicas para recomendaciones de hardware, y GPU vs CPU vs Apple Silicon para comparativas de plataformas.

Tu GPUQué puedes ejecutar
8GB de VRAMFLUX.1 schnell, SD 3.5, SDXL, Qwen-Image (GGUF) — la mayor parte del menú
12–16GB de VRAMFLUX.1 dev y Kontext, Qwen-Image a mayor precisión
24GB+ de VRAMTodo, incluyendo FLUX.2 dev a máxima calidad

Coste aproximado de hardware a fecha de agosto de 2026: una RTX 3060 12GB de segunda mano cuesta entre $170 y $220. Los precios de las GPU cambian — y varían según el país y los impuestos locales — verifica el precio actual antes de comprar en lugar de confiar en esta cifra pasados unos meses.

La realidad del hazlo-tú-mismo: lo que "gratis" te pide

La misma honestidad que en el artículo sobre vídeo. La generación de imágenes local significa:

La configuración. ComfyUI o una interfaz similar, archivos de modelo en las carpetas correctas, algún que otro error de dependencias. Una tarde, no una semana — las configuraciones de imagen son mucho más sencillas que las de vídeo —, pero sigue siendo tu tarde.

La escritura de prompts. Sin asistente de prompts integrado, sin presets de estilo, sin filtro de contenido (control total — y responsabilidad total). Tú escribes los prompts. Nuestras guías sobre prompts de sistema vs. prompts de usuario y prompt engineering para modelos locales cubren los fundamentos que se aplican directamente aquí.

El acabado. Escalado (upscaling), corrección de rostros, organización por lotes — herramientas y nodos separados que tú eliges. ¿Quieres un personaje consistente en 30 imágenes? Eso es entrenamiento de LoRA: factible, documentado, pero un proyecto en sí mismo.

Débil (una frase)

Un gato

Estructurado (lo que necesitan los modelos de imagen)

Retrato de estudio de un gato pelirrojo con una pequeña bufanda tejida, luz suave de ventana desde la izquierda, profundidad de campo reducida, aspecto de lente 85mm, tonos cálidos otoñales, alto detalle

Para qué sirven realmente las imágenes con IA

Antes de elegir una puerta, conoce para qué la vas a usar. El mapa realista de casos de uso:

  • Sitios de contenido y blogs: imágenes destacadas, ilustraciones de artículos, tarjetas de vista previa para redes sociales.
  • YouTube y redes sociales: miniaturas, arte de canal, gráficos para publicaciones, creatividades publicitarias — incluyendo variantes rápidas para pruebas A/B.
  • E-commerce y marketing: maquetas de producto, escenas de estilo de vida, variantes estacionales de la misma toma.
  • Materiales de trabajo: visuales para presentaciones, gráficos para pitch decks, maquetas conceptuales.
  • Proyectos creativos: portadas de libros, arte conceptual, mood boards, diseños para impresión bajo demanda.
  • Edición, no solo creación: con Qwen-Image-Edit o FLUX Kontext — sustituye fondos, elimina objetos, cambia el estilo de fotos de producto, corrige texto en gráficos.

Dos límites honestos: las imágenes con IA aún tienen dificultades con la consistencia exacta de marca en lotes grandes (los LoRA locales ayudan; las herramientas en la nube se están poniendo al día), y cualquier cosa que requiera personas reales, productos reales o precisión factual necesita fotografía, no generación.

La puerta de la nube: dos servicios a considerar

Elegimos Adobe Firefly y getimg.ai porque cubren genuinamente las dos necesidades más comunes en la nube: máxima seguridad comercial, y el puente más sencillo entre lo local y la nube. Midjourney y ChatGPT también se usan mucho para generación de imágenes, pero ninguno encaja tan directamente en esas dos necesidades específicas — Firefly y getimg.ai son las opciones más útiles para esta comparativa, no una elección por defecto.

Adobe Firefly — la opción comercialmente segura

¿Quieres probar la opción de nube comercialmente segura? Si no tienes GPU o no quieres gestionar modelos locales, prueba Adobe Firefly antes de comprometerte con una configuración local. Probar Adobe Firefly →

Firefly está entrenado con contenido de Adobe Stock y contenido con licencia abierta — lo que significa que Adobe lo diseñó para que los usuarios empresariales no hereden riesgo de derechos de autor — y se integra directamente con Photoshop y el resto de Creative Cloud. Si el trabajo con clientes o la seguridad de marca es tu preocupación, esta es la puerta de la nube. Existe una prueba gratuita para probarlo antes de pagar; los planes de pago empiezan en $9.99/mes por 2.000 créditos generativos (nivel Standard). Ideal para: profesionales, agencias, cualquiera cuyos clientes pregunten "¿esto es legalmente seguro?".

Adobe Fireflyenlace de producto · divulgado

getimg.ai — la versión en la nube de los modelos locales

¿Quieres modelos locales sin tener la GPU? getimg.ai te da acceso a modelos abiertos como FLUX a través de la nube, sin instalar ComfyUI ni requisitos de VRAM. Probar getimg.ai →

Aquí está el giro que la mayoría de las comparativas se pierden: getimg.ai ejecuta los mismos modelos abiertos que instalarías localmente — FLUX y compañía, más de 20 modelos en una sola interfaz — pero en sus GPU en lugar de la tuya. Sin configuración, sin cálculos de VRAM, derechos comerciales incluidos en todos los planes. Si la puerta local te atrae pero tu hardware dice que no, este es el puente. Los precios son de pago exclusivamente desde principios de 2026 (el nivel gratuito se retiró) — el plan Entry desde $8/mes con facturación anual ($10/mes con facturación mensual) por 3.000 créditos; los niveles superiores escalan a partir de ahí. Ideal para: usuarios curiosos por lo local pero sin la GPU, y cualquiera que quiera variedad de modelos abiertos sin la curva de aprendizaje de ComfyUI.

(Mención honorífica: Ideogram — un líder en la nube para texto dentro de imagen, con un nivel gratuito limitado que publica las imágenes en una galería pública, y planes de pago que empiezan alrededor de $20/mes.)

getimg.aienlace de producto · divulgado

Nube o local: ¿cuál es tu puerta?

¿Sin GPU? Empieza por la nube. Si todavía no estás seguro, prueba la prueba gratuita de Firefly o usa getimg.ai para experimentar con modelos abiertos sin comprar hardware. Probar Adobe Firefly → · Probar getimg.ai →

La versión resumida, mapeada a situaciones comunes:

Tu situaciónRecomendación
Sin GPU, o menos de 8GB de VRAMNube: getimg.ai (modelos abiertos, sin configuración) o prueba gratuita de Adobe Firefly para probar
Necesitas imágenes ocasionalmente, cero tolerancia a la configuraciónNube: Adobe Firefly (más sencillo) o getimg.ai (más variedad de modelos)
Texto dentro de las imágenes (carteles, miniaturas)Local: Qwen-Image — o Ideogram en la nube para trabajos puntuales
Producto comercial a gran escalaLocal: Qwen-Image o FLUX schnell (Apache 2.0) — revisa antes el límite de $1M de SD 3.5 y los términos no comerciales de FLUX dev
Trabajo con clientes donde se cuestiona la seguridad legalNube: Adobe Firefly (datos de entrenamiento comercialmente seguros)
Trabajo con clientes, productos no lanzados, sensible a la privacidadLocal — nada sale de tu máquina
GPU de 8GB o más, alto volumen, coste marginal $0Local: schnell para velocidad, Qwen-Image para texto, SD 3.5 para estilos
Personaje/estilo consistente en muchas imágenesLocal con LoRAs (ecosistema SD 3.5/SDXL)

Míralos en acción

Preguntas frecuentes

¿Puedo generar imágenes con IA con 8GB de VRAM?

Sí — sin problemas. FLUX.1 schnell, SD 3.5, SDXL y Qwen-Image cuantizado funcionan todos con 8GB. Las imágenes son mucho más ligeras que el vídeo; esta es la mayor diferencia respecto a nuestra comparativa de vídeo.

¿Qué modelo de imagen local es realmente gratis para uso comercial?

Qwen-Image y FLUX.1 schnell (ambos Apache 2.0), además de HiDream-O1 (MIT). SD 3.5 es gratis para uso comercial solo por debajo de $1M de ingresos anuales. Los pesos de FLUX dev/Kontext son no comerciales sin una licencia de pago de Black Forest Labs.

¿Qué herramientas de imagen en la nube tienen un nivel gratuito?

Adobe Firefly ofrece una prueba gratuita (la asignación exacta de créditos varía — consulta firefly.adobe.com para la cifra actual). Ideogram ofrece un nivel gratuito limitado con las imágenes publicadas en una galería pública. getimg.ai retiró su nivel gratuito a principios de 2026 — es de pago exclusivamente desde $8/mes con facturación anual.

¿Pueden los modelos de IA poner texto legible dentro de las imágenes?

Sí — esto fue un gran desbloqueo en 2025–2026. Qwen-Image lidera a nivel local (multilingüe, incluyendo inglés y chino); Ideogram es una sólida opción en la nube para trabajos puntuales con mucho texto.

¿Son privadas mis imágenes generadas en la nube?

Depende del servicio. Algunos niveles gratuitos (entre ellos el de Ideogram) publican las generaciones en una galería pública por defecto. Revisa los términos de privacidad actuales de cada servicio antes de generar algo sensible — la generación local es privada por defecto, ya que nada sale de tu máquina.

¿Puedo editar mis propias fotos con estas herramientas?

Sí. Localmente: Qwen-Image-Edit y FLUX Kontext cambian objetos, fondos, colores y texto a partir de instrucciones en lenguaje sencillo. En la nube, el Generative Fill de Adobe Firefly (dentro de Photoshop) y los endpoints de edición de getimg.ai hacen lo mismo.

¿Necesito saber prompt engineering?

Para las herramientas en la nube, no realmente — las instrucciones conversacionales funcionan. Para los modelos locales, los prompts estructurados (sujeto, estilo, iluminación, composición) mejoran drásticamente los resultados; es una habilidad que se aprende, no un talento.

¿Local o nube para una pequeña empresa?

Si generas menos de unas 200 imágenes al mes y no tienes GPU: nube — Adobe Firefly si la seguridad legal importa, getimg.ai si quieres variedad de modelos. Por encima de ese volumen, o si la confidencialidad con el cliente importa, una GPU de segunda mano de $200 y Qwen-Image pueden amortizarse en pocos meses.

El veredicto

Ve a lo local si tienes (o vas a comprar) una GPU de 8GB o más, generas imágenes regularmente, y quieres privacidad, coste marginal cero y control creativo total. Qwen-Image es la base más segura — Apache 2.0, el mejor renderizado de texto de su categoría — con FLUX para fotorrealismo (ten en cuenta la división de licencia por variante) y SD 3.5 por su ecosistema de estilos inigualable.

Ve a la nube si quieres resultados en los próximos cinco minutos, generas ocasionalmente, o no tienes GPU. Adobe Firefly es la opción segura y profesional con datos de entrenamiento comercialmente seguros; getimg.ai es el puente para cualquiera al que le guste la idea de los modelos abiertos pero no la idea de instalarlos.

Y si el vídeo es lo siguiente en tu lista — esa es otra conversación de hardware distinta. Lee el artículo complementario: Generación de vídeo con IA local vs. la nube.

Fuentes

← Volver a LLM locales avanzados