Cómo usar Qwen Image 3.0 en 2026 (y por qué no hay API aún)
2026/07/21

Cómo usar Qwen Image 3.0 en 2026 (y por qué no hay API aún)

Cómo usar Qwen Image 3.0: no hay API pública todavía. Dónde probar la 3.0 oficial y cómo lograr el mismo texto nítido desde el navegador — dos imágenes gratis.

Qwen Image 3.0 se lanzó el 21 de julio, y lo primero que escribió casi todo el mundo tras el anuncio fue alguna variación de la misma pregunta: ¿cómo se usa esto en realidad? El equipo de Qwen en Alibaba la llamó tercera generación, presumió del truco por el que esta línea es conocida —texto legible dentro de las imágenes— y luego apuntó a todos hacia Qwen Chat, y a ningún otro sitio. Sin pesos, sin licencia, sin API, ni siquiera una tabla de benchmarks.

Así que esta es la guía práctica que fui a buscar y no encontré: qué hace realmente Qwen Image 3.0, si hay una API que puedas llamar (no la hay, por ahora), y cómo he estado generando en el mismo estilo Qwen orientado al texto desde una pestaña normal del navegador mientras los pesos 3.0 siguen bajo llave.

Qué hace realmente Qwen Image 3.0

El anuncio hace tres afirmaciones, y todas perfeccionan lo que ya distinguía a la línea de imágenes de Qwen:

  • Renderizado de texto en 12 idiomas y más de 20 fuentes. Titulares, rótulos, etiquetas —se colocan limpios en lugar de disolverse en pseudo-letras— y no solo en alfabetos latinos: el chino es el idioma que esta línea siempre ha manejado mejor. Esta es la característica estrella y la razón por la que la gente busca Qwen en lugar de modelos más bonitos pero analfabetos.
  • Diseños densos de conocimiento desde un prompt muy largo. La 3.0 acepta hasta unos 4.500 tokens de instrucción en una sola pasada (la versión anterior alcanzaba cerca de 1.000), y los ejemplos insisten mucho en ello: fórmulas, figuras geométricas, derivaciones lógicas, infografías multipanel, mockups de UI, incluso páginas con la densidad de un periódico y diseños académicos cargados de matemáticas.
  • Detalle fotorrealista — piel, cabello, papel, las texturas de siempre, más cercano a una cámara que a un render.

Lo que no aparece en el anuncio es tan llamativo como lo que sí: sin número de parámetros, sin licencia, sin pesos, sin API. Oficialmente, encuentras Qwen Image 3.0 dentro de Qwen Chat y en ningún otro lugar, al menos hoy.

¿Hay una API de Qwen Image 3.0?

Respuesta corta: aún no. No hay ningún endpoint oficial al que llamar, ni pesos descargables para autoalojar.

Esto confunde a la gente porque todo sitio de terceros con un botón "Qwen" tiene una API detrás —solo que no la de la 3.0. Esos corren un modelo de imagen Qwen más antiguo (2.0 y anteriores), las versiones que ya distribuye el propio DashScope de Alibaba, más routers como OpenRouter y puentes de nivel gratuito como Puter. Cualquiera que diga que está sirviendo los pesos 3.0 hoy está, siendo generosos, adelantándose a los hechos. Cuando Alibaba abra una verdadera API 3.0, ese será el día en que las herramientas puedan cambiar de verdad.

Así que "usarlo" se divide en dos: la 3.0 oficial exactamente como la afinó Alibaba vive en Qwen Chat, y generar en el mismo estilo Qwen orientado al texto desde el navegador significa usar el modelo de imagen Qwen que ya responde a un endpoint. Ese segundo camino es lo que hacemos en nuestra página de Qwen Image 3.0 —un sitio independiente, no afiliado a Alibaba, que reconoce honestamente que el motor en vivo es el modelo de imagen Qwen actualmente disponible en lugar de los pesos 3.0 no lanzados.

En qué es bueno el modelo de imagen Qwen disponible (lo probé)

Antes de escribir nada de esto ejecuté prompts reales a través de él, y la reputación del renderizado de texto se sostiene —con un límite que vale la pena conocer.

El texto corto y grande sale limpio a la primera. Pedí una tienda de panadería al atardecer con un rótulo que dice "SUNRISE BAKERY" encima del chino "日出面包房" y obtuve ambas escrituras nítidas y deletreadas correctamente, neón brillante y todo —el rótulo bilingüe que la mayoría de los modelos convierten en sopa de letras.

Una tienda de panadería al atardecer con un rótulo de neón que dice SUNRISE BAKERY encima del chino 日出面包房, ambas escrituras nítidas y legibles

Los pósteres se comportan igual. Un brief de una línea —gran titular, una pequeña línea de detalles— regresó con "DESIGN WEEK 2026" y "Talks · Workshops · Exhibits" colocados lo suficientemente limpios como para usar tal cual.

Un póster de evento que dice DESIGN WEEK 2026 con un subtítulo Talks, Workshops, Exhibits, tipografía limpia y legible

El límite: cuando empujé hacia texto denso —un tablero de clima con seis pequeños campos etiquetados— la letra pequeña se disolvió en galimatías, el clásico fallo de texto en la IA. Así que la regla a la que llegué es simple: mantén las palabras en la imagen pocas y grandes. Un título audaz más dos o tres etiquetas cortas se renderiza hermosamente; una pared de pequeños pies de foto no. Una infografía limpia con un encabezado y un puñado de etiquetas de una palabra se sitúa justo en el punto óptimo.

Una infografía de diseño plano con el encabezado RENEWABLE ENERGY y tres grandes iconos etiquetados SOLAR, WIND, HYDRO

Ninguno de estos necesitó un truco de prompt —solo texto breve, entrecomillado y un diseño claro. Si has peleado con letras deformadas en otros modelos, eso por sí solo es la razón para recurrir a la familia Qwen.

Cómo usar Qwen Image 3.0 hoy, en tres pasos

  1. Comprueba el techo en Qwen Chat. Abre la 3.0 oficial donde Alibaba la aloja y ejecuta tu prompt de texto más difícil —un póster bilingüe, un diagrama etiquetado. Eso es la referencia de lo que los pesos 3.0 pueden hacer.
  2. Genera en el mismo estilo en el navegador. Abre el generador de Qwen Image 3.0, inicia sesión con Google y gasta los créditos de bienvenida —las primeras dos imágenes son gratis. Mantén cualquier texto en la imagen breve y pon las palabras exactas entre comillas. Hace texto a imagen y edición imagen a imagen, en cinco proporciones.
  3. Elige la proporción antes de escribir el prompt. Las cinco de Qwen son 1:1, 3:4, 4:3, 9:16 y 16:9 —un conjunto diferente de las 3:2 y 2:3 de Grok— y el selector no acepta nada fuera de ellas, así que elegir el marco primero te ahorra una pasada de recorte.

Dónde se sitúa junto a los modelos que ya conoces

El renderizado de texto no es exclusivo de Qwen. GPT Image 2 es el otro modelo en el que confío con palabras en una imagen, y llega a 4K para impresión —el motor de acabado cuando un borrador tiene que entregarse. La línea Nano Banana de Google es el caballo de batalla rápido y barato; Grok Imagine es la opción de velocidad fotorrealista, que comparé en 6 alternativas a Grok Imagine. La ventaja específica de Qwen es el texto bilingüe y los diseños densos de conocimiento desde un prompt largo —recurre a ella cuando las palabras en la imagen importan tanto como la imagen. Y si prefieres comparar en la práctica a leer al respecto, el estudio de texto a imagen pone el catálogo principal del sitio en un menú desplegable.

En resumen

Qwen Image 3.0 es un paso real para la generación orientada al texto, y por ahora hay exactamente una puerta oficial —Qwen Chat, sin pesos, sin API. Eso cambia el día en que Alibaba lance pesos o un endpoint; hasta entonces, la forma honesta de trabajar en el estilo Qwen desde el navegador es el modelo que ya responde a uno, que es lo que nuestra página ejecuta —sin suplantar los pesos 3.0, solo el renderizado de texto de la familia Qwen con tus primeras dos imágenes gratis. Mantén las palabras cortas y déjale hacer lo que hace mejor que casi cualquier otra cosa: deletrear.

Lecturas relacionadas

Free to try

Generate your first image with GPT Image 2 — right now

Reliable non-Latin text rendering, directed editing, and 50+ ready-to-use prompts. No downloads — just open in your browser.