Qwen-Image-2.1: ¿existe una API y qué puedes usar hoy?
Qwen-Image-2.1 es solo de pesos abiertos: no hay API alojada ni precio oficial, y su Qwen Research License no es comercial. Esto es lo confirmado, lo que no lo está y qué API de imágenes puedes llamar comercialmente hoy.
Published 2026-09-21
Qwen-Image-2.1 no tiene API alojada ni precio oficial. El equipo Qwen de Alibaba publicó los pesos como código abierto el 20 de septiembre de 2026, pero se distribuyó como una descarga para Hugging Face, GitHub, ModelScope y ComfyUI, no como un endpoint medido. No hay un ID de modelo oficial qwen-image-2.1 para API, ni una tarifa publicada por imagen, ni un sandbox alojado al que puedas llamar con una clave de API.
El mayor obstáculo es la licencia. Los pesos se publican bajo la Qwen Research License (20 de septiembre de 2026), que permite únicamente investigación y evaluación no comerciales; el uso comercial requiere una concesión separada de Qwen. Es un cambio deliberado respecto al anterior Qwen-Image, que se distribuía bajo Apache 2.0, y significa que Qwen-Image-2.1 no es algo que puedas incorporar tal cual a un producto de pago.
Si necesitas generación o edición de imágenes comercial a través de una API hoy, APIMaster tiene rutas que sí funcionan. La más económica es GPT Image 2 (gpt-image-2) a desde $0.0075 por 1K imágenes en 5 rutas activas, frente a la referencia de $0.25 de OpenAI — alrededor de un 97% de descuento, verificado el 21 de septiembre de 2026. Nano Banana 2 (gemini-3.1-flash-image) es la otra opción sólida, desde $0.0469 por 1K imágenes en 3 rutas activas frente a la referencia de $0.067 de Google. Consulta la tarjeta en vivo de GPT Image 2 y la tarjeta de Nano Banana 2; los precios y la disponibilidad de las rutas cambian según la oferta.
Prueba de GPT(GPT-6 Astra, GPT-5.6, GPT-5.5 y GPT Image 2 disponibles)
Regístrate y recibe $20 de prueba de GPT
¿Existe una API de Qwen-Image-2.1?
No. A fecha del 21 de septiembre de 2026 no existe una API oficial de Qwen-Image-2.1, ni indicios de que vaya a haberla:
| Elemento | Estado de Qwen-Image-2.1 |
|---|---|
| Pesos abiertos | Publicados el 20 de septiembre de 2026 |
| API alojada oficial | No publicada |
| ID de modelo de API público | No publicado |
| Precio oficial | No publicado |
| Licencia | Qwen Research License — solo investigación y evaluación no comerciales |
| Lo que existe hoy | Descarga de pesos, pipeline de Diffusers, nodos de ComfyUI, Space de demostración en Hugging Face |
Cualquiera que cite un "precio de la API de Qwen-Image-2.1" está poniendo precio a una GPU autoalojada, no a un endpoint de un proveedor. Esa cifra depende por completo de tu propio hardware y utilización, y no es comparable a una tarifa de API por imagen.
Qué está realmente confirmado sobre Qwen-Image-2.1
Todo lo siguiente proviene de los propios materiales de lanzamiento y la model card de Qwen.
- La generación y la edición comparten un único conjunto de pesos. Un solo
QwenImage21Pipelinehace texto-a-imagen y edición basada en instrucciones, así que no cambias de modelo para cambiar de tarea. El texto y las imágenes de referencia se codifican primero y luego se desruidan. - Una columna vertebral de imagen de ~7B más un codificador visión-lenguaje. La parte visual es un DiT Single-Stream de 32 capas con aproximadamente 7B de parámetros, con texto e imágenes de referencia codificados por
Qwen3-VL-8B. Contando el codificador de texto, el stack está en el orden de 16B, y los pesos oficiales en BF16 son de unos 33GB. - Transparencia nativa (RGBA). El VAE es un autoencoder RGBA de 64 canales con compresión espacial 16×. Puede generar imágenes con canal alfa directamente, editar capas transparentes existentes y recortar sujetos de fotos normales para convertirlos en recursos transparentes. El propio consejo de prompting de Qwen es indicarlo explícitamente, por ejemplo: "This is an RGBA image with transparency. … The image has alpha channel and the background is transparent."
- Hasta 10 imágenes de referencia. Una solicitud puede llevar hasta 10 imágenes de condicionamiento para fotos de grupo, probador virtual o ambientación de interiores. Las ediciones locales aceptan círculos, marcas de pincel o una máscara separada, con énfasis en preservar la identidad de personas y productos. Los nodos de ComfyUI reservan ranuras hasta
image_16. - Salida nativa 2K. El tamaño común es 2048×2048, y un encuadre 16:9 alcanza aproximadamente 2752×1536. El número de pasos por defecto es 40. Qwen destaca una mejora en la disposición del texto, la iluminación de retratos y el detalle fino.
- Trabajo de eficiencia. La atención de granularidad mixta y la reutilización de la caché KV de prefijo hacen que el prompt y las imágenes de referencia se codifiquen una vez y se reutilicen en los pasos de desruido, lo que ahorra más cómputo al editar con varias imágenes de referencia.
- Ecosistema desde el primer día. Hugging Face Diffusers (
QwenImage21Pipeline), ComfyUI (con pesos cuantizados empaquetados por separado, una combinación mínima de unos 14GB), además de vLLM-Omni, SGLang y LightX2V. - Modelos de reescritura de prompts. Qwen también distribuye modelos de reescritura de prompts PE-T2I / PE-I2I — ajustes finos de
Qwen3.5-VLde unos 9B.
Qué no está confirmado
- Ningún endpoint alojado de nadie oficial. Qwen publicó pesos, no un servicio.
- Ningún precio oficial — ni por imagen, ni por token.
- El benchmark es del propio proveedor. Qwen reporta alrededor de 60.28 en su Qwen-Image-Bench interno, que su gráfico sitúa primero entre los modelos abiertos, ligeramente por delante de Nano Banana 2.0 (59.82) y GPT Image 1.5 (59.65). Es un benchmark propio, y la replicación independiente escaseaba el día del lanzamiento. Trata el ranking como una afirmación que hay que probar, no como un resultado que citar.
La licencia es el verdadero punto de decisión
Esta es la parte que la mayoría de la cobertura de "Qwen-Image-2.1 ya está aquí" omite. Los pesos están bajo la Qwen Research License, efectiva desde el 20 de septiembre de 2026: solo investigación y evaluación, no comercial. Ejecutarlo dentro de un producto comercial, una entrega a un cliente o una API de pago propia generalmente requiere una concesión comercial separada de Qwen.
Es un cambio real de postura. Las versiones anteriores de Qwen-Image eran Apache 2.0, y por eso tantos tutoriales asumen "descárgalo y publícalo". Con 2.1, la descarga no es una licencia comercial. Antes de construir nada orientado al cliente sobre estos pesos, lee el texto de la licencia en el repositorio de Hugging Face y, si necesitas derechos comerciales, pregúntale directamente a Qwen.
Qwen-Image-2.1 frente a las API de imágenes que puedes usar comercialmente
| Qwen-Image-2.1 | GPT Image 2 (gpt-image-2) |
Nano Banana 2 (gemini-3.1-flash-image) |
Nano Banana (gemini-2.5-flash-image) |
Nano Banana Pro (gemini-3-pro-image) |
|
|---|---|---|---|---|---|
| Acceso | Pesos abiertos, autoalojado | API | API | API | API |
| Rutas de APIMaster | No alojado | 5 rutas activas | 3 rutas activas | Activa | Activa |
| Precio de APIMaster, por 1K imágenes | Sin precio de API (tu coste de GPU) | desde $0.0075 | desde $0.0469 | $0.03744 | $0.12864 |
| Precio de referencia por imagen | — | $0.25 | $0.067 | $0.039 | $0.134 |
| Uso comercial | No (licencia de investigación/evaluación) | Sí | Sí | Sí | Sí |
Los precios son los precios de ruta en vivo de APIMaster, verificados el 21 de septiembre de 2026, y son independientes de las tarifas de referencia de los propios proveedores; pueden aplicarse ajustes de cuenta. Qwen-Image-2.1 no tiene precio de API porque no tiene API — solo una descarga. Ten en cuenta también que la transparencia RGBA nativa es la característica más destacada de Qwen-Image-2.1; si una ruta alojada devuelve un canal alfa real varía según el canal, así que verifícalo en la ruta que elijas antes de depender de ello.
Qué usar hoy
- La generación y edición de imágenes comercial más económica: GPT Image 2 (
gpt-image-2). A desde $0.0075 por 1K imágenes frente a una referencia de $0.25, es la ruta de menor coste de la plataforma y cubre tanto la generación como la edición con imágenes de referencia. Empieza en la página del modelo GPT Image. - La alternativa más cercana: Nano Banana 2 (
gemini-3.1-flash-image). El nivel actual de imagen Flash de Google, desde $0.0469 por 1K imágenes frente a una referencia de $0.067. Consulta la página del modelo Nano Banana. - Nano Banana y Nano Banana Pro cubren los extremos más ligero y premium de la misma familia a $0.03744 y $0.12864 por 1K imágenes.
Qwen no está ausente de la plataforma — sus modelos de texto están listados y activos: qwen3.8-max, qwen3.8-flash, qwen3.7-max y qwen3.7-plus, todos accesibles a través de una sola clave en la página de la API de Qwen. Los modelos de imagen son otro asunto: como Qwen-Image-2.1 no es comercial y no tiene API alojada, no hay nada que podamos enrutar hoy. Si Qwen abre una licencia comercial o un endpoint de imagen alojado, evaluaremos listarlo — la misma clave que usas ahora lo cubriría entonces sin nueva integración.
Cómo llamar a una API de imágenes comercial
Crea una clave en la consola de APIMaster, define APIMASTER_API_KEY y usa el esquema de canal que se muestra a continuación. En estas rutas size es una relación de aspecto y resolution selecciona el nivel de precio. Estas convenciones pertenecen al canal, así que no las copies en una solicitud directa al proveedor.
curl "https://apimaster.ai/v1/images/generations" \
-H "Authorization: Bearer $APIMASTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-image-2",
"prompt": "A studio product photograph of a red ceramic teapot on a teal table.",
"size": "1:1",
"resolution": "1K",
"n": 1
}'
Cambiar al nivel de Google es un cambio de una línea — define "model": "gemini-3.1-flash-image" y mantén la misma clave y endpoint.
Prepararse para una API de Qwen-Image-2.1
- Mantén configurable el ID del modelo. Si alguna vez aparece un endpoint
qwen-imagealojado, trátalo como un valor de configuración en lugar de codificar a fuego una cadena adivinada. - Lee primero la licencia. No comercial hoy significa que no hay uso orientado al cliente hasta que Qwen conceda derechos comerciales.
- Haz benchmark en tus propias tareas. Registra la corrección, la latencia y el coste por imagen utilizable en la ruta que realmente uses, para que cualquier comparación futura sea justa.
- Verifica qué está sirviendo una ruta. Un nombre de modelo por sí solo no puede demostrar qué modelo respondió; comprueba un canal antes de escalarlo.
FAQ
¿Está lanzado Qwen-Image-2.1?
Los pesos sí. Qwen publicó Qwen-Image-2.1 como código abierto el 20 de septiembre de 2026 para Hugging Face, GitHub, ModelScope y ComfyUI. No hay un lanzamiento de API alojada.
¿Existe una API o un precio oficial de Qwen-Image-2.1?
No. Qwen no ha publicado ningún ID de modelo de API ni ningún precio para Qwen-Image-2.1. Cualquier coste que veas citado es una estimación de autoalojamiento, no una tarifa de proveedor.
¿Puedo usar Qwen-Image-2.1 comercialmente?
No bajo la licencia publicada. Los pesos usan la Qwen Research License, limitada a investigación y evaluación no comerciales; el uso comercial requiere una concesión separada de Qwen.
¿APIMaster aloja Qwen-Image-2.1?
No. APIMaster lista los modelos de texto de Qwen (qwen3.8-max, qwen3.8-flash, qwen3.7-max, qwen3.7-plus) pero no los modelos de imagen de Qwen, porque no hay una API alojada que enrutar. Eso cambiaría solo si Qwen abre una licencia comercial o un endpoint alojado.
Entonces, ¿qué debería usar para la generación de imágenes comercial?
GPT Image 2 a desde $0.0075 por 1K imágenes (alrededor de un 97% de descuento sobre la referencia de $0.25 de OpenAI), o Nano Banana 2 a desde $0.0469 por 1K imágenes. Ambos están activos, ambos admiten edición y ambos se facturan por imagen con tu clave de APIMaster.
¿Es fiable la puntuación de benchmark de 60.28?
Es el benchmark interno propio de Qwen, presentado en el gráfico de lanzamiento de Qwen como el mejor modelo abierto. La replicación independiente fue limitada el día del lanzamiento, así que trata la cifra como una afirmación autoinformada en lugar de un resultado verificado.
¿Cuál es la característica más destacada de Qwen-Image-2.1?
La transparencia RGBA nativa: un VAE RGBA de 64 canales le permite generar y editar imágenes con un canal alfa real, algo poco habitual entre los modelos de imagen y difícil de obtener en muchas rutas alojadas.
Fuentes y fecha de verificación
- Pesos y model card de Qwen-Image-2.1: huggingface.co/Qwen/Qwen-Image-2.1 — arquitectura, VAE RGBA, detalles de imágenes de referencia y resolución.
- Código y nodos de lanzamiento de Qwen: github.com/QwenLM/Qwen-Image-2.1.
- Blog de lanzamiento de Qwen: qwen.ai/blog?id=qwen-image-2.1 — encuadre de licencia y benchmark.
- Espejo en ModelScope: modelscope.cn/models/Qwen/Qwen-Image-2.1.
- Catálogo de precios en vivo y tarjetas del marketplace de APIMaster, verificados el 21 de septiembre de 2026. La disponibilidad y los precios de las rutas pueden cambiar después de la publicación.
Empieza con una API de imágenes que existe hoy
Qwen-Image-2.1 merece la pena seguir — la transparencia nativa y la edición con 10 imágenes son genuinamente interesantes. Pero no es una API a la que puedas llamar, y su licencia descarta el uso comercial. GPT Image 2 y Nano Banana 2 están activos ahora mismo.
Crea una cuenta de APIMaster, genera una clave en la consola, apunta tu cliente a https://apimaster.ai/v1 y define el modelo como gpt-image-2 — desde $0.0075 por 1K imágenes, alrededor de un 97% de descuento sobre la referencia de $0.25. Una sola clave compatible con OpenAI también cubre Nano Banana, Claude, GPT, DeepSeek y los modelos de texto de Qwen, y cada canal se verifica con huella antes de listarlo.
