Para quienes ejecutan IA en su propio ordenador, los modelos de imagen tenían una costumbre molesta: cada uno nuevo era mejor, y cada uno nuevo era más grande. Un texto mejor y unos detalles más nítidos solían significar necesitar una tarjeta gráfica más cara.
Qwen-Image-2.1, publicado por Alibaba el 20 de septiembre de 2026, rompe esa tendencia. Es más pequeño que los modelos de imagen Qwen anteriores y hace más cosas.
Pequeño y sorprendentemente capaz
La parte del modelo que realmente dibuja la imagen tiene 7.000 millones de parámetros. Es bastante menos que el generador de 20.000 millones que había detrás de los modelos Qwen-Image anteriores. Alibaba dice que lo consigue con un diseño simplificado —32 capas de «flujo único» que procesan texto e imagen juntos— y con trucos que evitan repetir el mismo trabajo dos veces.
Para ti, eso significa que el modelo es más ligero y más barato de ejecutar. Y trae más cosas dentro:
- Imágenes transparentes. Pide una pegatina, un personaje de videojuego o un recorte de producto y puede generarlo con un fondo realmente transparente. La mayoría de los modelos pintan un fondo y te dejan a ti borrarlo, normalmente con un halo borroso alrededor del pelo o del cristal. Qwen-Image-2.1 también puede editar capas transparentes y extraer un sujeto de una foto existente.
- Hasta diez referencias. Dale la foto de una persona, una chaqueta de una tienda online y la imagen de una habitación, y puede colocar a esa persona, con esa chaqueta, en esa habitación. Entre los ejemplos de la propia Alibaba hay una foto de grupo montada a partir de seis retratos distintos.
- Señalar en vez de describir. Para cambiar una parte de una imagen, puedes rodearla con un círculo, garabatear encima o aportar una máscara, en lugar de intentar explicar con palabras dónde está «la cosa de la izquierda».
- Salida en 2K. Genera de forma nativa a 2048×2048, además de formatos panorámicos, verticales y otros.
Desde el primer día funcionó en ComfyUI y Hugging Face Diffusers, las dos formas más populares de ejecutar modelos de imagen en local.
La pega: la licencia ha cambiado
Aquí es donde la buena noticia se complica.
Los modelos de imagen Qwen anteriores se publicaron bajo Apache 2.0, una de las licencias más generosas del mundo del software. Podías descargarlos, modificarlos, integrarlos en un producto y vender lo que generaban sin pedir permiso a nadie.
Qwen-Image-2.1 se publica, en cambio, bajo la Qwen Research License.
Esa licencia te permite experimentar, investigar y crear arte para ti. Pero en el momento en que montes una aplicación de pago sobre él, vendas imágenes generadas a clientes o lo uses dentro de un producto comercial, necesitas un acuerdo aparte con Alibaba.
Esto va más allá de la letra pequeña legal. Las herramientas de imagen de código abierto prosperan porque la gente comparte complementos libremente: estilos, personajes y versiones ajustadas. Una licencia solo para investigación implica que menos empresas invertirán en ese ecosistema, así que probablemente crecerá más despacio de lo que habría crecido con Apache.
A quién le conviene
- Aficionados, estudiantes, investigadores y artistas que crean obra personal: es uno de los modelos de imagen más capaces que puedes ejecutar en casa. Es compacto, crea imágenes realmente transparentes y puede manejar diez referencias a la vez. Pruébalo.
- Quien esté montando un negocio: lee antes la licencia. Para tener libertad comercial sin pedir permiso, FLUX.2 Klein y otros modelos con licencias permisivas siguen siendo el terreno más seguro.
Qwen-Image-2.1 demuestra lo buenos que se han vuelto los modelos de imagen pequeños y locales. También demuestra que «abierto» y «de uso comercial libre» no siempre son lo mismo.