En resumen

  • Qwen-Image-3.0, lanzado el 21 de julio por el equipo Qwen de Alibaba, acepta 4.500 tokens de instrucciones.
  • Esto permite la generación en una sola pasada de diseños complejos como periódicos, guiones gráficos y cuadrículas densas de infografías.
  • A diferencia de su predecesor, el lanzamiento no incluyó pesos de modelo abiertos, puntos de referencia ni un informe técnico; está disponible en chat.qwen.ai con precios de API aún no revelados.

El equipo Qwen de Alibaba lanzó Qwen Image 3.0 el martes, y la propuesta no tiene nada que ver con lo hermoso que se ve el resultado. Se trata de si el resultado puede usarse realmente en el trabajo.

La mayoría de las herramientas de imagen con IA (Reve, Nano Banana, Seedream) están diseñadas para sobresalir en áreas específicas: creatividad, realismo, capacidades de edición, etc. Qwen Image 3.0 va en una dirección diferente. "Qwen-Image-3.0 no solo persigue lo 'bonito', sino que persigue lo 'útil', haciendo que la generación de imágenes sea una herramienta de productividad realmente desplegable", escribió el equipo Qwen en el anuncio oficial.

La pieza central es lo que el gigante chino Alibaba llama contenido rico. El modelo acepta hasta 4.500 tokens, que es 4,5 veces más de lo que la generación anterior podía procesar. Los tokens son las unidades de texto que una IA lee; imagina un token como aproximadamente una palabra o parte de una palabra, así que 4.500 de ellos son varias páginas de instrucciones detalladas.

Eso es suficiente para describir nueve paneles de infografía separados en una sola indicación y obtenerlos como una imagen completa.