En resumen

  • Qwen3.8-Max ejecuta 2,4 billones de parámetros y es el primer modelo de clase Max de Qwen que Alibaba lanzará como pesos abiertos.
  • Incluye instrucciones de configuración para Claude Code de Anthropic y Codex de OpenAI, herramientas rivales.
  • En la propia tabla de referencia de Alibaba, Fable 5 gana 15 de 31 pruebas. Qwen3.8-Max gana siete.

Alibaba lanzó Qwen3.8-Max el lunes, llamándolo el modelo más capaz que ha construido jamás. Los pesos estarán disponibles en Hugging Face y ModelScope la próxima semana, siendo la primera vez que la compañía regala un modelo a escala Max.

Las especificaciones son grandes: 2,4 billones de parámetros en total, con 95 mil millones activados en cualquier momento. Los parámetros son el número de diales que un modelo puede manejar.

Esto es extremadamente importante para la eficiencia, ya que significa que no requeriría demasiados recursos para ejecutarse. Piense en ello como una biblioteca enorme donde solo el estante relevante se ilumina para cada pregunta. Las pequeñas empresas y laboratorios con hardware suficientemente bueno ahora pueden ejecutar un modelo de última generación sin gastar lo mismo que un enorme centro de datos.

La publicación de lanzamiento de Alibaba omite la narrativa habitual de perseguir puntos de referencia y se apoya en la resistencia. El modelo pasó 16 días construyendo una herramienta de codificación por sí mismo: 265 commits, 127 pull requests, 151 issues, sin que ningún humano tocara el teclado. Pasó cinco días reproduciendo un artículo de investigación cuyo código nunca había visto, y luego superó los resultados del propio artículo por 2,7 puntos. En un concurso de aprendizaje automático de 24 horas, terminó por delante de 458 de 526 equipos humanos.

Diseñado para ejecutarse dentro de las herramientas de un rival

Qwen3.8-Max incluye instrucciones para Claude Code y Codex, las herramientas de codificación creadas por Anthropic y OpenAI. La API de Alibaba habla los protocolos de ambas compañías. La mayoría de sus puntos de referencia de codificación se ejecutaron dentro de Claude Code.

Y esos puntos de referencia no lo favorecen. En 31 pruebas de texto, Fable 5 de Anthropic obtiene 15 primeros lugares, GPT-5.6 Sol de OpenAI obtiene nueve, Qwen obtiene siete. En las 12 pruebas de codificación, Qwen gana exactamente una. Sin embargo, en términos de costos de inteligencia, este modelo es extremadamente barato y eficiente, lo que significa que incluso si requiere más iteraciones o razonamiento, el costo de completar el trabajo será mucho menor, casi el 30% de lo que cobra Claude Fable 5.

Dicho esto, si pasamos al trabajo multimodal—documentos, video, razonamiento espacial—las clasificaciones se invierten. Qwen lidera la mayor parte de esa tabla.

También hay una inversión en términos de estrategia empresarial. En abril, Alibaba eliminó el nivel gratuito de Qwen Code, con el equipo inclinándose hacia modelos cerrados y de pago después de las salidas de liderazgo. Nuestra reseña de Qwen 3.7 Max señaló que la versión Plus sería abierta mientras que Max permanecería bloqueado detrás de la API.

Esa puerta ahora está abierta, y el momento no es una coincidencia. Los modelos chinos de peso abierto pasaron de menos del 2% de los tokens en OpenRouter a finales de 2024 a aproximadamente el 61% a mediados de 2026. Qwen superó a Llama de Meta como el modelo más autoalojado del mundo.

Mientras tanto, Washington restringió Fable 5 y Mythos 5 bajo controles de exportación en junio, y Pekín está considerando según informes, límites propios sobre los modelos chinos que van al extranjero.

Así que Alibaba está perdiendo en el papel y ganando en distribución. Si puedes descargar algo que se acerque gratis, el segundo lugar es un buen lugar para estar.