Em resumo
- O Qwen3.8-Max executa 2,4 trilhões de parâmetros e é o primeiro modelo da classe Max que a Alibaba lançará com pesos abertos.
- Ele vem com instruções de configuração para o Claude Code da Anthropic e o Codex da OpenAI—ferramentas concorrentes.
- Na própria tabela de benchmarks da Alibaba, o Fable 5 vence 15 de 31 testes. O Qwen3.8-Max vence sete.
A Alibaba lançou o Qwen3.8-Max na segunda-feira, chamando-o de o modelo mais capaz que já construiu. Os pesos chegam ao Hugging Face e ao ModelScope na próxima semana—a primeira vez que a empresa disponibiliza um modelo na escala Max.
As especificações são grandes: 2,4 trilhões de parâmetros no total, com 95 bilhões ativados a qualquer momento. Parâmetros são o número de dials que um modelo é capaz de manipular.
Isso é extremamente importante para a eficiência, pois significa que não exigiria muitos recursos para ser executado. Pense nisso como uma biblioteca enorme onde apenas a prateleira relevante acende para cada pergunta. Pequenas empresas e laboratórios com hardware suficientemente bom agora podem executar um modelo de última geração sem gastar o mesmo que um enorme datacenter.
O post de lançamento da Alibaba pula a narrativa usual de busca por benchmarks e aposta na resistência. O modelo passou 16 dias construindo uma ferramenta de codificação sozinho—265 commits, 127 pull requests, 151 issues, sem nenhum humano tocando no teclado. Passou cinco dias reproduzindo um artigo de pesquisa para o qual nunca viu código, e depois superou os resultados do próprio artigo em 2,7 pontos. Em uma competição de aprendizado de máquina de 24 horas, terminou à frente de 458 de 526 equipes humanas.
Construído para rodar dentro das ferramentas de um concorrente
O Qwen3.8-Max vem com instruções para Claude Code e Codex, as ferramentas de codificação feitas pela Anthropic e OpenAI. A API da Alibaba fala os protocolos de ambas as empresas. A maioria de seus benchmarks de codificação foi executada dentro do Claude Code.
E esses benchmarks não o favorecem. Em 31 testes de texto, o Fable 5 da Anthropic leva 15 primeiros lugares, o GPT-5.6 Sol da OpenAI leva nove, o Qwen leva sete. Nos 12 testes de codificação, o Qwen vence exatamente um. No entanto, em termos de custo de inteligência, este modelo é extremamente barato e eficiente, o que significa que mesmo que exija mais iterações ou raciocínio, o custo de concluir o trabalho será muito menor, quase 30% do que o Claude Fable 5 cobra.

Dito isso, mude para o trabalho multimodal—documentos, vídeo, raciocínio espacial—e os rankings se invertem. Qwen lidera a maior parte dessa tabela.
Há também uma reversão em termos de estratégia de negócios. Em abril, a Alibaba eliminou o nível gratuito do Qwen Code, com a equipe se inclinando para modelos fechados e pagos após saídas de liderança. Nossa análise do Qwen 3.7 Max observou que a versão Plus seria aberta enquanto o Max permaneceria bloqueado atrás da API.
Essa porta agora está aberta, e o momento não é acidente. Os modelos chineses de pesos abertos passaram de menos de 2% dos tokens no OpenRouter no final de 2024 para aproximadamente 61% em meados de 2026. Qwen ultrapassou o Llama da Meta como o modelo mais auto-hospedado do mundo.
Enquanto isso, Washington restringiu o Fable 5 e o Mythos 5 sob controles de exportação em junho, e Pequim está supostamente considerando limites próprios para modelos chineses que vão para o exterior.
Então, a Alibaba está perdendo no papel e vencendo na distribuição. Se você pode baixar algo que chega perto de graça, o segundo lugar é um ótimo lugar para estar.






