Alibaba anuncia Qwen3.8-Max, IA de 2,4 trilhões de parâmetros
Além do Qwen3.8-Max, Alibaba prepara o Qwen3.8-27B com pesos abertos para execução local ou infraestrutura própria.
Ainda hoje (segunda-feira, 3), a Alibaba anunciou o Qwen3.8-Max, novo modelo da linha Qwen voltado a programação e tarefas de agentes de longa duração. Com 2,4 trilhões de parâmetros totais e suporte a texto, imagens e vídeo, a IA ativa 95 bilhões de parâmetros por solicitação e tem janela de contexto de até 1 milhão de tokens. Veja os detalhes:
A empresa descreveu o Qwen3.8-Max como seu maior modelo e afirmou que liberará os pesos na próxima semana no Hugging Face e no ModelScope. Ainda não há licença, model card ou requisitos de hardware divulgados.
Modelo mira agentes que podem trabalhar por vários dias
O Qwen3.8-Max usa uma arquitetura de mistura de especialistas (Mixture of Experts, ou MoE), na qual apenas uma parte do modelo entra em ação a cada solicitação. Segundo a Alibaba, isso deve reduzir custo de inferência e tempo de resposta em comparação com modelos densos.
A proposta é usar essa capacidade em agentes que executam tarefas completas. Em um teste interno, a empresa diz que a IA trabalhou 16 dias em um projeto de engenharia de software e criou o framework de linha de comando oh-my-cli sem intervenção humana.

O modelo também processa informações visuais de forma nativa. A Alibaba afirma que ele pode analisar documentos, vídeos e interfaces para reconstruir aplicações e criar projetos web a partir de capturas de tela.
A versão já está disponível por API no Alibaba Cloud Model Studio. Em uma publicação no X, a Qwen informou preços de US$ 2 por milhão de tokens de entrada e US$ 6 por milhão de tokens de saída.
Qwen3.8-27B deve ser a opção mais viável fora da nuvem
Além do modelo de 2,4 trilhões de parâmetros, a Alibaba também prometeu liberar os pesos abertos do Qwen3.8-27B na próxima semana. A versão menor deve ser mais adequada para desenvolvedores e empresas que pretendem executar ou ajustar o modelo em infraestrutura própria.
A Unsloth, desenvolvedora de ferramentas para modelos locais, afirma que o Qwen3.8-27B poderá rodar em configurações com cerca de 17 GB de RAM/VRAM. O dado coloca o modelo em uma faixa mais próxima de PCs intermediários do que o Qwen3.8-Max, que tem 2,4 trilhões de parâmetros e exigirá infraestrutura de data center para execução local.
Ainda assim, esse número ainda não deve ser tratado como requisito definitivo. A postagem não detalha a quantização, a janela de contexto ou como a memória será dividida entre RAM e VRAM, fatores que podem alterar bastante o consumo e a velocidade. A Alibaba também não divulgou a arquitetura, o tamanho dos arquivos ou a licença do Qwen3.8-27B.
- Veja também: Claude Opus 5 chega com desempenho perto do Fable 5
Por isso, os pesos e os primeiros testes serão importantes para confirmar em quais computadores o modelo realmente funcionará de forma prática. Mesmo com essa ressalva, o anúncio é relevante para quem acompanha IA local e já usa versões menores da família Qwen fora dos serviços em nuvem.
Comparativos divulgados pela Alibaba ainda são internos
A Alibaba publicou tabelas que comparam o Qwen3.8-Max com Claude Opus 4.8, Claude Fable 5 e GPT-5.6 Sol. Em PaperBench, por exemplo, o modelo alcançou 93 pontos, acima dos 90,5 pontos do GPT-5.6 Sol e dos 88,8 pontos do Fable 5.
Os resultados não colocam o Qwen à frente em todos os testes. No TerminalBench 2.1, o Qwen3.8-Max registrou 86,6, abaixo dos 88,8 do GPT-5.6 Sol. Já no SWE-bench Pro, o Fable 5 chegou a 80 pontos, enquanto o modelo da Alibaba marcou 67,7.
Por isso, os números mostram o posicionamento que a Alibaba quer dar ao produto, mas ainda não substituem avaliações independentes. A liberação dos pesos pode facilitar testes reproduzíveis e indicar custo, velocidade e qualidade em tarefas reais.
O que você achou do Qwen3.8-Max? Deixe o que você achou nos comentários e nas redes sociais do Hardware em Ponto!
Fontes: Qwen, Alibaba, Unsloth, TechNode, InfoWorld, The Edge e Neowin.