Alibaba Qwen3.8-Max: 2,4 Trilhões de Parâmetros

No momento, você está visualizando Alibaba Qwen3.8-Max: 2,4 Trilhões de Parâmetros

A corrida global pela inteligência artificial mais capaz ganhou mais um concorrente de peso. A Alibaba acaba de apresentar o Qwen3.8-Max, seu maior modelo de IA até hoje, disponibilizado por meio da plataforma QwenCloud. E os números por trás dele são impressionantes o suficiente para chamar a atenção de quem acompanha o setor.

Se você quer entender o que esse lançamento representa na prática — e por que ele mexe com o equilíbrio de forças entre laboratórios chineses e americanos —, vale conhecer os detalhes a seguir.

Organização de TI

Um gigante que ativa só o necessário

O Qwen3.8-Max adota a arquitetura conhecida como “mistura de especialistas” (mixture of experts), e é aí que mora a sacada. Ele reúne 2,4 trilhões de parâmetros no total, mas ativa apenas 95 bilhões deles a cada solicitação. Essa estratégia serve justamente para reduzir os custos de inferência e diminuir o tempo de resposta.

Traduzindo para o dia a dia: em vez de acionar todo o cérebro do modelo para qualquer pergunta, ele convoca apenas as partes realmente relevantes para aquela tarefa. O resultado é um sistema enorme em capacidade, mas bem mais econômico e ágil na hora de trabalhar.

O modelo também é multimodal, ou seja, dá conta de texto, imagens e vídeo. E conta com uma janela de contexto que chega a 1 milhão de tokens, o que permite processar documentos extensos, bases de código inteiras e históricos longos de tarefas sem perder o fio da meada.

Foco em programação e trabalho autônomo

A Alibaba posiciona o Qwen3.8-Max principalmente para tarefas de programação e de trabalho colaborativo que exigem agentes de IA operando de forma independente por períodos prolongados. Essa é, aliás, a grande fronteira que todas as empresas de IA estão disputando no momento.

Os números divulgados pela empresa dão a dimensão dessa ambição. Segundo a Alibaba, o modelo concluiu um projeto interno de software ao longo de 16 dias e é capaz de conduzir trabalho autônomo de desenvolvimento de forma contínua por mais de 10 dias. É um salto considerável em relação à ideia de uma IA que apenas responde perguntas pontuais.

A companhia também afirma que o Qwen3.8-Max superou o GPT-5.6 Sol, da OpenAI, e o Claude Fable 5, da Anthropic, em diversos benchmarks de programação, capacidade agêntica, uso geral e multimodalidade. Vale um alerta importante aqui: esses resultados ainda não foram verificados de forma independente, então o ideal é encarar as comparações com um pouco de reserva até que testes externos confirmem os dados.

Disponibilidade e pesos abertos

Por enquanto, o modelo pode ser acessado através da QwenCloud. A boa notícia para desenvolvedores e pesquisadores é que os pesos do Qwen3.8-Max têm lançamento previsto para a semana seguinte no Hugging Face e no ModelScope.

Essa liberação faz diferença, porque permite que a comunidade experimente, avalie e adapte o modelo em seus próprios ambientes — algo que costuma acelerar bastante a validação real das capacidades anunciadas.

A escalada dos modelos chineses

O lançamento não acontece isolado. Ele vem na esteira de outros grandes modelos chineses, como o Kimi K3, da Moonshot AI, num momento em que a competição com os laboratórios norte-americanos só se intensifica.

Esse movimento mostra que a disputa pela liderança em IA deixou de ser um jogo restrito a poucos nomes do Vale do Silício. Com modelos cada vez maiores, mais eficientes e frequentemente com pesos abertos, os laboratórios chineses vêm pressionando o mercado tanto em capacidade técnica quanto em acessibilidade.

O que esperar daqui para frente

No conjunto, o Qwen3.8-Max reforça uma tendência clara: o foco agora está em modelos que conseguem trabalhar sozinhos por longos períodos, lidando com projetos complexos do início ao fim. Janelas de contexto gigantescas e arquiteturas que economizam recursos deixaram de ser diferencial e viraram requisito para competir no topo.

Para quem desenvolve software ou pensa em incorporar agentes de IA ao fluxo de trabalho, vale acompanhar de perto o que acontece quando os pesos forem liberados e testes independentes começarem a sair. É aí que saberemos se as promessas se sustentam fora do laboratório — e, se sustentarem, a concorrência entre os grandes modelos promete ficar ainda mais acirrada.

Qwen

Deixe um comentário