A Alibaba ampliou sua ofensiva em modelos abertos de inteligência artificial com o lançamento do Qwen3.8-27B e a liberação dos pesos do Qwen3.8-2.4T-A95B, seu modelo mais avançado até agora. A companhia informou que as duas versões estão disponíveis para desenvolvedores, com distribuição pelo Hugging Face e, no caso do modelo principal, também pelo ModelScope.

A movimentação coloca sob licença Apache 2.0 desde um modelo de 27 bilhões de parâmetros capaz de funcionar em hardware de consumo até uma arquitetura Mixture of Experts (MoE) com 2,4 trilhões de parâmetros totais.

O Qwen3.8-27B chamou atenção logo após o lançamento. Em dois dias, entrou entre os cinco modelos com mais curtidas no Hugging Face, segundo os dados apresentados pela Alibaba.

Data from Hugging Face

Modelo de 27B pode rodar localmente

O Qwen3.8-27B é um modelo multimodal denso, com capacidade de processar texto, imagens e vídeos. A Alibaba posiciona a versão como uma alternativa para aplicações que precisam equilibrar desempenho, infraestrutura e custo.

Com quantização, técnica usada para reduzir o consumo de memória de modelos, a companhia afirma que o Qwen3.8-27B pode ser executado até mesmo em um laptop. Sem essa otimização, o modelo ainda foi projetado para operar em equipamentos de nível consumidor.

Apesar de ter 27 bilhões de parâmetros, o Qwen3.8-27B alcança desempenho comparável ao Qwen3.7-plus em diferentes tarefas avaliadas pela empresa. O modelo anterior utiliza arquitetura MoE e possui aproximadamente dez vezes mais parâmetros totais.

A nova versão também foi desenvolvida para programação, pesquisa, atividades profissionais e operações realizadas por agentes de IA durante sequências mais longas de ações.

O contexto nativo chega a 262 mil tokens e pode ser estendido para até 1 milhão. Isso permite que o sistema processe grandes bases de documentos, históricos extensos de interação ou fluxos prolongados de trabalho sem dividir o material em tantas etapas.

Alibaba também abre seu modelo de 2,4 trilhões de parâmetros

A companhia foi além da versão compacta e liberou os pesos do Qwen3.8-2.4T-A95B, apresentado como o principal modelo da atual geração Qwen.

A arquitetura possui 2,4 trilhões de parâmetros no total, mas utiliza cerca de 95 bilhões de parâmetros ativos durante a execução. Essa é uma das características do modelo MoE: apenas uma parcela da rede é acionada para cada processamento.

O Qwen3.8-2.4T-A95B também suporta contexto de até 1 milhão de tokens.

Segundo a Alibaba, esta é a primeira vez que um modelo da classe Qwen-Max — faixa reservada aos sistemas de maior capacidade da empresa — recebe uma versão aberta.

Os pesos podem ser baixados pelo Hugging Face e pelo ModelScope, plataforma de modelos iniciada pela própria Alibaba.

A licença permite que empresas e desenvolvedores modifiquem, redistribuam e utilizem comercialmente o modelo, respeitadas as condições da Apache 2.0.

Modelo aparece entre líderes em programação e agentes

O Qwen3.8-2.4T-A95B também começou a aparecer nas primeiras posições de avaliações independentes.

Na CodeArena, ranking da Arena AI direcionado a desenvolvimento web front-end, o modelo alcançou a terceira colocação global.

Ele também ficou em terceiro lugar no Agentic Index da Artificial Analysis, benchmark voltado à capacidade de modelos executarem tarefas de forma autônoma e coordenarem múltiplas etapas.

Os resultados reforçam uma das principais áreas de disputa entre os laboratórios de IA em 2026: modelos capazes não apenas de responder perguntas, mas de planejar, utilizar ferramentas e concluir fluxos de trabalho mais extensos.

Qwen ultrapassa 3 bilhões de downloads

Os novos lançamentos chegam em um momento de rápida expansão do ecossistema Qwen.

Considerando Hugging Face e ModelScope, a Alibaba afirma já ter disponibilizado mais de 460 modelos abertos. Eles deram origem a mais de 300 mil modelos derivados e acumularam mais de 3 bilhões de downloads globalmente.

Dados publicados pelo Hugging Face no relatório State of Open Models: Summer 2026 Observations também mostram a dimensão do ecossistema.

O Hub registrava 151.448 modelos derivados do Qwen, número equivalente a aproximadamente 2,6 vezes toda a presença de modelos derivados da Meta na plataforma e 4,7 vezes o número associado especificamente aos repositórios Llama, conforme o levantamento.

Entre janeiro e julho de 2026, repositórios baseados em Qwen com número de parâmetros declarado acumularam cerca de 2,045 bilhões de downloads no Hugging Face.

O próprio Hugging Face apontou o Qwen como uma das principais bases utilizadas pela comunidade para criar, adaptar e implantar novos modelos.

A combinação de diferentes tamanhos, ciclos frequentes de lançamento e licença permissiva tem ampliado o uso da família tanto em experimentos quanto em sistemas destinados à produção.

Ecossistema avança também sobre agentes multimodais

A estratégia aberta da Alibaba não se limita aos modelos.

A empresa também disponibilizou recentemente o Qwen-MM-Plugins, uma biblioteca criada para incorporar recursos multimodais a frameworks de agentes.

O projeto oferece componentes para processamento de imagens e vídeos, memória multimodal, suporte a resoluções variáveis e utilização de ferramentas a partir de informações visuais.

Com a nova geração Qwen3.8, a Alibaba passa a oferecer no mesmo ecossistema desde modelos que podem ser executados localmente até uma arquitetura de 2,4 trilhões de parâmetros.

A amplitude dessa oferta aumenta a pressão competitiva no mercado de modelos abertos, onde capacidade técnica, custo de execução e facilidade para desenvolvedores passaram a disputar espaço ao lado do desempenho bruto.

Continue no Radar