Alibaba abre os pesos do Qwen3.8: modelo de 27 bilhões roda localmente e versão Max-class tem licença com limites
O Qwen3.8-27B saiu sob Apache 2.0 e rende bem em testes de terceiros. O modelo de 2,4 trilhões tem licença própria, que limita o uso por grandes empresas.
A Alibaba publicou em agosto de 2026, no Hugging Face, os pesos de dois modelos da geração Qwen3.8 com perfis bem diferentes. O Qwen3.8-27B, um modelo denso e multimodal de 27 bilhões de parâmetros, saiu sob a licença Apache 2.0. Já o Qwen3.8-2.4T-A95B, base do serviço Qwen3.8-Max, é segundo a empresa o primeiro modelo da classe Max do Qwen com pesos abertos, mas vem com licença própria e restrições comerciais.
O modelo de 27 bilhões
Pelo cartão do modelo, o Qwen3.8-27B entende texto, imagem e vídeo e tem contexto nativo de 262.144 tokens, expansível até 1 milhão. A VentureBeat relatou em 17/8 que o modelo chegou ao Hugging Face numa sexta-feira e virou o lançamento mais comentado entre desenvolvedores. Segundo a revista, rodar o modelo em 16 bits exige cerca de 56 GB de memória de GPU; em FP8, cerca de 28 GB; quantizado em 4 bits, o arquivo cai para cerca de 17 GB, ao alcance de desktops e notebooks potentes.
Nos testes da Artificial Analysis, citados pela VentureBeat, o modelo marcou 52 no Intelligence Index, a mesma nota do GPT-5.6 Luna no raciocínio máximo, e 51 no índice de tarefas agênticas. Na mesma comparação, superou o Claude Opus 4.8 no esforço máximo. Os números da própria Alibaba incluem 61,7 no SWE-bench Pro, mas a revista alerta que parte das avaliações é interna e que as condições de teste variam.
Limites práticos
O ganho tem custo: a Artificial Analysis contou 160 milhões de tokens de saída na bateria de testes do modelo, contra uma mediana de 43 milhões para modelos abertos comparáveis. Segundo a VentureBeat, o desenvolvedor Simon Willison levou 21 minutos para obter um SVG, porque o modelo vem configurado no nível máximo de raciocínio. Ele recomenda começar com raciocínio baixo ou desligado, e relatou entre 15 e 30 tokens por segundo no LM Studio.
A versão Max-class
O Qwen3.8-2.4T-A95B é um modelo de mistura de especialistas com 2,4 trilhões de parâmetros, dos quais 95 bilhões ficam ativos por token. Pelo cartão, ele só trabalha com texto e sempre no modo de raciocínio, que não pode ser desligado. Visão, modo sem raciocínio, contexto padrão de 1 milhão de tokens e ferramentas embutidas ficam no serviço pago Qwen3.8-Max. A licença permite uso comercial, mas impõe duas condições. Produtos com mais de 100 milhões de usuários mensais ou US$ 20 milhões de receita mensal devem exibir o nome do modelo na interface. Empresas que oferecem modelos como serviço ou assistentes de código e de escritório, com receita acima de US$ 50 milhões em 12 meses, precisam de licença separada; o uso interno fica isento.
Para quem desenvolve, a escolha é clara: o 27B é a opção realista para rodar localmente com licença permissiva; o Max-class exige infraestrutura de data center e uma leitura cuidadosa da licença antes do uso comercial.
Fontes
- Qwen (Hugging Face) — Qwen/Qwen3.8-27B — cartão do modelo (14/08/2026)
- Qwen (Hugging Face) — Qwen/Qwen3.8-2.4T-A95B — cartão do modelo (12/08/2026)
- Qwen (Hugging Face) — Qwen3.8-Max License (12/08/2026)
- VentureBeat — Qwen3.8-27B runs frontier-class coding agents and reasoning locally, no cloud API required (17/08/2026)
Imagem destacada: ilustração gerada por computador, sem valor documental.


