A equipe Qwen da Alibaba publicou os pesos do Qwen3.8-27B em 14 de agosto, disponibilizando-os no Hugging Face e no ModelScope sob a licença Apache 2.0.

O que é o modelo

Um modelo de visão e linguagem denso de 27B parâmetros — não uma mixture-of-experts — que abrange texto, imagens e vídeo de várias horas. A arquitetura é híbrida em 64 camadas: dezesseis blocos de três camadas Gated DeltaNet alimentando uma rede, cada um seguido por um único bloco Gated Attention. O contexto nativo é de 262.144 tokens, extensível para cerca de 1M com YaRN, e o modo de raciocínio pode ser desativado.

A alegação

A Qwen afirma que o modelo de 27B supera o substancialmente maior Qwen3.7-Plus em programação e tarefas de escritório. Sua ficha informa SWE-bench Pro 61.7, Terminal Bench 2.1 73.0, OSWorld-Verified 84.3, GPQA Diamond 89.2, MathVision 94.6 com code interpreter e CharXiv 90.2.

Leia a licença com precisão

Apache 2.0 aqui é real: os pesos podem ser baixados e usados comercialmente sem uma licença customizada. Mas os dados de treinamento e o código de treinamento não foram divulgados, então isto são pesos abertos, não código aberto — uma distinção que importa para quem precisa auditar o que o modelo aprendeu, e não apenas executá-lo.

E leia os benchmarks da mesma forma

Todos os números acima são autorrelatados pela Alibaba em sua própria ficha do modelo, sem replicação independente até agora. Um modelo pequeno e denso superando um irmão muito maior é exatamente o tipo de comparação que costuma encolher em avaliações de terceiros, porque o fornecedor escolhe tanto o ambiente quanto a base de comparação. A API oficial está listada como “em breve”, e uma versão hospedada com contexto de 1M é prometida no Qwen Cloud.

O que realmente há de novo aqui

O nome Qwen 3.8 não é novo. Ele foi usado em julho para o fechado Qwen3.8-Max, e o modelo mixture-of-experts aberto e muito maior Qwen3.8-2.4T-A95B foi publicado dois dias antes. A novidade é que agora saiu a versão pequena, densa e executável localmente da família — justamente a camada que a maioria das pessoas consegue realmente implantar.