Qwen 3.8-27B de código aberto da Alibaba: Apache 2.0, multimodal, roda em notebooks
A IA de código aberto deu mais um grande passo adiante. A equipe Qwen da Alibaba lançou em 14 de agosto o Qwen 3.8-27B, sob licença Apache 2.0. Este modelo multimodal com 27 bilhões de parâmetros, em alguns benchmarks de código e agentes, até se saiu melhor do que o Claude Opus 4.6 Max da Anthropic em desempenho autorrelatado. Um modelo multimodal com 27 bilhões de parâmetros também roda em notebooks. De acordo com o card oficial do modelo, o Qwen 3.8-27B tem cerca de 27,8 bilhões de parâmetros; a janela de contexto nativa é de 262.144 tokens, com extensão até 1 milhão, e suporta compreensão de texto, imagens e vídeos, com licença Apache 2.0 e uso comercial livre. Nesse patamar, após quantização, notebooks de alta categoria ou até um Mac também conseguem rodá-lo, refletindo a popularidade recente do debate sobre “IA local”: colocar um modelo gratuito e que funciona offline diretamente no próprio dispositivo.
Benchmark autorrelatado: em alguns itens, fica acima do Opus 4.6 Max. Segundo a comparação no card oficial do Qwen, o Qwen 3.8-27B em SWE-bench Pro (61,7 vs. 53,4), LiveCodeBench v6 (90,3 vs. 88,8) e OSWorld-Verified (84,3 vs. 72,7) obteve pontuações maiores do que o Claude Opus 4.6 Max; mas no Terminal Bench 2.1 ficou para trás (73,0 vs. 78,2). Vale lembrar que, nessa comparação, o Opus 4.6 Max usa “pontuações divulgadas oficialmente”, enquanto o Qwen foi avaliado usando o framework de testes do Claude Code; portanto, as condições não são exatamente as mesmas. Esses números ainda são autorrelatados pelos fabricantes e precisam de validação por terceiros.
A ala do código aberto segue se aproximando da fronteira
Em comparação com a geração anterior Qwen 3.6-27B, a versão mais recente evoluiu de forma clara em capacidades de agentes e de programação. Por exemplo, em OSWorld-Verified, saiu de 63,9 para 84,3, e em DeepSWE, de 13,3 para 42,2. Isso também dá continuidade à tendência recente dos modelos de código aberto de se aproximarem da fronteira fechada com baixo custo. Recentemente, foi noticiado o DeepSeek V4 Pro, que aposta em custo-benefício para competir com o Claude. Quando um modelo gratuito e implantável localmente consegue vencer ou empatar com modelos fechados de ponta em algumas tarefas, isso se torna uma pressão contínua sobre os preços e as “barreiras” (moat) da OpenAI e da Anthropic.
Este artigo “Qwen 3.8-27B de código aberto da Alibaba: Apache 2.0, multimodal, roda em notebooks” apareceu pela primeira vez em .
A IA de código aberto deu mais um grande passo adiante. A equipe Qwen da Alibaba lançou em 14 de agosto o Qwen 3.8-27B, sob licença Apache 2.0. Este modelo multimodal com 27 bilhões de parâmetros, em alguns benchmarks de código e agentes, até se saiu melhor do que o Claude Opus 4.6 Max da Anthropic em desempenho autorrelatado. Um modelo multimodal com 27 bilhões de parâmetros também roda em notebooks. De acordo com o card oficial do modelo, o Qwen 3.8-27B tem cerca de 27,8 bilhões de parâmetros; a janela de contexto nativa é de 262.144 tokens, com extensão até 1 milhão, e suporta compreensão de texto, imagens e vídeos, com licença Apache 2.0 e uso comercial livre. Nesse patamar, após quantização, notebooks de alta categoria ou até um Mac também conseguem rodá-lo, refletindo a popularidade recente do debate sobre “IA local”: colocar um modelo gratuito e que funciona offline diretamente no próprio dispositivo.
Benchmark autorrelatado: em alguns itens, fica acima do Opus 4.6 Max. Segundo a comparação no card oficial do Qwen, o Qwen 3.8-27B em SWE-bench Pro (61,7 vs. 53,4), LiveCodeBench v6 (90,3 vs. 88,8) e OSWorld-Verified (84,3 vs. 72,7) obteve pontuações maiores do que o Claude Opus 4.6 Max; mas no Terminal Bench 2.1 ficou para trás (73,0 vs. 78,2). Vale lembrar que, nessa comparação, o Opus 4.6 Max usa “pontuações divulgadas oficialmente”, enquanto o Qwen foi avaliado usando o framework de testes do Claude Code; portanto, as condições não são exatamente as mesmas. Esses números ainda são autorrelatados pelos fabricantes e precisam de validação por terceiros.
A ala do código aberto segue se aproximando da fronteira
Em comparação com a geração anterior Qwen 3.6-27B, a versão mais recente evoluiu de forma clara em capacidades de agentes e de programação. Por exemplo, em OSWorld-Verified, saiu de 63,9 para 84,3, e em DeepSWE, de 13,3 para 42,2. Isso também dá continuidade à tendência recente dos modelos de código aberto de se aproximarem da fronteira fechada com baixo custo. Recentemente, foi noticiado o DeepSeek V4 Pro, que aposta em custo-benefício para competir com o Claude. Quando um modelo gratuito e implantável localmente consegue vencer ou empatar com modelos fechados de ponta em algumas tarefas, isso se torna uma pressão contínua sobre os preços e as “barreiras” (moat) da OpenAI e da Anthropic.
Este artigo “Qwen 3.8-27B de código aberto da Alibaba: Apache 2.0, multimodal, roda em notebooks” apareceu pela primeira vez em .