Um cartão de título para o artigo Qwen3.8-27B e Artificial Analysis: uma lupa pairando sobre um chip com um cartão de pontuação vazio 'aguardando dados', intitulado 'Qwen3.8-27B no Artificial Analysis' com o subtítulo 'Nenhuma pontuação independente ainda — aqui estão os dados que servem de referência'.
Guides & Insights

Qwen3.8-27B no Artificial Analysis: Ainda Sem Índice, e os Dados que o Substituem

Autor

Magnus Corvin

Data de publicação

Modelos mais recentes · 20Ver todos os modelos
Benchmarks: Artificial Analysis · atualizado diariamente
Voltar para todas as publicações

A Artificial Analysis não indexou o Qwen3.8 27B. Verificado em 2026-08-15, a página do modelo em artificialanalysis.ai retorna 404 — sem Intelligence Index, sem velocidade de saída, sem preço AA, sem benchmark independente. Os pesos Apache 2.0 foram disponibilizados em 13 e 14 de agosto, então isso provavelmente mudará em dias ou semanas; ainda não mudou. Até que isso aconteça, todo número do Qwen3.8 27B que você encontrar é a ficha técnica da própria Ali​baba ou um veículo de imprensa repetindo-a. Aqui está a resposta em uma linha, os dados da AA que existem para a família Qwen3.8, as especificações oficiais e uma leitura honesta do que realmente são as manchetes de “bate tudo”.

Nota sobre as fontes: tudo abaixo está rotulado. Oficial significa retirado da ficha do modelo Qwen/Qwen3.8-27B da Ali​baba no Hugging Face (agosto de 2026). Independente significa medido e reproduzido por uma parte externa — ainda nada se qualifica para o 27B. Repassado significa que um veículo de imprensa copia números do fornecedor, o que não é independente.

A resposta de uma linha, datada

Qwen3.8 27B no Artificial Analysis: sem página, sem pontuação. A URL artificialanalysis.ai/models/qwen-3-8-27b retornou "404 Page not found" quando verificada em 2026-08-15.

• As pontuações AA do "Qwen 3.8" que circulam online — Inteligência 58, Índice Agêntico #1 — pertencem ao Qwen3.8-Max, o carro-chefe da API de 2,4T de parâmetros. Não ao de 27B.

• O 27B mais recente que a AA rastreia é o predecessor Qwen3.6-27B: Índice de Inteligência ~37–38 em modo de raciocínio, ~55–59 tokens/seg de saída. Essa é a sua referência para como um 27B indexado se parece.

A status card for Qwen3.8-27B on Artificial Analysis, checked 2026-08-15: the model is marked NOT INDEXED (no page, no score, no price; the model URL returns 404), while Qwen3.8-Max 2.4T A95B is indexed at Intelligence 58 and Agentic Index #1, and the predecessor Qwen3.6-27B is indexed at Intelligence ~37–38 and ~55–59 tokens/sec.

O que a Artificial Analysis realmente mostra para a família Qwen3.8

O leaderboard da AA lista "Qwen3.8 2.4T A95B" — que é o Qwen3.8-Max — com Intelligence Index 58, o segundo melhor modelo de pesos abertos no índice (página de modelos do Artificial Analysis, acessada em 15 de agosto de 2026). Em 6 de agosto de 2026, o Agentic Index da AA classificou o Qwen3.8-Max em 1º lugar no ranking global — a primeira vez que um laboratório chinês alcançou o topo, à frente do Claude Opus 5 e do GPT-5.6 — como amplamente noticiado a partir do leaderboard da AA naquele dia.

Nenhum desses números se transfere para o 27B. Qwen3.8-Max é um modelo de API de mistura de especialistas com 2.4T de parâmetros e aproximadamente 95B de parâmetros ativos; o 27B é um download denso e auto-hospedável. Eles compartilham um rótulo de geração, não uma avaliação.

O predecessor é sua linha de base: Qwen3.6-27B em AA

AA acompanha o Qwen3.6-27B há meses. Dependendo do snapshot, ele pontua ~37–38 no Intelligence Index em modo de raciocínio (cerca de 31 em modo sem raciocínio) a ~55–59 tokens/seg — um modelo de GPU única que se mantém firme contra modelos de fronteira de médio porte de um ano atrás. Esse é o formato dos dados a esperar quando a AA indexar o 3.8-27B: um índice na mesma faixa, uma velocidade em hardware de consumo e um preço que reflete principalmente a escolha de hospedagem. Trate-o como uma linha de base, não uma previsão — o 3.8-27B adiciona atenção híbrida e entrada de vídeo nativa, qualquer uma das quais pode alterar os números.

Os dados oficiais: o cartão do modelo da Ali​baba, não independente.

A data card for Qwen3.8-27B from Alibaba's official model card: specifications (27B dense, 28B with vision encoder, 64 layers, hidden size 5,120, vocabulary 248,320, 48 linear + 16 full attention heads, 262K native to 1M context via YaRN, text+image+video input, ~55.6 GB BF16) and vendor-reported benchmarks (Terminal-Bench 2.1 73.0, SWE-bench Pro 61.7, LiveCodeBench v6 90.3, GPQA Diamond 89.2, OSWorld-Verified 84.3), labeled Alibaba-reported, unreproduced.

Estas são as especificações verificadas do cartão do modelo Qwen/Qwen3.8-27B (Apache 2.0, agosto de 2026):

• 27B parâmetros densos (28B com o codificador de visão), 64 camadas, tamanho oculto 5.120, vocabulário 248.320.

• Atenção híbrida: 48 cabeças de atenção linear (Gated DeltaNet) mais 16 cabeças completas de Atenção Gated — aproximadamente uma divisão de 3:1 entre linear e completa.

• Contexto: 262.144 tokens nativos, expansível para 1.000.000 via YaRN.

• Entrada: texto, imagem e vídeo nativamente; modo de raciocínio ativado por padrão.

• Tamanho: ~55,6 GB em BF16; ~16–17 GB de pesos em Q4 — uma GPU de 24 GB é o alvo prático de placa única.

Benchmarks relatados pelo fornecedor da mesma placa (palavra da Ali​baba, não reproduzidos): Terminal-Bench 2.1 73.0; SWE-bench Pro 61.7; LiveCodeBench v6 90.3; GPQA Diamond 89.2; OSWorld-Verified 84.3.

O que as manchetes "it beats everything" realmente são

Uma retransmissão de notícias de tecnologia chinesa (Gate.it, meados de agosto de 2026) abre com "Qwen3.8 27B supera o Muse Glimmer da Meta em todos os 8 benchmarks" — Terminal-Bench 2.1 73,0 vs 51,7, SWE-bench Pro 61,7 vs 51,2 — e afirma vitórias sobre o Claude Opus 4.6 em 15 dos 19 testes em comum. Esses números são os da ficha técnica do modelo da Ali​baba, copiados em um resumo de notícias. Nenhum laboratório externo executou o 27B, e a retransmissão não afirma que alguém o fez. "Cobertura de terceiros" aqui significa repetição por terceiros, não verificação por terceiros.

A screenshot of the Qwen/Qwen3.8-27B model card on Hugging Face, showing the Apache 2.0 license, the model type 'Causal Language Model with Vision Encoder', BF16 tensor type, the note that the Qwen Cloud hosted version is coming soon with 1M context, and 4 adapters, 46 finetunes and 304 quantizations.

Por que não há preço AA para o 27B — e o que isso te diz

AA precifica modelos por endpoint de API. O 27B ainda não tem uma API hospedada oficial: a hospedagem do Qwen Cloud da Alibaba está "em breve" com um contexto de 1M de tokens. Não há nada para precificar. Esse é o contraste real no centro deste modelo. Qwen3.8 27B é um download de pesos abertos; o preço é a sua conta de eletricidade. Em Q4, em uma placa de 24 GB, custa $0 por token. O carro-chefe exclusivo de API Qwen3.8-Max custa $2 por milhão de entrada / $6 por milhão de saída. Um modelo auto-hospedado não aparece em um índice de preços de API justamente porque é gratuito por token — o oposto da situação de todos os modelos de API que a AA precifica.

O que usar até a AA indexar

Você quer um Qwe​n 27B avaliado de forma independente hoje: rode ou chame Qwen3.6-27B. Ele é classificado como AA (Inteligência ~37–38 em modo de raciocínio), Apache 2.0, auto-hospedável, e é o modelo que o 3.8-27B precisa superar. Se você preferir chamá-lo via API em vez de executá-lo, ele está no catálogo do OrcaRouter ao preço de tabela do provedor com 0% de acréscimo — uma chave, sem segundo contrato.

Você quer o carro-chefe da API: Qwen3.8-Max tem índice AA de 58 e é o #1 em Agentic, a US$ 2/US$ 6 por 1M de tokens. Você está pagando por um MoE de 2.4T, não por um modelo local.

Você quer o 3.8-27B especificamente: baixe os pesos Apache-2.0 e faça self-host. Trate cada benchmark como palavra da Ali​baba até que um harness independente publique. Acompanhe a página do modelo AA (artificialanalysis.ai/models/qwen-3-8-27b) e os harnesses abertos — quando um número real surgir, será óbvio.

O resultado final

O Qwen3.8 27B não tem pontuação no Artificial Analysis porque o Artificial Analysis não o mediu — e não tem preço AA porque é um modelo auto-hospedado, não uma API. Toda manchete "Qwen 3.8 vence X" que você encontrar hoje é o model card da Alibaba fantasiado de notícia. Os números genuinamente independentes nesta história pertencem aos irmãos: Qwen3.8-Max com 58 de Inteligência e #1 no Agentic Index, e Qwen3.6-27B com ~37–38. Apoie-se nesses; trate os valores do próprio 27B como alegações do fornecedor até que alguém independente o teste. Volte mais tarde — esta página mudará no dia em que a AA publicar.

© 2026 OrcaRouter

Para provedores

Opera uma plataforma de inferência? Traga seus modelos para o OrcaRouter.

providers@orcarouter.ai

Junte-se à comunidade

Discordsupport@orcarouter.aiXGitHubYouTube