Um cartão de título para o artigo 'Qwen3.8-27B Release Date' mostrando um calendário marcando a semana de 10 de agosto de 2026 como a janela de lançamento prometida, com um selo 'status: pendente', um subtítulo mencionando o anúncio de 3 de agosto de 2026 e um gráfico empilhado de camadas do modelo.
Guides & Insights

Data de lançamento do Qwen3.8-27B: tudo o que sabemos até agora

Autor

Jim Song

Data de publicação

Modelos mais recentes · 20Ver todos os modelos
Benchmarks: Artificial Analysis · atualizado diariamente
Voltar para todas as publicações

A Alibaba prometeu os pesos abertos do Qwen3.8-27B para a semana de 10 de agosto de 2026, e essa janela passou. Agora o atraso tem um alvo concreto: a página oficial do Qwe​n no ModelScope está exibindo uma contagem regressiva até a meia-noite de 15 de agosto de 2026 — 00:00 JST, de acordo com o relatório de 13 de agosto do PC Watch sobre o teaser. Os pesos ainda não apareceram na organização oficial do Qwe​n no Hugging Face até hoje, mas a questão da data de lançamento agora tem uma resposta pela primeira vez desde o anúncio de 3 de agosto. Aqui está o que está confirmado, o que ainda não foi verificado e o que observar.

O que está confirmado

Em 3 de agosto de 2026, a Alibaba anunciou a geração Qwen3.8. Duas coisas aconteceram nesse dia: o Qwen3.8-Max, o carro-chefe mixture-of-experts de 2,4 trilhões de parâmetros, entrou no ar com uma API paga, e a Alibaba se comprometeu a abrir os pesos tanto do Max quanto do menor Qwen3.8-27B "em cerca de uma semana". Vários veículos independentes (36Kr, TrendForce, C114) divulgaram o mesmo compromisso: Hugging Face e ModelScope, na semana de 10 de agosto.

O 27B é o membro auto-hospedável da geração — a Alibaba o posicionou como dimensionado para trabalho com GPU única e on-premise, o sucessor direto do amplamente usado Qwen3.6-27B. Essa linhagem importa. O Qwen3.6-27B se tornou um dos modelos locais de codificação mais populares de sua geração, e a versão 3.8 herda essa base instalada de perguntas: quanto custa para rodar, é melhor em agentes, quando posso baixá-lo.

O que é {{1}}verificável de forma independente hoje{{/1}} é o {{2}}carro-chefe{{/2}}, e isso agora inclui {{3}}pesos abertos{{/3}}. {{4}}Qwen3.8-Max{{/4}} está {{5}}disponível na API{{/5}}, e seus {{6}}repositórios{{/6}} — {{7}}Qwen3.8-2.4T-A95B{{/7}} ({{8}}BF16 completo{{/8}}) e uma {{9}}quantização FP8 oficial{{/9}} — {{10}}foram publicados na organização oficial Qwe​n no Hugging Face{{/10}} {{11}}na semana de 10 de agosto{{/11}}, {{12}}a primeira vez que a Alibaba disponibilizou como código aberto um carro-chefe da classe Max{{/12}}. {{13}}Ele já foi avaliado também{{/13}}: a {{14}}Artificial Analysis{{/14}} coloca seu {{15}}Índice de Inteligência em 58{{/15}}, {{16}}o mais próximo que um laboratório chinês chegou do topo dessa tabela{{/16}}, seu {{17}}Índice de Codificação em 71,8{{/17}} e seu {{18}}preço em US$ 2,00 por milhão de tokens de entrada e US$ 6,00 por milhão de tokens de saída{{/18}}.

Artificial Analysis profile page for Qwen3.8-Max, showing an Intelligence Index of 58, an output speed of 48.4 tokens per second, $2.00/$6.00 per-million-token pricing, a 1M-token context window, and a summary describing it as leading in intelligence but slow and verbose.

Como um "lançamento" realmente se parece para um modelo de pesos abertos

Uma pergunta sobre data em um modelo fechado é simples — a API é ativada. Para um modelo de pesos abertos, "lançado" tem camadas, e cada camada chega com dias de diferença:

Os pesos brutos aparecem como um repositório Hugging Face e ModelScope, com um cartão de modelo e um arquivo LICENSE.

Os frameworks de inferência seguem — espera-se que vLLM e SGLang adicionem suporte em poucos dias, o que é o sinal de que um modelo está pronto para servir e não apenas para download.

As quantizações da comunidade (GGUF, AWQ) normalmente ficam disponíveis uma a duas semanas depois, que é quando os usuários do Ollama, LM Studio e llama.cpp conseguem de fato baixá-las e executá-las.

Então, se a pergunta é "quando posso baixar os pesos", a resposta é um repositório aparecendo na organização oficial Qwe​n. Se a pergunta é "quando posso executá-lo com um único comando", adicione uma a duas semanas. A promessa de 3 de agosto visava a primeira dessas para a semana de 10 de agosto — e essa camada agora chegou para um membro da geração: Qwen3.8-2.4T-A95B foi publicado no Hugging Face naquela semana. Para o 27B especificamente, ainda não foi publicado no Hugging Face — mas a contagem regressiva do ModelScope agora nomeia um alvo: 15 de agosto de 2026 às 00:00 JST.

O que ainda não está verificado

Tudo o mais sobre o 27B é especulativo até o lançamento do repositório. Não deixe que a cobertura confiante converta projeções em especificações — nada do que se segue está confirmado no momento em que este texto foi escrito:

• Arquitetura — densa ou mixture-of-experts, e a contagem de parâmetros ativos se for MoE.

• Janela de contexto, limites de saída e se é somente texto ou multimodal. O teaser do ModelScope, segundo o PC Watch, descreve suporte nativo multimodal e multilíngue para imagens e vídeo — declarado pelo fornecedor no teaser, ainda não verificado até que os pesos sejam lançados.

• A licença. Apache 2.0 não é uma suposição segura; lançamentos abertos recentes do Qwe​n foram distribuídos sob a licença Tongyi Qianwen, que contém uma cláusula de 100 milhões de usuários ativos mensais que aciona discussão comercial além desse limite.

• Quaisquer pontuações de benchmark. Todos os números que circulam para a geração 3.8 são reportados pelo fornecedor para o Max; o 27B não tem nenhuma avaliação pública.

Tamanhos quantizados exatos. Os valores de VRAM em circulação são projeções herdadas do Qwen3.6-27B, não medições do modelo 3.8.

A two-column infographic for Qwen3.8-27B contrasting 'Confirmed' facts (announced Aug 3 2026, weights promised week of Aug 10, target platforms Hugging Face and ModelScope, ~27B params, successor to Qwen3.6-27B) with 'Unverified' items (architecture, context window, license, benchmarks, quantized VRAM), with a footer noting no official repository had appeared as of Aug 12, 2026.

Por que a licença importa mais do que a data

A data de lançamento determina quando você pode começar a testar. A licença determina se você pode distribuir. Um modelo Qwe​n sob a licença Tongyi Qianwen é gratuito para uso abaixo de 100 milhões de usuários ativos mensais — acima disso, espera-se que você negocie termos comerciais. Para um modelo local que as equipes integrarão em produtos e agentes, esse limite pode chegar mais rápido do que parece. O primeiro arquivo a abrir no repositório é a LICENSE, antes do model card e antes do README.

Como captar a queda antes que os posts de blog o façam.

{{1}}A organização oficial Qwen no Hugging Face é a fonte da verdade{{/1}} — {{2}}quando um repositório chamado Qwen3.8-27B aparecer lá, ou no ModelScope, o lançamento aconteceu.{{/2}} {{3}}O mecanismo já se provou esta semana:{{/3}} {{4}}Qwen3.8-2.4T-A95B e sua variante FP8 apareceram na organização exatamente dessa forma,{{/4}} {{5}}então o repositório 27B será igualmente inconfundível.{{/5}} {{6}}No ModelScope, uma página de contagem regressiva para Qwen3.8-27B já está no ar,{{/6}} {{7}}apontando para a meia-noite de 15 de agosto{{/7}} — {{8}}a coisa mais próxima de uma data oficial até agora.{{/8}} {{9}}Três sinais anteriores merecem atenção:{{/9}}

• Um pull request do vLLM ou SGLang mencionando Qwen3.8-27B. PRs de frameworks costumam ser o primeiro rastro público de um lançamento de pesos, porque o trabalho de integração começa no momento em que o repositório é preparado.

Os canais próprios da equipe da Qwen (X, WeChat, o blog qwen.ai), {{1}}que tendem a anunciar o próprio drop{{/1}}.

• Quantizadores da comunidade — {{1}}Unsloth e outros{{/1}} geralmente publicam arquivos quantizados e medições reais de VRAM em poucos dias, o que converte as projeções acima em números mensuráveis.

Um aviso se aplica o tempo todo: antes de a organização oficial publicar, qualquer "Qwen3.8-27B" que você puder baixar é ou um placeholder ou um upload de terceiros. O nome por si só não é autenticidade.

O que você pode usar hoje

O 27B é o modelo pelo qual vale a pena esperar, não é a única opção desta geração. O Qwen3.8-Max está no ar agora — e também pode ser auto-hospedado, já que seus pesos estão disponíveis para download — e no OrcaRouter ele é cobrado pelo preço de tabela do provedor, US$ 2,00 por milhão de tokens de entrada e US$ 6,00 por milhão de tokens de saída, sem nenhum acréscimo, então o preço na página de preços do próprio fornecedor é o preço que você paga. Uma única chave dá acesso a ele, e quando o 27B for lançado e conquistar confiança nos benchmarks públicos, a mesma chave também será roteada para ele. Para uma equipe que quer desenvolver para esta geração hoje enquanto mantém a opção de um 27B auto-hospedado depois, esse é o caminho com menos dependência que existe.

OrcaRouter model page for Qwen3.8-Max (qwen/qwen3.8-max), showing the NEW FEATURED badge, Vision and Tools capabilities, $2.00 per million input tokens and $6.00 per million output tokens, a p50 time-to-first-token of 4.84 seconds, a 1M-token context window, and OpenAI-compatible API code samples.

O resumo direto: a resposta sobre a data de lançamento está mais clara do que estava há uma semana. A janela que a Alibaba deu — a semana de 10 de agosto de 2026 — veio e passou. Ela entregou os pesos do carro-chefe: o Qwen3.8-2.4T-A95B e sua quantização FP8 oficial estão no Hugging Face agora. Não entregou os do 27B — mas o atraso agora tem um alvo: a contagem regressiva do ModelScope vai até a meia-noite de 15 de agosto de 2026 (00:00 JST, segundo o PC Watch). Acompanhe a organização oficial Qwen no Hugging Face e a página da Qwen no ModelScope, leia o LICENSE no momento em que o repositório do 27B for publicado e trate toda especificação e número de VRAM que circulam como uma projeção até que os pesos os tornem mensuráveis.

© 2026 OrcaRouter

Para provedores

Opera uma plataforma de inferência? Traga seus modelos para o OrcaRouter.

Fale conosco

Junte-se à comunidade

DiscordEmailXGitHubYouTube