
Data de lançamento do Qwen3.8-27B: tudo o que sabemos até agora
- deepseekNOVODeepSeek: DeepSeek V4 Pro 08132026-08-12$0.44 / $0.88 por 1M de tokens · 72 tok/s
- grokNOVOSpaceXAI: Grok 4.62026-08-1261Inteligência77Código
- metaNOVOMeta: Muse Spark 1.22026-08-0557Inteligência72Código
- qwenNOVOQwen: Qwen3.8 Max2026-08-0358Inteligência72Código
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152Inteligência69Código
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 por 1M de tokens · 2304 tok/s
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Inteligência78Código
- googleGoogle: Gemini 3.6 Flash2026-07-2152Inteligência69Código
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Inteligência49Código
- metaMeta: Muse Spark 1.12026-07-1653Inteligência71Código
- kimiMoonshotAI: Kimi K32026-07-1560Inteligência76Código
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Inteligência71Código
- openaiOpenAI: GPT-5.6 Terra2026-07-0957Inteligência77Código
- openaiOpenAI: GPT-5.6 Sol2026-07-0961Inteligência77Código
- grokxAI: Grok 4.52026-07-0856Inteligência72Código
- tencentTencent: Hy32026-07-0642Inteligência59Código
- obsidianQwen3.6 35B A3B Uncensored (Aggressive)2026-07-0232Inteligência42Código
- obsidianGemma4 26B A4B Uncensored (Balanced)2026-07-0226Inteligência39Código
A Alibaba prometeu os pesos abertos do Qwen3.8-27B para a semana de 10 de agosto de 2026, e essa janela passou. Agora o atraso tem um alvo concreto: a página oficial do Qwen no ModelScope está exibindo uma contagem regressiva até a meia-noite de 15 de agosto de 2026 — 00:00 JST, de acordo com o relatório de 13 de agosto do PC Watch sobre o teaser. Os pesos ainda não apareceram na organização oficial do Qwen no Hugging Face até hoje, mas a questão da data de lançamento agora tem uma resposta pela primeira vez desde o anúncio de 3 de agosto. Aqui está o que está confirmado, o que ainda não foi verificado e o que observar.
O que está confirmado
Em 3 de agosto de 2026, a Alibaba anunciou a geração Qwen3.8. Duas coisas aconteceram nesse dia: o Qwen3.8-Max, o carro-chefe mixture-of-experts de 2,4 trilhões de parâmetros, entrou no ar com uma API paga, e a Alibaba se comprometeu a abrir os pesos tanto do Max quanto do menor Qwen3.8-27B "em cerca de uma semana". Vários veículos independentes (36Kr, TrendForce, C114) divulgaram o mesmo compromisso: Hugging Face e ModelScope, na semana de 10 de agosto.
O 27B é o membro auto-hospedável da geração — a Alibaba o posicionou como dimensionado para trabalho com GPU única e on-premise, o sucessor direto do amplamente usado Qwen3.6-27B. Essa linhagem importa. O Qwen3.6-27B se tornou um dos modelos locais de codificação mais populares de sua geração, e a versão 3.8 herda essa base instalada de perguntas: quanto custa para rodar, é melhor em agentes, quando posso baixá-lo.
O que é {{1}}verificável de forma independente hoje{{/1}} é o {{2}}carro-chefe{{/2}}, e isso agora inclui {{3}}pesos abertos{{/3}}. {{4}}Qwen3.8-Max{{/4}} está {{5}}disponível na API{{/5}}, e seus {{6}}repositórios{{/6}} — {{7}}Qwen3.8-2.4T-A95B{{/7}} ({{8}}BF16 completo{{/8}}) e uma {{9}}quantização FP8 oficial{{/9}} — {{10}}foram publicados na organização oficial Qwen no Hugging Face{{/10}} {{11}}na semana de 10 de agosto{{/11}}, {{12}}a primeira vez que a Alibaba disponibilizou como código aberto um carro-chefe da classe Max{{/12}}. {{13}}Ele já foi avaliado também{{/13}}: a {{14}}Artificial Analysis{{/14}} coloca seu {{15}}Índice de Inteligência em 58{{/15}}, {{16}}o mais próximo que um laboratório chinês chegou do topo dessa tabela{{/16}}, seu {{17}}Índice de Codificação em 71,8{{/17}} e seu {{18}}preço em US$ 2,00 por milhão de tokens de entrada e US$ 6,00 por milhão de tokens de saída{{/18}}.

Como um "lançamento" realmente se parece para um modelo de pesos abertos
Uma pergunta sobre data em um modelo fechado é simples — a API é ativada. Para um modelo de pesos abertos, "lançado" tem camadas, e cada camada chega com dias de diferença:
Os pesos brutos aparecem como um repositório Hugging Face e ModelScope, com um cartão de modelo e um arquivo LICENSE.
Os frameworks de inferência seguem — espera-se que vLLM e SGLang adicionem suporte em poucos dias, o que é o sinal de que um modelo está pronto para servir e não apenas para download.
As quantizações da comunidade (GGUF, AWQ) normalmente ficam disponíveis uma a duas semanas depois, que é quando os usuários do Ollama, LM Studio e llama.cpp conseguem de fato baixá-las e executá-las.
Então, se a pergunta é "quando posso baixar os pesos", a resposta é um repositório aparecendo na organização oficial Qwen. Se a pergunta é "quando posso executá-lo com um único comando", adicione uma a duas semanas. A promessa de 3 de agosto visava a primeira dessas para a semana de 10 de agosto — e essa camada agora chegou para um membro da geração: Qwen3.8-2.4T-A95B foi publicado no Hugging Face naquela semana. Para o 27B especificamente, ainda não foi publicado no Hugging Face — mas a contagem regressiva do ModelScope agora nomeia um alvo: 15 de agosto de 2026 às 00:00 JST.
O que ainda não está verificado
Tudo o mais sobre o 27B é especulativo até o lançamento do repositório. Não deixe que a cobertura confiante converta projeções em especificações — nada do que se segue está confirmado no momento em que este texto foi escrito:
• Arquitetura — densa ou mixture-of-experts, e a contagem de parâmetros ativos se for MoE.
• Janela de contexto, limites de saída e se é somente texto ou multimodal. O teaser do ModelScope, segundo o PC Watch, descreve suporte nativo multimodal e multilíngue para imagens e vídeo — declarado pelo fornecedor no teaser, ainda não verificado até que os pesos sejam lançados.
• A licença. Apache 2.0 não é uma suposição segura; lançamentos abertos recentes do Qwen foram distribuídos sob a licença Tongyi Qianwen, que contém uma cláusula de 100 milhões de usuários ativos mensais que aciona discussão comercial além desse limite.
• Quaisquer pontuações de benchmark. Todos os números que circulam para a geração 3.8 são reportados pelo fornecedor para o Max; o 27B não tem nenhuma avaliação pública.
Tamanhos quantizados exatos. Os valores de VRAM em circulação são projeções herdadas do Qwen3.6-27B, não medições do modelo 3.8.

Por que a licença importa mais do que a data
A data de lançamento determina quando você pode começar a testar. A licença determina se você pode distribuir. Um modelo Qwen sob a licença Tongyi Qianwen é gratuito para uso abaixo de 100 milhões de usuários ativos mensais — acima disso, espera-se que você negocie termos comerciais. Para um modelo local que as equipes integrarão em produtos e agentes, esse limite pode chegar mais rápido do que parece. O primeiro arquivo a abrir no repositório é a LICENSE, antes do model card e antes do README.
Como captar a queda antes que os posts de blog o façam.
{{1}}A organização oficial Qwen no Hugging Face é a fonte da verdade{{/1}} — {{2}}quando um repositório chamado Qwen3.8-27B aparecer lá, ou no ModelScope, o lançamento aconteceu.{{/2}} {{3}}O mecanismo já se provou esta semana:{{/3}} {{4}}Qwen3.8-2.4T-A95B e sua variante FP8 apareceram na organização exatamente dessa forma,{{/4}} {{5}}então o repositório 27B será igualmente inconfundível.{{/5}} {{6}}No ModelScope, uma página de contagem regressiva para Qwen3.8-27B já está no ar,{{/6}} {{7}}apontando para a meia-noite de 15 de agosto{{/7}} — {{8}}a coisa mais próxima de uma data oficial até agora.{{/8}} {{9}}Três sinais anteriores merecem atenção:{{/9}}
• Um pull request do vLLM ou SGLang mencionando Qwen3.8-27B. PRs de frameworks costumam ser o primeiro rastro público de um lançamento de pesos, porque o trabalho de integração começa no momento em que o repositório é preparado.
Os canais próprios da equipe da Qwen (X, WeChat, o blog qwen.ai), {{1}}que tendem a anunciar o próprio drop{{/1}}.
• Quantizadores da comunidade — {{1}}Unsloth e outros{{/1}} geralmente publicam arquivos quantizados e medições reais de VRAM em poucos dias, o que converte as projeções acima em números mensuráveis.
Um aviso se aplica o tempo todo: antes de a organização oficial publicar, qualquer "Qwen3.8-27B" que você puder baixar é ou um placeholder ou um upload de terceiros. O nome por si só não é autenticidade.
O que você pode usar hoje
O 27B é o modelo pelo qual vale a pena esperar, não é a única opção desta geração. O Qwen3.8-Max está no ar agora — e também pode ser auto-hospedado, já que seus pesos estão disponíveis para download — e no OrcaRouter ele é cobrado pelo preço de tabela do provedor, US$ 2,00 por milhão de tokens de entrada e US$ 6,00 por milhão de tokens de saída, sem nenhum acréscimo, então o preço na página de preços do próprio fornecedor é o preço que você paga. Uma única chave dá acesso a ele, e quando o 27B for lançado e conquistar confiança nos benchmarks públicos, a mesma chave também será roteada para ele. Para uma equipe que quer desenvolver para esta geração hoje enquanto mantém a opção de um 27B auto-hospedado depois, esse é o caminho com menos dependência que existe.

O resumo direto: a resposta sobre a data de lançamento está mais clara do que estava há uma semana. A janela que a Alibaba deu — a semana de 10 de agosto de 2026 — veio e passou. Ela entregou os pesos do carro-chefe: o Qwen3.8-2.4T-A95B e sua quantização FP8 oficial estão no Hugging Face agora. Não entregou os do 27B — mas o atraso agora tem um alvo: a contagem regressiva do ModelScope vai até a meia-noite de 15 de agosto de 2026 (00:00 JST, segundo o PC Watch). Acompanhe a organização oficial Qwen no Hugging Face e a página da Qwen no ModelScope, leia o LICENSE no momento em que o repositório do 27B for publicado e trate toda especificação e número de VRAM que circulam como uma projeção até que os pesos os tornem mensuráveis.
