
Qwen3.8-27B-Uncensored-FP8: O que lançamos e por que é apenas para pesquisa
- typesafeNOVOTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 por 1M de tokens · 348 tok/s
- OpenAINOVOOpenAI: GPT-6 Luna2026-09-2237Inteligência
- OpenAINOVOOpenAI: GPT-6 Sol2026-09-2248Inteligência
- AnthropicNOVOAnthropic: Claude Opus 5.52026-09-2258Inteligência
- xAINOVOGrok 4.72026-09-2146Inteligência
- OrcaNOVOOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 por 1M de tokens · 107 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 por 1M de tokens · 969 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligência
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Inteligência77Código
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Inteligência76Código
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Inteligência76Código
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Inteligência82Código
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 por 1M de tokens · 48 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens · 106 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligência72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 por 1M de tokens · 219 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligência75Código
- obsidianQwen3.8 27B2026-08-1534Inteligência68Código
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligência69Código
- xAISpaceXAI: Grok 4.62026-08-1244Inteligência77Código
Lançamos Qwen3.8-27B-Uncensored-FP8 hoje — uma build abliterada, offline, em block-FP8 do Qwen3.8 27B da Qwen, hospedada em orcarouter/Qwen3.8-27B-Uncensored-FP8 no Hugging Face. Este post é a versão honesta do que ele é, do que fizemos e — o mais importante — para o que ele não serve.
O que é este modelo
O Qwen3.8 27B é um modelo nativo de visão-linguagem denso, com 27 bilhões de parâmetros, atenção híbrida (Gated DeltaNet linear + atenção total), controle flexível de pensamento, chamada de ferramentas e uma cabeça de decodificação especulativa MTP. O build FP8 o requantiza para o esquema FP8 exato do Qwen3.8-27B-FP8 oficial, de modo que ele roda no mesmo caminho de kernel do vLLM — contexto de 262K, ferramentas, raciocínio e MTP, tudo preservado.
O que torna este build diferente é a palavra antes de FP8: sem censura. Aplicamos abliteration — ortogonalizando a direção de recusa do fluxo residual — para remover as recusas de alinhamento de segurança do modelo. O resultado é um modelo que atenderá a solicitações que o original recusaria.
Dois artefatos-chave:
• Repositório Hugging Face — orcarouter/Qwen3.8-27B-Uncensored-FP8 — safetensors, Apache 2.0, block-FP8 E4M3, imagem-texto-para-texto.
• Cartão do modelo no OrcaRouter — disponível na nossa linha de catálogo Obsidian, com preços e benchmarks.
Por que o lançamos
{{1}}Porque mecanismos de recusa são um tema legítimo de pesquisa.{{/1}} {{2}}Equipes de interpretabilidade estudam como as direções de recusa são codificadas no fluxo residual.{{/2}} {{3}}Pesquisadores de segurança investigam o que acontece quando o alinhamento é removido.{{/3}} {{4}}Red-teaming requer modelos que não recusam, para que você possa testar suas próprias salvaguardas contra algo que tenta ativamente contorná-las.{{/4}} {{5}}Modelos abliterados são uma ferramenta padrão nesse kit.{{/5}}
Construímos isto com base nos pesos abertos da Qwen (Apache 2.0) e o relançamos sob a mesma licença. O objetivo é dar aos pesquisadores uma referência abliterada conhecida e reproduzível — a mesma arquitetura, o mesmo caminho de serviço FP8, uma variável alterada.
A parte que você deve ler antes de baixar
Este modelo teve seu alinhamento de segurança substancialmente removido. Concretamente:
• Ele atenderá a solicitações prejudiciais, antiéticas, ofensivas ou ilegais que o Qwen3.8 27B original recusaria. Ele não possui salvaguardas integradas significativas.
• É disponibilizado estritamente para pesquisa legítima — interpretabilidade, estudo de segurança de IA e mecanismos de recusa, red-teaming, avaliação de robustez e experimentos controlados.
• Você assume total responsabilidade e obrigação legal pela forma como o utiliza e por tudo o que ele gera. Não o implemente para usuários finais ou em produção sem adicionar suas próprias camadas de segurança, moderação e prevenção de abuso.
• O uso deve estar em conformidade com a Licença Apache 2.0.
Se o seu caso de uso é um produto em produção, um chatbot ou qualquer coisa que atenda usuários finais — este não é o modelo para você. Use o padrão Qwen3.8 27B, que mantém seu alinhamento de segurança.
Como usar
Se você está fazendo pesquisa legítima e entende o que foi dito acima:
• Baixe-o do Hugging Face: orcarouter/Qwen3.8-27B-Uncensored-FP8
• Ou acesse-o através da nossa ficha do modelo, que contém os detalhes de preços e benchmarks.
• Ele opera no caminho padrão do kernel vLLM com contexto de 262K, ferramentas, raciocínio e MTP intactos.
Disponibilizamos isto porque a pesquisa sobre remoção de recusas é real e carece de apoio. Também o disponibilizamos com um aviso que não esconde o que é. Leia-o, entenda-o e use-o dentro dos limites para os quais foi feito.
Para pesquisa legítima, os pesos estão no Hugging Face: Baixe-o do Hugging Face
