
Qwen3.8-27B-Uncensored-FP8: O que lançamos e por que é apenas para pesquisa
- obsidianNOVOQwen3.8 27B Uncensored (Aggressive)2026-08-15$0.40 / $4.21 por 1M de tokens · 18 tok/s
- qwenNOVOQwen: Qwen3.8 27B (free)2026-08-1335 tok/s
- deepseekNOVODeepSeek: DeepSeek V4 Pro 08132026-08-1253Inteligência69Código
- grokNOVOSpaceXAI: Grok 4.62026-08-1261Inteligência77Código
- metaNOVOMeta: Muse Spark 1.22026-08-0557Inteligência72Código
- qwenNOVOQwen: Qwen3.8 Max2026-08-0358Inteligência72Código
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152Inteligência69Código
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 por 1M de tokens · 2341 tok/s
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Inteligência78Código
- googleGoogle: Gemini 3.6 Flash2026-07-2152Inteligência69Código
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Inteligência49Código
- metaMeta: Muse Spark 1.12026-07-1653Inteligência71Código
- kimiMoonshotAI: Kimi K32026-07-1560Inteligência76Código
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Inteligência71Código
- openaiOpenAI: GPT-5.6 Terra2026-07-0957Inteligência77Código
- openaiOpenAI: GPT-5.6 Sol2026-07-0961Inteligência77Código
- grokxAI: Grok 4.52026-07-0856Inteligência72Código
- tencentTencent: Hy32026-07-0642Inteligência59Código
Lançamos Qwen3.8-27B-Uncensored-FP8 hoje — uma build abliterada, offline, em block-FP8 do Qwen3.8 27B da Qwen, hospedada em orcarouter/Qwen3.8-27B-Uncensored-FP8 no Hugging Face. Este post é a versão honesta do que ele é, do que fizemos e — o mais importante — para o que ele não serve.
O que é este modelo
O Qwen3.8 27B é um modelo nativo de visão-linguagem denso, com 27 bilhões de parâmetros, atenção híbrida (Gated DeltaNet linear + atenção total), controle flexível de pensamento, chamada de ferramentas e uma cabeça de decodificação especulativa MTP. O build FP8 o requantiza para o esquema FP8 exato do Qwen3.8-27B-FP8 oficial, de modo que ele roda no mesmo caminho de kernel do vLLM — contexto de 262K, ferramentas, raciocínio e MTP, tudo preservado.
O que torna este build diferente é a palavra antes de FP8: sem censura. Aplicamos abliteration — ortogonalizando a direção de recusa do fluxo residual — para remover as recusas de alinhamento de segurança do modelo. O resultado é um modelo que atenderá a solicitações que o original recusaria.
Dois artefatos-chave:
• Repositório Hugging Face — orcarouter/Qwen3.8-27B-Uncensored-FP8 — safetensors, Apache 2.0, block-FP8 E4M3, imagem-texto-para-texto.
• Cartão do modelo no OrcaRouter — disponível na nossa linha de catálogo Obsidian, com preços e benchmarks.
Por que o lançamos
{{1}}Porque mecanismos de recusa são um tema legítimo de pesquisa.{{/1}} {{2}}Equipes de interpretabilidade estudam como as direções de recusa são codificadas no fluxo residual.{{/2}} {{3}}Pesquisadores de segurança investigam o que acontece quando o alinhamento é removido.{{/3}} {{4}}Red-teaming requer modelos que não recusam, para que você possa testar suas próprias salvaguardas contra algo que tenta ativamente contorná-las.{{/4}} {{5}}Modelos abliterados são uma ferramenta padrão nesse kit.{{/5}}
Construímos isto com base nos pesos abertos da Qwen (Apache 2.0) e o relançamos sob a mesma licença. O objetivo é dar aos pesquisadores uma referência abliterada conhecida e reproduzível — a mesma arquitetura, o mesmo caminho de serviço FP8, uma variável alterada.
A parte que você deve ler antes de baixar
Este modelo teve seu alinhamento de segurança substancialmente removido. Concretamente:
• Ele atenderá a solicitações prejudiciais, antiéticas, ofensivas ou ilegais que o Qwen3.8 27B original recusaria. Ele não possui salvaguardas integradas significativas.
• É disponibilizado estritamente para pesquisa legítima — interpretabilidade, estudo de segurança de IA e mecanismos de recusa, red-teaming, avaliação de robustez e experimentos controlados.
• Você assume total responsabilidade e obrigação legal pela forma como o utiliza e por tudo o que ele gera. Não o implemente para usuários finais ou em produção sem adicionar suas próprias camadas de segurança, moderação e prevenção de abuso.
• O uso deve estar em conformidade com a Licença Apache 2.0.
Se o seu caso de uso é um produto em produção, um chatbot ou qualquer coisa que atenda usuários finais — este não é o modelo para você. Use o padrão Qwen3.8 27B, que mantém seu alinhamento de segurança.
Como usar
Se você está fazendo pesquisa legítima e entende o que foi dito acima:
• Baixe-o do Hugging Face: orcarouter/Qwen3.8-27B-Uncensored-FP8
• Ou acesse-o através da nossa ficha do modelo, que contém os detalhes de preços e benchmarks.
• Ele opera no caminho padrão do kernel vLLM com contexto de 262K, ferramentas, raciocínio e MTP intactos.
Disponibilizamos isto porque a pesquisa sobre remoção de recusas é real e carece de apoio. Também o disponibilizamos com um aviso que não esconde o que é. Leia-o, entenda-o e use-o dentro dos limites para os quais foi feito.
Para pesquisa legítima, os pesos estão no Hugging Face: Baixe-o do Hugging Face
