
Qwen3.8-27B-Uncensored-FP8: Co wypuściliśmy i dlaczego tylko do celów badawczych
- typesafeNOWOŚĆTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 za 1 mln tokenów · 348 tok/s
- OpenAINOWOŚĆOpenAI: GPT-6 Luna2026-09-2237Inteligencja
- OpenAINOWOŚĆOpenAI: GPT-6 Sol2026-09-2248Inteligencja
- AnthropicNOWOŚĆAnthropic: Claude Opus 5.52026-09-2258Inteligencja
- xAINOWOŚĆGrok 4.72026-09-2146Inteligencja
- OrcaNOWOŚĆOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 za 1 mln tokenów · 107 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 za 1 mln tokenów · 969 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencja
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Inteligencja77Kod
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Inteligencja76Kod
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Inteligencja76Kod
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencja82Kod
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 za 1 mln tokenów · 48 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 za 1 mln tokenów · 106 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencja72Kod
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 za 1 mln tokenów · 219 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencja75Kod
- obsidianQwen3.8 27B2026-08-1534Inteligencja68Kod
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligencja69Kod
- xAISpaceXAI: Grok 4.62026-08-1244Inteligencja77Kod
Wypuściliśmy Qwen3.8-27B-Uncensored-FP8 dziś — odabliterowaną kompilację offline w blokowym FP8 modelu Qwen3.8 27B firmy Qwen, hostowaną pod adresem orcarouter/Qwen3.8-27B-Uncensored-FP8 na Hugging Face. Ten wpis to uczciwa wersja tego, czym jest, co zrobiliśmy, a — co najważniejsze — do czego nie służy.
Czym jest ten model
Qwen3.8 27B to natywny model wizyjno-językowy o 27 miliardach parametrów, gęsty, z hybrydowym mechanizmem uwagi (liniowy Gated DeltaNet + pełna uwaga), z elastyczną kontrolą myślenia, wywoływaniem narzędzi oraz głowicą spekulacyjnego dekodowania MTP. Wersja FP8 jest ponownie kwantyzowana do dokładnego schematu FP8 oficjalnego Qwen3.8-27B-FP8, dzięki czemu działa na identycznej ścieżce jądra vLLM — z zachowanym kontekstem 262K, narzędziami, rozumowaniem i MTP.
To, co odróżnia tę wersję, to słowo przed FP8: uncensored. Zastosowaliśmy abliterację — ortogonalizując kierunek odmowy ze strumienia rezydualnego — aby usunąć odmowy modelu wynikające z jego dostrojenia do bezpieczeństwa. Rezultatem jest model, który spełni żądania, które oryginał by odrzucił.
Dwa kluczowe artefakty:
• Repozytorium Hugging Face — orcarouter/Qwen3.8-27B-Uncensored-FP8 — safetensors, Apache 2.0, block-FP8 E4M3, image-text-to-text.
Karta modelu OrcaRouter — dostępna w naszej linii katalogowej Obsidian, z cenami i benchmarkami.
Dlaczego to wydaliśmy
Ponieważ mechanizmy odmowy są uzasadnionym przedmiotem badań. Zespoły zajmujące się interpretowalnością badają, w jaki sposób kierunki odmowy są zakodowane w strumieniu rezydualnym. Badacze bezpieczeństwa badają, co się dzieje, gdy usunięte zostanie alignment. Red-teaming wymaga modeli, które nie odmawiają, abyś mógł przetestować własne zabezpieczenia przeciwko czemuś, co aktywnie próbuje je ominąć. Modele abliterowane to standardowe narzędzie w tym zestawie.
Zbudowaliśmy to na otwartych wagach Qwena (Apache 2.0) i ponownie wydaliśmy na tej samej licencji. Chodzi o to, aby dać badaczom znaną, odtwarzalną bazę po abliteracji — tę samą architekturę, tę samą ścieżkę serwowania FP8, przy zmianie tylko jednej zmiennej.
Część, którą musisz przeczytać przed pobraniem.
Ten model został w znacznym stopniu pozbawiony swojego ukierunkowania na bezpieczeństwo. Konkretnie:
Będzie spełniać {{1}}szkodliwe, nieetyczne, obraźliwe lub nielegalne{{/1}} prośby, których spełnienia oryginalny Qwen3.8 27B by odmówił. Nie posiada {{2}}żadnych znaczących wbudowanych zabezpieczeń{{/2}}.
Jest ono udostępniane wyłącznie do legalnych badań — interpretowalności, bezpieczeństwa AI, analizy mechanizmów odmowy, red teamingu, oceny odporności oraz kontrolowanych eksperymentów.
• Ponosisz pełną odpowiedzialność, w tym odpowiedzialność prawną, za sposób, w jaki go używasz, oraz za wszystko, co generuje. Nie wdrażaj go u użytkowników końcowych ani w produkcji bez dodania własnych warstw bezpieczeństwa, moderacji i zapobiegania nadużyciom.
• Użycie musi być zgodne z licencją Apache 2.0.
Jeśli Twój przypadek użycia to produkt produkcyjny, chatbot lub cokolwiek, co służy użytkownikom końcowym — to nie jest model dla Ciebie. Użyj standardowego Qwen3.8 27B, który utrzymuje swoje ukierunkowanie na bezpieczeństwo.
Jak tego używać
Jeśli prowadzisz legalne badania i rozumiesz powyższe:
• Pobierz go z Hugging Face: orcarouter/Qwen3.8-27B-Uncensored-FP8
• Lub uzyskaj do niego dostęp przez naszą kartę modelu, która zawiera szczegóły dotyczące cen i benchmarków.
• Działa na standardowej ścieżce jądra vLLM, zachowując kontekst 262K, narzędzia, rozumowanie i MTP.
Udostępniamy to, ponieważ badania nad usuwaniem odmów są realne i niedoceniane. Udostępniamy je również z zastrzeżeniem, które nie ukrywa, czym jest. Przeczytaj to, zrozum to i używaj tego w granicach, do których jest przeznaczone.
Do legalnych badań wagi znajdują się na Hugging Face: Pobierz je z Hugging Face
