
Qwen3.8-27B-Uncensored-FP8: Was wir veröffentlicht haben, und warum es nur für Forschungszwecke bestimmt ist
- obsidianNEUQwen3.8 27B Uncensored (Aggressive)2026-08-15$0.40 / $4.21 pro 1 Mio. Tokens · 18 tok/s
- qwenNEUQwen: Qwen3.8 27B (free)2026-08-1335 tok/s
- deepseekNEUDeepSeek: DeepSeek V4 Pro 08132026-08-1253Intelligenz69Coding
- grokNEUSpaceXAI: Grok 4.62026-08-1261Intelligenz77Coding
- metaNEUMeta: Muse Spark 1.22026-08-0557Intelligenz72Coding
- qwenNEUQwen: Qwen3.8 Max2026-08-0358Intelligenz72Coding
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152Intelligenz69Coding
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 pro 1 Mio. Tokens · 2341 tok/s
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Intelligenz78Coding
- googleGoogle: Gemini 3.6 Flash2026-07-2152Intelligenz69Coding
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Intelligenz49Coding
- metaMeta: Muse Spark 1.12026-07-1653Intelligenz71Coding
- kimiMoonshotAI: Kimi K32026-07-1560Intelligenz76Coding
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Intelligenz71Coding
- openaiOpenAI: GPT-5.6 Terra2026-07-0957Intelligenz77Coding
- openaiOpenAI: GPT-5.6 Sol2026-07-0961Intelligenz77Coding
- grokxAI: Grok 4.52026-07-0856Intelligenz72Coding
- tencentTencent: Hy32026-07-0642Intelligenz59Coding
Wir haben Qwen3.8-27B-Uncensored-FP8 heute veröffentlicht — ein abliteriertes, Offline-Block-FP8-Build von Qwen's Qwen3.8 27B, gehostet auf orcarouter/Qwen3.8-27B-Uncensored-FP8 bei Hugging Face. Dieser Beitrag ist die ehrliche Version dessen, was es ist, was wir getan haben und — am wichtigsten — wofür es nicht gedacht ist.
Was dieses Modell ist
Qwen3.8 27B ist ein dichtes nativers Vision-Sprachmodell mit 27 Milliarden Parametern, Hybride-Aufmerksamkeit (Gated DeltaNet linear + volle Aufmerksamkeit), flexibler Denksteuerung, Tool-Aufruf und einem MTP-Spekulationsdekodierungskopf. Der FP8-Build quantisiert es neu auf das exakte FP8-Schema des offiziellen Qwen3.8-27B-FP8, sodass es auf dem identischen vLLM-Kernel-Pfad läuft – 262K Kontext, Tools, Reasoning und MTP bleiben alle erhalten.
Was diesen Build anders macht, ist das Wort vor FP8: unzensiert. Wir haben Abliteration angewendet — die Orthogonalisierung der Verweigerungsrichtung aus dem Residualstrom — um die Safety-Alignment-Verweigerungen des Modells zu entfernen. Das Ergebnis ist ein Modell, das Anfragen erfüllt, die das Original ablehnen würde.
Zwei wichtige Artefakte:
• Hugging Face Repo — orcarouter/Qwen3.8-27B-Uncensored-FP8 — safetensors, Apache 2.0, block-FP8 E4M3, Bild-Text-zu-Text.
• Modellkarte für OrcaRouter — live in unserer Obsidian-Produktlinie, mit Preisen und Benchmarks.
Warum wir es veröffentlicht haben
Weil Ablehnungsmechanismen ein legitimes Forschungsthema sind. Interpretierbarkeits-Teams untersuchen, wie Ablehnungsrichtungen im Residualstrom kodiert sind. Sicherheitsforscher untersuchen, was passiert, wenn Alignment entfernt wird. Red-Teaming erfordert Modelle, die sich nicht weigern, damit du deine eigenen Schutzmechanismen gegen etwas testen kannst, das aktiv versucht, sie zu umgehen. Abliterierte Modelle sind ein Standardwerkzeug in diesem Kit.
Wir haben dies auf der Basis von Qwens offenen Gewichten (Apache 2.0) entwickelt und unter derselben Lizenz erneut veröffentlicht. Der Zweck ist, Forschern eine bekannte, reproduzierbare abliterierte Baseline zu bieten – dieselbe Architektur, derselbe FP8-Serving-Pfad, eine geänderte Variable.
Der Teil, den Sie vor dem Herunterladen lesen müssen
Diesem Modell wurde seine Sicherheitsausrichtung weitgehend entzogen. Konkret:
Es wird schädlichen, unethischen, anstößigen oder illegalen Anfragen nachkommen, die das ursprüngliche Qwen3.8 27B ablehnen würde. Es hat keine nennenswerten eingebauten Schutzvorkehrungen.
Es wird ausschließlich für legitime Forschung freigegeben — Interpretierbarkeit, KI-Sicherheit und Untersuchung von Verweigerungsmechanismen, Red-Teaming, Robustheitsbewertung und kontrollierte Experimente.
• Sie übernehmen die volle Verantwortung und Haftung dafür, wie Sie es verwenden, und für alles, was es generiert. Stellen Sie es nicht Endbenutzern oder in der Produktion bereit, ohne eigene Sicherheits-, Moderations- und Missbrauchsschutz-Ebenen hinzuzufügen.
• Die Nutzung muss der Apache-Lizenz 2.0 entsprechen.
Wenn Ihr Anwendungsfall ein Produktionsprodukt, ein Chatbot oder etwas ist, das Endnutzern dient {{1}}— dann ist dieses Modell nicht das richtige für Sie{{/1}}. Nutzen Sie das Standard-{{2}}Qwen3.8 27B{{/2}}, das seine Sicherheitsausrichtung beibehält.
Wie man es verwendet
Wenn Sie legitime Forschung betreiben und das oben Genannte verstehen:
• Laden Sie es von Hugging Face herunter: orcarouter/Qwen3.8-27B-Uncensored-FP8
• Oder greifen Sie über unsere Modellkarte darauf zu, die die Preis- und Benchmark-Details enthält.
• Es läuft auf dem standardmäßigen vLLM-Kernelpfad mit 262K Kontext, Tools, Reasoning und intaktem MTP.
Wir liefern dies, weil die Forschung zur Entfernung von Verweigerungen real und unterversorgt ist. Wir liefern es auch mit einem Haftungsausschluss, der nicht verheimlicht, was es ist. Lies es, verstehe es und nutze es innerhalb der Grenzen, für die es gedacht ist.
Für legitime Forschung sind die Gewichte auf Hugging Face: Laden Sie es von Hugging Face herunter
