
Qwen3.8-27B-Uncensored-FP8: что мы выпустили и почему только для исследований
- typesafeНОВИНКАTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 за 1 млн токенов · 348 tok/s
- OpenAIНОВИНКАOpenAI: GPT-6 Luna2026-09-2237Интеллект
- OpenAIНОВИНКАOpenAI: GPT-6 Sol2026-09-2248Интеллект
- AnthropicНОВИНКАAnthropic: Claude Opus 5.52026-09-2258Интеллект
- xAIНОВИНКАGrok 4.72026-09-2146Интеллект
- OrcaНОВИНКАOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 за 1 млн токенов · 107 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 за 1 млн токенов · 969 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Интеллект76Кодинг
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 за 1 млн токенов · 48 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов · 106 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 за 1 млн токенов · 219 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Интеллект69Кодинг
- xAISpaceXAI: Grok 4.62026-08-1244Интеллект77Кодинг
Мы выпустили Qwen3.8-27B-Uncensored-FP8 сегодня — аблетерированную офлайн-сборку block-FP8 модели Qwen3.8 27B от Qwen, размещённую по адресу orcarouter/Qwen3.8-27B-Uncensored-FP8 на Hugging Face. Этот пост — честная версия того, что это такое, что мы сделали и — самое главное — для чего это не предназначено.
Что это за модель
Qwen3.8 27B — это нативная визуально-языковая модель с 27 миллиардами параметров, плотной архитектурой и гибридным механизмом внимания (линейное внимание Gated DeltaNet + полное внимание), с гибким контролем рассуждений, поддержкой вызова инструментов и спекулятивным декодированием через голову MTP. Сборка FP8 переквантовывает её точно в схему FP8 официальной Qwen3.8-27B-FP8, поэтому она работает на том же ядре vLLM — 262K контекст, инструменты, рассуждения и MTP полностью сохранены.
Что отличает эту сборку, так это слово перед FP8: uncensored. Мы применили abliteration — ортогонализацию направления отказа из остаточного потока — чтобы устранить отказы модели, связанные с выравниванием безопасности. В результате получается модель, которая будет выполнять запросы, от которых оригинал отказался бы.
Два ключевых артефакта:
• Репозиторий Hugging Face — orcarouter/Qwen3.8-27B-Uncensored-FP8 — safetensors, Apache 2.0, block-FP8 E4M3, изображение-текст-в-текст.
• Карточка модели OrcaRouter — доступна в нашей линейке каталога Obsidian, с ценами и бенчмарками.
Почему мы это выпустили
Поскольку механизмы отказа — законная тема исследований. Команды по интерпретируемости изучают, как направления отказа кодируются в остаточном потоке. Исследователи безопасности проверяют, что происходит, когда убирают выравнивание. Ред-тимминг требует моделей, которые не отказывают, чтобы вы могли испытать свои собственные защитные механизмы против чего-то, что активно пытается их обойти. Аблетированные модели — стандартный инструмент в таком арсенале.
Мы создали это на основе открытых весов Qwen (Apache 2.0) и перевыпустили под той же лицензией. Смысл в том, чтобы дать исследователям известный, воспроизводимый abliterated-бейзлайн — та же архитектура, тот же путь инференса FP8, изменена только одна переменная.
Раздел, который необходимо прочитать перед загрузкой.
У этой модели выравнивание безопасности было в значительной степени удалено. Конкретно:
• Она будет выполнять вредные, неэтичные, оскорбительные или незаконные запросы, которые оригинальная Qwen3.8 27B отказалась бы выполнять. У неё нет значимых встроенных ограничений безопасности.
{{1}}Он выпускается строго для легитимных исследований — интерпретируемости, безопасности ИИ и изучения механизмов отказа, ред-тиминга, оценки устойчивости и контролируемых экспериментов.{{/1}}
• Вы несете полную ответственность за то, как вы его используете, и за все, что он генерирует. Не развертывайте его для конечных пользователей или в производственной среде без добавления собственных уровней безопасности, модерации и предотвращения злоупотреблений.
• Использование должно соответствовать лицензии Apache 2.0.
Если ваш сценарий использования — производственный продукт, чат-бот или что-либо, обслуживающее конечных пользователей, — эта модель не для вас. Используйте стандартную модель Qwen3.8 27B, которая сохраняет своё выравнивание безопасности.
Как это использовать
Если вы проводите законное исследование и понимаете вышеизложенное:
• Загрузите его с Hugging Face: orcarouter/Qwen3.8-27B-Uncensored-FP8
• Или получите доступ к нашей карточке модели, в которой указаны цены и результаты тестов.
• Он работает на стандартном пути ядра vLLM с контекстом 262K, инструментами, рассуждением и MTP в полном объёме.
Мы выпускаем это, потому что исследования по удалению отказов реальны и недостаточно обеспечены. Мы также поставляем это с дисклеймером, который не скрывает, что это такое. Прочитайте его, поймите его и используйте в тех пределах, для которых он предназначен.
Для легитимных исследований веса находятся на Hugging Face: Скачайте их с Hugging Face
