
Qwen3.8-27B-Uncensored-FP8: Những gì chúng tôi đã phát hành, và vì sao nó chỉ dành cho nghiên cứu
- typesafeMỚITypeSafe: Jev 1.132026-09-24$0.04 / $0.00 trên 1 triệu token · 348 tok/s
- OpenAIMỚIOpenAI: GPT-6 Luna2026-09-2237Trí tuệ
- OpenAIMỚIOpenAI: GPT-6 Sol2026-09-2248Trí tuệ
- AnthropicMỚIAnthropic: Claude Opus 5.52026-09-2258Trí tuệ
- xAIMỚIGrok 4.72026-09-2146Trí tuệ
- OrcaMỚIOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 trên 1 triệu token · 107 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 trên 1 triệu token · 969 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Trí tuệ
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Trí tuệ77Lập trình
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Trí tuệ76Lập trình
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Trí tuệ76Lập trình
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Trí tuệ82Lập trình
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 trên 1 triệu token · 48 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 trên 1 triệu token · 106 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Trí tuệ72Lập trình
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 trên 1 triệu token · 219 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Trí tuệ75Lập trình
- obsidianQwen3.8 27B2026-08-1534Trí tuệ68Lập trình
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Trí tuệ69Lập trình
- xAISpaceXAI: Grok 4.62026-08-1244Trí tuệ77Lập trình
Chúng tôi đã phát hành Qwen3.8-27B-Uncensored-FP8 hôm nay — một bản build block-FP8 offline đã abliterate của Qwen3.8 27B của Qwen, được lưu trữ tại orcarouter/Qwen3.8-27B-Uncensored-FP8 trên Hugging Face. Bài viết này là phiên bản trung thực về nó là gì, chúng tôi đã làm gì, và — quan trọng nhất — nó không dành cho.
Mô hình này là gì
Qwen3.8 27B là mô hình thị giác-ngôn ngữ gốc dense 27 tỷ tham số, sử dụng cơ chế chú ý lai (Gated DeltaNet tuyến tính + chú ý đầy đủ), với khả năng kiểm soát suy luận linh hoạt, gọi công cụ và đầu giải mã dự đoán suy luận MTP. Bản dựng FP8 định lượng lại mô hình theo đúng sơ đồ FP8 của Qwen3.8-27B-FP8 chính thức, nhờ đó chạy trên cùng một đường kernel vLLM — ngữ cảnh 262K, công cụ, suy luận và MTP đều được giữ nguyên.
Điều làm nên sự khác biệt của bản dựng này là từ đứng trước FP8: không kiểm duyệt. Chúng tôi đã áp dụng abliteration — trực giao hóa hướng từ chối ra khỏi luồng phần dư — để loại bỏ sự từ chối do căn chỉnh an toàn của mô hình. Kết quả là một mô hình sẽ đáp ứng các yêu cầu mà bản gốc sẽ từ chối.
Hai hiện vật chính:
• Kho lưu trữ Hugging Face — orcarouter/Qwen3.8-27B-Uncensored-FP8 — safetensors, Apache 2.0, block-FP8 E4M3, hình ảnh-văn bản thành văn bản.
• Thẻ mô hình trên OrcaRouter — nằm trong dòng sản phẩm Obsidian của chúng tôi, với giá cả và điểm chuẩn.
Tại sao chúng tôi phát hành nó
Vì cơ chế từ chối là một đề tài nghiên cứu chính đáng. Các nhóm interpretability nghiên cứu cách các hướng từ chối được mã hóa trong residual stream. Các nhà nghiên cứu an toàn thăm dò điều gì xảy ra khi alignment bị loại bỏ. Red-teaming đòi hỏi các mô hình không từ chối, để bạn có thể kiểm tra các rào chắn của chính mình trước một thứ gì đó chủ động cố gắng vượt qua chúng. Các mô hình abliterated là một công cụ tiêu chuẩn trong bộ công cụ đó.
Chúng tôi đã xây dựng dựa trên {{1}}trọng số mở của Qwen (Apache 2.0){{/1}} và phát hành lại dưới cùng một giấy phép. Mục đích là cung cấp cho các nhà nghiên cứu một đường cơ sở abliterated đã biết, có thể tái lập — cùng kiến trúc, cùng đường dẫn phục vụ FP8, chỉ thay đổi một biến.
Phần bạn phải đọc trước khi tải xuống
Mô hình này đã bị loại bỏ đáng kể sự căn chỉnh an toàn. Cụ thể:
• Nó sẽ tuân thủ các yêu cầu có hại, phi đạo đức, xúc phạm hoặc bất hợp pháp mà Qwen3.8 27B gốc sẽ từ chối. Nó không có hàng rào bảo vệ tích hợp đáng kể nào.
• Nó chỉ được phát hành cho mục đích nghiên cứu hợp pháp — tính khả diễn giải, nghiên cứu an toàn AI và cơ chế từ chối, kiểm thử tấn công (red-teaming), đánh giá độ bền vững và các thử nghiệm có kiểm soát.
Bạn hoàn toàn chịu trách nhiệm và nghĩa vụ pháp lý về cách bạn sử dụng nó cũng như mọi thứ mà nó tạo ra. Không được triển khai nó cho người dùng cuối hoặc trong môi trường sản xuất nếu chưa bổ sung các lớp an toàn, kiểm duyệt và ngăn chặn lạm dụng của riêng bạn.
• Việc sử dụng phải tuân thủ Giấy phép Apache 2.0.
Nếu trường hợp sử dụng của bạn là sản phẩm production, chatbot, hoặc bất cứ thứ gì phục vụ người dùng cuối — thì đây không phải là mô hình dành cho bạn. Hãy sử dụng Qwen3.8 27B tiêu chuẩn, vốn giữ nguyên sự căn chỉnh an toàn của nó.
Cách sử dụng
Nếu bạn đang nghiên cứu hợp pháp và hiểu những điều trên:
• Tải về từ Hugging Face: orcarouter/Qwen3.8-27B-Uncensored-FP8
• Hoặc truy cập qua thẻ mô hình của chúng tôi, trong đó có chi tiết về giá cả và điểm chuẩn.
Nó hoạt động trên đường dẫn kernel vLLM tiêu chuẩn với ngữ cảnh 262K, các công cụ, khả năng suy luận và MTP được giữ nguyên vẹn.
Chúng tôi phát hành sản phẩm này vì nghiên cứu về việc loại bỏ cơ chế từ chối là có thật và chưa được quan tâm đúng mức. Chúng tôi cũng kèm theo một tuyên bố miễn trừ không che giấu bản chất của nó. Hãy đọc nó, hiểu nó, và sử dụng nó trong phạm vi mà nó được tạo ra.
Đối với nghiên cứu hợp pháp, các trọng số có trên Hugging Face: Tải nó từ Hugging Face
