
Qwen3.8-27B 發布日期:權重於8月14日釋出
- typesafe新TypeSafe: Jev 1.132026-09-24$0.04 / $0.00 每百萬 tokens · 383 tok/s
- OpenAI新OpenAI: GPT-6 Luna2026-09-2237智能
- OpenAI新OpenAI: GPT-6 Sol2026-09-2248智能
- Anthropic新Anthropic: Claude Opus 5.52026-09-2258智能
- xAI新Grok 4.72026-09-2146智能
- Orca新Orca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 每百萬 tokens · 209 tok/s
- Orca新Orca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 每百萬 tokens · 680 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040智能
- OpenAIOpenAI: GPT-6 Astra2026-09-0453智能77程式
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241智能76程式
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245智能76程式
- AnthropicAnthropic: Claude Fable 5.12026-09-0153智能82程式
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 每百萬 tokens · 50 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 每百萬 tokens · 102 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642智能72程式
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 每百萬 tokens · 219 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845智能75程式
- obsidianQwen3.8 27B2026-08-1534智能68程式
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236智能69程式
- xAISpaceXAI: Grok 4.62026-08-1244智能77程式
阿里巴巴於 2026 年 8 月 14 日晚間發布了 Qwen3.8-27B 的開放權重,將存放庫上架到 Hugging Face 和 ModelScope,採用 Apache 2.0 授權。這結束了本篇文章自 8 月 3 日公告以來持續追蹤的發布日期問題,同時也帶來了第一個 API 可用性資料點:該模型於同一天上架至商業 API 市場。Qwen3.8-27B 是 Qwen3.8 世代中密集、可自行託管的成員——阿里巴巴將其定位為與 2.4 兆參數的 Qwen3.8-Max 旗艦模型相對應的姊妹款,也是廣為使用的 Qwen3.6-27B 的後繼者。
8月14日发布所確認的
Qwen3.8 世代於 2026 年 8 月 3 日正式發表。當天,混合專家旗艦模型 Qwen3.8-Max 以付費 API 形式同步上線,阿里巴巴並承諾在「約一週內」開放 Max 與較小規模 Qwen3.8-27B 的模型權重。這個時間窗口後來有所延宕,直到 ModelScope 的預告頁面啟動倒數計時、指向 8 月 15 日午夜(日本時間 00:00),才有了明確的發布目標。最終模型如期上架:北京時間 8 月 14 日晚間,同時登陸 Hugging Face 與 ModelScope。
{{1}}已確認的規格:Qwen3.8-27B是一個密集的270億參數模型,原生多模態(文字、圖片、影片、圖表、文件),具備原生262,000個token的上下文視窗,可透過YaRN擴展至100萬個token,並提供可配置的reasoning_effort模式,能調整思考深度以節省運算資源。{{/1}}{{2}}這些是來自發布資料的廠商規格——現在可直接在公開權重中驗證,而非僅憑信任。{{/2}}
在阿里巴巴自家的評測中,27B 超越了其前代,甚至超過了更大的 Qwen3.7-Plus:SWE-bench Pro 61.7(Qwen3.6-27B 為 53.5)、代理式終端編碼 73.0(對比 63.4),以及 JobBench 33.4(對比 21.8)。這些是供應商自行回報的數字——目前尚無獨立評測為 27B 公布分數,因此應將其視為社群接下來將嘗試複現的宣稱。

某個發行版中的哪些層級已經落地?
對於開放權重的模型,「released」具有層次,而且各層之間相隔數天才陸續到位。原始權重是第一層——已於 8 月 14 日釋出。推論框架的支援是第二層:vLLM 和 SGLang 通常會在權重釋出後數天內加入支援,而這就是模型已準備好提供服務、而非僅供下載的訊號。社群量化是第三層——GGUF 和 AWQ 版本,以及隨之而來的 Ollama、LM Studio 和 llama.cpp 一行指令路徑,通常會在一到兩週後出現。
「所以,『我什麼時候可以拉取權重』的答案是:現在。『我什麼時候可以用一條命令執行它』則由框架層和量化層來回答,這些仍在逐步推出中。」

授權問題已解決。
授權條款是比發布日期更重要的懸而未決的問題,而這次發布解決了它。Qwen3.8-27B 以 Apache 2.0 授權發布——這是一個寬鬆的授權,沒有用戶數量上限,也沒有商業協商觸發條件。先前擔心 Qwen 開源發布會採用通義千問授權(含 1 億 MAU 條款)的疑慮,並未在 27B 上成真。這消除了從第一天起就將模型整合進產品和代理程式的主要法律障礙。
第一個 API 可用性數據點
此次发布还产生了27B的首个API可用性数据点:权重发布后数小时内,该模型便作为一个实时服务端点出现在商业API市场上。该条目可独立验证——是第三方目录条目,而非供应商声明——这是该模型不仅可下载、还可通过托管API部署的首个证据。
這就是 OrcaRouter 在成本計算上發揮作用的地方。目前該世代可路由的成員是 Qwen3.8-Max,以供應商列表價格在 OrcaRouter 上提供服務——每百萬輸入代幣 2.00 美元,每百萬輸出代幣 6.00 美元,零加價,因此供應商自己的價格就是您支付的價格。一個 API 金鑰即可涵蓋它以及目錄中的 200 多個模型,並具備自動故障轉移。當 Qwen3.8-27B 在路由器上贏得一席之地時,同一個金鑰將路由到它;在此之前,Apache 2.0 的權重可免費自行托管以進行評估。
接下來要驗證什麼?
此次發布回答了時間問題,但尚未回答品質問題。在未來幾週內,有三件事值得關注:
• 推論框架支援 — vLLM 與 SGLang 的拉取請求指名 Qwen3.8-27B,這代表該模型已準備好大規模服務,而不只是能從儲存庫中執行。
• 社群量化版本與實際 VRAM 測量數據 — Unsloth 等團隊通常會在數天內發布 GGUF 建置檔與實測記憶體用量,將發布前的預估值轉化為你可據以部署的實際數字。
• 獨立基準測試 — Artificial Analysis 和 LMArena 針對 27B 的分數,一旦公布,才是驅動生產決策的依據,而非阿里巴巴自己的評估。
你今天可以使用的
Qwen3.8-27B 現在已可下載——這正是 Apache 2.0 發布的意義所在。對於想立即在託管 API 上針對這一代模型進行開發的團隊,Qwen3.8-Max 已在 OrcaRouter 上線,按供應商定價(每百萬輸入 tokens 2.00 美元,每百萬輸出 tokens 6.00 美元,零加價),並配備自動故障轉移及一個金鑰通行整個目錄。在獨立基準測試確認供應商數據之前,自行託管 27B 權重進行評估是低風險的入門方式。

發布日期的問題已經塵埃落定:Qwen3.8-27B已於2026年8月14日以Apache 2.0授權正式發布,原生支援262K上下文窗口,且同日亦有API可用性的數據點。剩下的問題皆屬可衡量者——它的服務表現如何、量化效果如何,以及獨立評測能否重現阿里巴巴的分數。在押注生產環境路徑之前,先閱讀LICENSE、下載模型權重,並等待框架支援與社群建置版本。
