
API Qwen 3.8 27B แบบฟรี: ยังไม่มี — สิ่งที่ควรใช้งานแทน
- deepseekใหม่DeepSeek: DeepSeek V4.1 Flash2026-09-1040ความฉลาด
- openaiใหม่OpenAI: GPT-6 Astra2026-09-0453ความฉลาด77การเขียนโค้ด
- googleใหม่Google: Gemini 3.8 Flash2026-09-0241ความฉลาด76การเขียนโค้ด
- qwenใหม่Qwen: Qwen3.8 Max (0902)2026-09-0240ความฉลาด72การเขียนโค้ด
- anthropicใหม่Anthropic: Claude Fable 5.12026-09-0153ความฉลาด82การเขียนโค้ด
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 ต่อ 1 ล้านโทเค็น
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642ความฉลาด72การเขียนโค้ด
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.24 / $0.73 ต่อ 1 ล้านโทเค็น
- z-aiZ.ai: GLM 5.32026-08-1845ความฉลาด75การเขียนโค้ด
- obsidianQwen3.8 27B2026-08-1534ความฉลาด68การเขียนโค้ด
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236ความฉลาด69การเขียนโค้ด
- grokSpaceXAI: Grok 4.62026-08-1244ความฉลาด77การเขียนโค้ด
- metaMeta: Muse Spark 1.22026-08-0540ความฉลาด72การเขียนโค้ด
- qwenQwen: Qwen3.8 Max2026-08-0340ความฉลาด72การเขียนโค้ด
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135ความฉลาด69การเขียนโค้ด
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 ต่อ 1 ล้านโทเค็น
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451ความฉลาด78การเขียนโค้ด
- googleGoogle: Gemini 3.6 Flash2026-07-2134ความฉลาด69การเขียนโค้ด
ไม่ — ณ วันที่ 12 สิงหาคม 2026 ยังไม่มี API ของ Qwen3.8-27B ให้ใช้ฟรี และก็ไม่มีแบบที่ต้องเสียเงินด้วยเช่นกัน โมเดลดังกล่าวถูกประกาศเมื่อวันที่ 3 สิงหาคม โดยให้คำมั่นว่าจะปล่อย open weights บน Hugging Face และ ModelScope "ในสัปดาห์ของวันที่ 10 สิงหาคม" แต่องค์กร Qwen อย่างเป็นทางการยังไม่มีรีโพซิทอรีของ Qwen3.8 จนกว่าจะมีการปล่อยน้ำหนัก จะไม่มีใครสามารถโฮสต์ Qwen3.8-27B ได้ ดังนั้นคำว่า "ฟรี" จึงไม่มีความหมาย นี่คือสามหนทางสู่การใช้งานฟรีเมื่อน้ำหนักถูกปล่อยออกมาแล้ว (และค่าใช้จ่ายจริงของแต่ละหนทาง) พร้อมกับโมเดลที่คุณสามารถรันฟรีบนเครื่องของคุณได้ในวันนี้
ยังไม่มี API ฟรี — น้ำหนักคือประตูทางเข้า
อาลีบาบาประกาศตระกูล Qwen3.8 เมื่อวันที่ 3 สิงหาคม 2026: Qwen3.8-Max ที่มีพารามิเตอร์ 2.4 ล้านล้านตัว (มีพารามิเตอร์ที่ใช้งานจริงประมาณ 95,000 ล้านตัว รองรับบริบท 1M โทเคน ราคา 2 ดอลลาร์ต่อโทเคนนำเข้า 1 ล้านตัว และ 6 ดอลลาร์ต่อโทเคนส่งออก 1 ล้านตัวบน Alibaba Cloud Model Studio) และ Qwen3.8-27B แบบ dense ที่รันบนเครื่องเดียว ทั้งคู่ได้รับสัญญาว่าจะเปิดน้ำหนัก (open weights) บน Hugging Face และ ModelScope ในสัปดาห์เดียวกัน
คำสัญญานั้นเลยกำหนดมาแล้วสองวัน ฉันตรวจสอบ Hugging Face โดยตรงเมื่อวันที่ 12 สิงหาคม: องค์กร Qwen อย่างเป็นทางการไม่มี repository ของ Qwen3.8 ชนิดใดเลย repository ของ Qwen3.8-27B-GGUF, -FP8, -NVFP4A16 และ -NInfer ที่โผล่ขึ้นมาในการค้นหาโมเดลเป็นเพียงการ์ด placeholder — ไม่มีไฟล์น้ำหนักใด ๆ จำนวนดาวน์โหลดเป็นเลขหลักเดียว และการ์ดโมเดลที่อ่านได้ตรงตัวว่า "สงวนไว้ก่อนการเปิดตัว Qwen/Qwen3.8-27B" อย่าถือว่าสิ่งเหล่านั้นเป็นหลักฐานว่าโมเดลมีอยู่จริง จงมองว่าพวกมันเป็นเหมือนคนที่จองที่จอดรถไว้
สองสิ่งที่คุณไม่ควรคาดเดา ประการแรก ใบอนุญาต: ยังไม่มีการระบุใบอนุญาตสำหรับ Qwen3.8-27B น้ำหนักโมเดลเปิดล่าสุดของ Qwen เผยแพร่ภายใต้ใบอนุญาต Tongyi Qianwen ซึ่งข้อกำหนดเรื่องผู้ใช้ประจำเดือน 100 ล้านคนก่อให้เกิดการหารือเรื่องใบอนุญาตเชิงพาณิชย์เมื่อใช้งานในระดับใหญ่ — Apache 2.0 ไม่ใช่ค่าเริ่มต้นที่ปลอดภัย ประการที่สอง สเปก: Alibaba ยังไม่ได้เผยแพร่ตาราง benchmark, ความยาว context window หรือข้อกำหนดฮาร์ดแวร์ที่ยืนยันสำหรับรุ่น 27B ทุกสิ่งที่กำลังพูดถึงกันในวันนี้ล้วนเป็นการคาดเดา
เราได้กล่าวถึงรายการตรวจสอบก่อนการปล่อยโมเดลไว้แล้ว — ว่าอะไรได้รับการยืนยันแล้ว อะไรเป็นเพียงข่าวลือ และควรตรวจสอบอะไรบ้างก่อนดาวน์โหลด — ใน Qwen3.8-27B Open Weights: What We Know Before the Drop บทความนี้พูดถึงส่วนที่บทความก่อนหน้านั้นไม่ได้กล่าวถึง นั่นคือ "ฟรี" จะทำงานจริงอย่างไรเมื่อโมเดลเปิดตัวอย่างเป็นทางการ
หลังจากที่น้ำหนักลดลง: สามเส้นทางสู่อิสรภาพ และแต่ละเส้นทางมีต้นทุนที่แท้จริงเท่าไร
"ฟรี" ไม่เคยฟรีจริง ทั้งสามเส้นทางที่นำไปสู่ Qwen3.8-27B ฟรี ล้วนย้ายต้นทุนไปที่ใดที่หนึ่ง ต่างกันตรงที่ต้นทุนนั้นไปตกอยู่ที่แห่งไหน 27B เป็น dense model — ทุกหนึ่งในพารามิเตอร์ประมาณ 27 พันล้านตัวทำงานในทุกโทเคน — ดังนั้นต้นทุนด้านล่างจึงเกี่ยวกับฮาร์ดแวร์จริง ไม่ใช่การตลาด

เส้นทางที่ 1: รันด้วยตัวเอง — ฟรีในแง่ตัวเงิน แต่มีค่าใช้จ่ายเป็นฮาร์ดแวร์
เส้นทางเดียวที่คำว่า "ฟรี" กลายเป็นจริงอย่างแท้จริงหลังจากซื้อฮาร์ดแวร์แล้ว Daniel Han ผู้ร่วมก่อตั้ง Unsloth คาดว่าโมเดล 27B จะใช้ VRAM ประมาณ 17GB เมื่อเปิดตัว — เป็นเป้าหมาย ไม่ใช่สเปกที่จัดส่งจริง โดยใช้การวัดระดับ quantization ladder ของ Qwen3.6-27B เป็นตัวแทน: Q4_K_M อยู่ที่ประมาณ 16GB, Q6_K อยู่ที่ประมาณ 21GB, FP8 อยู่ที่ประมาณ 27GB และ BF16 เต็มรูปแบบอยู่ที่ประมาณ 54–56GB ขั้นต่ำที่ทำได้จริงในปัจจุบันคือการ์ด 24GB — RTX 3090, RTX 4090 หรือคลาส A6000 — ที่ระดับ Q4
จังหวะเวลามีความสำคัญ: น้ำหนักโมเดลทางการที่ใช้กับ vLLM หรือ SGLang มักจะใช้งานได้ภายในไม่กี่วันหลังปล่อย แต่ควอนไทเซชัน GGUF และ AWQ จากชุมชนจะตามหลังไปประมาณหนึ่งถึงสองสัปดาห์ ดังนั้นรูปแบบ "ดึงแล้วรัน" แบบ Ollama จะยังไม่มีในวันวางจำหน่าย ต้นทุนแฝงคือค่าไฟฟ้า เครื่องที่เงียบ และเวลาของคุณ ข้อดีคือความเป็นส่วนตัว — ไม่มีข้อมูลใดออกจากเครื่องของคุณ — และต้นทุนส่วนเพิ่มเป็นศูนย์ ซึ่งยิ่งคุ้มเมื่อคุณใช้ GPU กับโมเดลอื่นๆ ด้วย
เส้นทางที่ 2: ระดับฟรีแบบโฮสต์ — ฟรีในเรื่องเงิน แต่แลกมาด้วยข้อจำกัด
เมื่อ weights ถูกปล่อยออกมา คาดว่าจะมีโควต้าสำหรับการประเมินผลจาก Alibaba Cloud และฟรีเทียร์จากโฮสต์ serverless ทั่วไป รูปแบบที่คาดว่าจะเป็นคือแบบเดียวกับที่ Alibaba ใช้สำหรับ Qwen3.8-Max อยู่แล้ว: โควต้าผู้ใช้ใหม่ 1M token, เฉพาะภูมิภาคสิงคโปร์, ใช้ได้ 90 วัน, ไม่มีการสะสม – และ reasoning tokens ถูกคิดค่าใช้จ่ายเป็น output ดังนั้นโมเดลที่คิดหาเหตุผลโดยค่าเริ่มต้นสามารถเผาผลาญโควต้าทั้งหมดได้ในหนึ่งสุดสัปดาห์ของการทำโปรโตไทป์ สิ่งที่คุณจ่ายจริงๆ คือ rate limits, การล็อกภูมิภาค, วันหมดอายุ, และพรอมพ์ต์ของคุณที่ถูกส่งไปยังบุคคลที่สาม ฟรีเทียร์คือทางลาดสำหรับประเมินโมเดล ไม่ใช่สถานที่สำหรับปรับใช้มัน
เส้นทาง 3: ระดับฟรีของ OrcaRouter — วางแผนไว้ ยังไม่เปิดใช้งาน
เนื่องจากคำค้นหาคือคำว่า "ฟรี" ตามตัวอักษร เราจะพูดให้ตรงไปตรงมา: OrcaRouter วางแผนที่จะมีระดับฟรีสำหรับ Qwen3.8-27B เมื่อค่าน้ำหนักถูกปล่อยออกมาเท่านั้น ตอนนี้ยังไม่เปิดใช้งานจริง ยังไม่มีเอนด์พอยต์ให้เรียกใช้ และฉันจะไม่วางตัวอย่างชั่วคราวเอาไว้ เราจะประกาศเมื่อมีอะไรให้ประกาศจริงๆ สิ่งที่เราโฮสต์อยู่ในวันนี้คือ Qwen3.8-Max ที่ราคา $2/$6 ต่อ 1M โทเค็น โดยไม่มีการบวกเพิ่ม — และรุ่น 27B ยังไม่ได้อยู่บนแพลตฟอร์ม เพราะยังไม่มีใครสามารถให้บริการมันได้
สิ่งที่คุณใช้ได้ฟรีตอนนี้
หากความต้องการของคุณคือ "โมเดลโอเพนคลาส 27B ที่ฉันสามารถรันได้โดยไม่ต้องจ่ายเงิน" คุณไม่จำเป็นต้องรอ คำตอบที่ตรงไปตรงมาในระดับเดียวกันคือ Qwen3.6-27B ซึ่งเป็นรุ่นก่อนหน้าโดยตรงของโมเดลที่คุณกำลังรอ

Qwen3.6-27B อยู่ภายใต้สัญญาอนุญาต Apache 2.0 เป็นโมเดลแบบ dense ขนาด 27.8B พารามิเตอร์ รองรับบริบท 262K และรับอินพุตทั้งข้อความ รูปภาพ และวิดีโอแบบเนทีฟ ไฟล์ GGUF แบบ Q4_K_M มีขนาดประมาณ 16.5GB และรันได้ประมาณ 25 โทเคนต่อวินาทีบน GPU สำหรับผู้บริโภคขนาด 24GB (16–18 โทเคนต่อวินาทีบน M4 Max) ตัวเลขที่ผู้พัฒนารายงานจากโมเดลการ์ด: SWE-Bench Verified 77.2, MMLU-Pro 86.2, AIME 2026 94.1, GPQA Diamond 87.8 และ MMMU 82.9 หาก Qwen3.8-27B คือ "27B" รุ่นนี้คือ 27B ที่คุณสามารถสัมผัสได้จริงในวันนี้ — ตระกูลเดียวกัน การออกแบบแบบ dense เดียวกัน และเปิดให้ใช้งานแล้ว
Nemotron 3.5 Lightning 30B A3Bเป็นโมเดลที่มาในรูปแบบที่แตกต่างออกไป และให้ใช้ฟรีเช่นกัน: เปิดตัวเมื่อวันที่ 11 สิงหาคม 2026 ภายใต้ไลเซนส์ OpenMDW 1.1 ของ NVIDIA เป็นโมเดล Mixture-of-Experts ที่มีพารามิเตอร์รวม 30B ใช้งานจริงประมาณ 3B สถาปัตยกรรมไฮบริด Mamba-2 รองรับบริบทสูงสุด 1M — เช็คพอยต์ NVFP4 มีขนาดประมาณ 21.6GB ส่วน Q4 GGUF ประมาณ 25GB ต้องใช้การ์ดจอ 24GB ขึ้นไป เนื่องจากพารามิเตอร์ทั้งหมด 30 พันล้านตัวต้องโหลดเข้าหน่วยความจำ แม้ว่าจะมีเพียงประมาณ 3 พันล้านตัวที่ทำงานต่อโทเคน รายงานแรก ๆ ระบุว่าทำงานได้ใกล้ 45 โทเคนต่อวินาทีบน GPU ตัวเดียว โมเดลนี้สร้างขึ้นสำหรับเลเยอร์การทำงานของเอเจนต์ — การเรียกใช้เครื่องมือ การตรวจสอบ การจัดรูปแบบ — ไม่ใช่การให้เหตุผลระดับแนวหน้า หากปริมาณงานของคุณเป็นงานพื้นฐานปริมาณมากของเอเจนต์ มันสามารถเอาชนะโมเดล dense 27B ในงานจริงของคุณได้
และหากสิ่งที่คุณต้องการโดยเฉพาะคือ API โฮสต์ฟรีในตอนนี้ แทนที่จะติดตั้งในเครื่อง "ฟรี" ที่จริงใจเพียงอย่างเดียวคือโควตาของ Alibaba Qwen3.8-Max: 1M โทเค็น ภูมิภาคสิงคโปร์ 90 วัน มันไม่ใช่ 27B และเป็นเพียงสิทธิ์การประเมิน ไม่ใช่บริการ — ใช้มันเพื่อลองพฤติกรรมของ Qwen3.8 ตอนนี้ แล้วค่อยย้ายไปที่อื่น
เมื่อคำแนะนำนี้ผิด
หากคุณมี GPU ขนาด 24GB+ อยู่แล้ว กรอบความคิดแบบ "รอ tier ฟรี" นั้นผิดสำหรับคุณ ในวันที่ weights ถูกปล่อยออกมา vLLM บน weights อย่างเป็นทางการคือ tier ฟรีของคุณ คุณจะรอเพื่อความสะดวกที่คุณไม่จำเป็นต้องใช้ รอประมาณสองสัปดาห์ก็ต่อเมื่อคุณต้องการลำดับขั้น quantization แบบ GGUF ที่ผ่านการปรับแต่งมาอย่างดีเท่านั้น
หากคุณกำลังสร้างต้นแบบตามสัญญา APIโควตาฟรีแบบโฮสต์ (เมื่อ 27B มีให้ใช้งานแล้ว) อาจมีต้นทุนต่ำกว่าเวลาที่คุณเสียไป — แม้จะมีการหมดอายุ 90 วันและการล็อกภูมิภาค การเช่าเครื่อง GPU เพื่อสร้างต้นแบบหนึ่งสัปดาห์ก็มักเป็นเส้นทางที่แพงกว่า
หากใบอนุญาตกลายเป็น Tongyi Qianwen แทนที่จะเป็น Apache,"free weights" จะไม่ได้หมายความว่าสามารถนำไปใช้เชิงพาณิชย์ได้อย่างอิสระเกินเกณฑ์ 100 ล้าน MAU โปรดอ่านไฟล์ LICENSE ใน repository จริงก่อนที่คุณจะสร้างอะไรบนพื้นฐานของมัน — นั่นคือหนทางที่พบบ่อยที่สุดที่ "free open-weights" จะกลายเป็นใบแจ้งหนี้
และถ้า Alibaba เลื่อนกำหนดอีกครั้ง — มันเกินกำหนดที่สัญญาไว้แล้วสองวัน — ทุกสัปดาห์ที่ผ่านไปทำให้ Qwen3.6-27B กลายเป็นตัวเลือกที่ถูกต้อง แทนที่จะเป็นเพียงมาตรการชั่วคราว

บรรทัดล่าง
ไม่มี Qwen3.8-27B API แบบฟรี เพราะไม่มี Qwen3.8-27B อยู่ที่ไหนเลย เมื่อมีการปล่อย weights ออกมา ช่องทางฟรีสามทางคือ การโฮสต์เอง (จ่ายด้วยฮาร์ดแวร์) ฟรีเทียร์แบบโฮสต์ (จ่ายด้วยข้อจำกัด) และฟรีเทียร์ที่ OrcaRouter วางแผนไว้ ซึ่งยังไม่เปิดใช้งาน และเราจะแจ้งให้ทราบเมื่อเปิดใช้งานแล้ว วันนี้สิ่งที่ใกล้เคียงฟรีที่สุดคือ Qwen3.6-27B บนฮาร์ดแวร์ของคุณเอง การรอไม่ได้ทำให้คุณเสียอะไรนอกจากตัว 27B ส่วนการรันรุ่นก่อนหน้าก็ไม่ทำให้คุณเสียอะไรนอกจาก GPU ที่คุณสามารถนำไปใช้งานอื่นได้ในระหว่างนี้
การเปรียบเทียบในบทความนี้1
ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
