นาฬิกาทรายบนแท่นโมเดลที่ว่างเปล่า — น้ำหนักของ Qwen3.8-27B ยังไม่ถูกปล่อยออกมา ดังนั้นจึงไม่มี API ฟรีใด ๆ ที่มีอยู่ได้
Guides & Insights

API Qwen 3.8 27B แบบฟรี: ยังไม่มี — สิ่งที่ควรใช้งานแทน

ผู้เขียน

Rowan Sterling

วันที่เผยแพร่

โมเดลล่าสุด · 20ดูโมเดลทั้งหมด
เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
กลับไปยังโพสต์ทั้งหมด

ไม่ — ณ วันที่ 12 สิงหาคม 2026 ยังไม่มี API ของ Qwen3.8-27B ให้ใช้ฟรี และก็ไม่มีแบบที่ต้องเสียเงินด้วยเช่นกัน โมเดลดังกล่าวถูกประกาศเมื่อวันที่ 3 สิงหาคม โดยให้คำมั่นว่าจะปล่อย open weights บน Hugging Face และ ModelScope "ในสัปดาห์ของวันที่ 10 สิงหาคม" แต่องค์กร Qwe​n อย่างเป็นทางการยังไม่มีรีโพซิทอรีของ Qwen3.8 จนกว่าจะมีการปล่อยน้ำหนัก จะไม่มีใครสามารถโฮสต์ Qwen3.8-27B ได้ ดังนั้นคำว่า "ฟรี" จึงไม่มีความหมาย นี่คือสามหนทางสู่การใช้งานฟรีเมื่อน้ำหนักถูกปล่อยออกมาแล้ว (และค่าใช้จ่ายจริงของแต่ละหนทาง) พร้อมกับโมเดลที่คุณสามารถรันฟรีบนเครื่องของคุณได้ในวันนี้

ยังไม่มี API ฟรี — น้ำหนักคือประตูทางเข้า

อาลีบาบาประกาศตระกูล Qwen3.8 เมื่อวันที่ 3 สิงหาคม 2026: Qwen3.8-Max ที่มีพารามิเตอร์ 2.4 ล้านล้านตัว (มีพารามิเตอร์ที่ใช้งานจริงประมาณ 95,000 ล้านตัว รองรับบริบท 1M โทเคน ราคา 2 ดอลลาร์ต่อโทเคนนำเข้า 1 ล้านตัว และ 6 ดอลลาร์ต่อโทเคนส่งออก 1 ล้านตัวบน Alibaba Cloud Model Studio) และ Qwen3.8-27B แบบ dense ที่รันบนเครื่องเดียว ทั้งคู่ได้รับสัญญาว่าจะเปิดน้ำหนัก (open weights) บน Hugging Face และ ModelScope ในสัปดาห์เดียวกัน

คำสัญญานั้นเลยกำหนดมาแล้วสองวัน ฉันตรวจสอบ Hugging Face โดยตรงเมื่อวันที่ 12 สิงหาคม: องค์กร Qwen อย่างเป็นทางการไม่มี repository ของ Qwen3.8 ชนิดใดเลย repository ของ Qwen3.8-27B-GGUF, -FP8, -NVFP4A16 และ -NInfer ที่โผล่ขึ้นมาในการค้นหาโมเดลเป็นเพียงการ์ด placeholder — ไม่มีไฟล์น้ำหนักใด ๆ จำนวนดาวน์โหลดเป็นเลขหลักเดียว และการ์ดโมเดลที่อ่านได้ตรงตัวว่า "สงวนไว้ก่อนการเปิดตัว Qwen/Qwen3.8-27B" อย่าถือว่าสิ่งเหล่านั้นเป็นหลักฐานว่าโมเดลมีอยู่จริง จงมองว่าพวกมันเป็นเหมือนคนที่จองที่จอดรถไว้

สองสิ่งที่คุณไม่ควรคาดเดา ประการแรก ใบอนุญาต: ยังไม่มีการระบุใบอนุญาตสำหรับ Qwen3.8-27B น้ำหนักโมเดลเปิดล่าสุดของ Qwen เผยแพร่ภายใต้ใบอนุญาต Tongyi Qianwen ซึ่งข้อกำหนดเรื่องผู้ใช้ประจำเดือน 100 ล้านคนก่อให้เกิดการหารือเรื่องใบอนุญาตเชิงพาณิชย์เมื่อใช้งานในระดับใหญ่ — Apache 2.0 ไม่ใช่ค่าเริ่มต้นที่ปลอดภัย ประการที่สอง สเปก: Alibaba ยังไม่ได้เผยแพร่ตาราง benchmark, ความยาว context window หรือข้อกำหนดฮาร์ดแวร์ที่ยืนยันสำหรับรุ่น 27B ทุกสิ่งที่กำลังพูดถึงกันในวันนี้ล้วนเป็นการคาดเดา

เราได้กล่าวถึงรายการตรวจสอบก่อนการปล่อยโมเดลไว้แล้ว — ว่าอะไรได้รับการยืนยันแล้ว อะไรเป็นเพียงข่าวลือ และควรตรวจสอบอะไรบ้างก่อนดาวน์โหลด — ใน Qwen3.8-27B Open Weights: What We Know Before the Drop บทความนี้พูดถึงส่วนที่บทความก่อนหน้านั้นไม่ได้กล่าวถึง นั่นคือ "ฟรี" จะทำงานจริงอย่างไรเมื่อโมเดลเปิดตัวอย่างเป็นทางการ

หลังจากที่น้ำหนักลดลง: สามเส้นทางสู่อิสรภาพ และแต่ละเส้นทางมีต้นทุนที่แท้จริงเท่าไร

"ฟรี" ไม่เคยฟรีจริง ทั้งสามเส้นทางที่นำไปสู่ Qwen3.8-27B ฟรี ล้วนย้ายต้นทุนไปที่ใดที่หนึ่ง ต่างกันตรงที่ต้นทุนนั้นไปตกอยู่ที่แห่งไหน 27B เป็น dense model — ทุกหนึ่งในพารามิเตอร์ประมาณ 27 พันล้านตัวทำงานในทุกโทเคน — ดังนั้นต้นทุนด้านล่างจึงเกี่ยวกับฮาร์ดแวร์จริง ไม่ใช่การตลาด

Three routes to a free Qwen3.8-27B API after the weights drop: run it yourself, a hosted free tier, or OrcaRouter's planned free tier — and the real cost of each.

เส้นทางที่ 1: รันด้วยตัวเอง — ฟรีในแง่ตัวเงิน แต่มีค่าใช้จ่ายเป็นฮาร์ดแวร์

เส้นทางเดียวที่คำว่า "ฟรี" กลายเป็นจริงอย่างแท้จริงหลังจากซื้อฮาร์ดแวร์แล้ว Daniel Han ผู้ร่วมก่อตั้ง Unsloth คาดว่าโมเดล 27B จะใช้ VRAM ประมาณ 17GB เมื่อเปิดตัว — เป็นเป้าหมาย ไม่ใช่สเปกที่จัดส่งจริง โดยใช้การวัดระดับ quantization ladder ของ Qwen3.6-27B เป็นตัวแทน: Q4_K_M อยู่ที่ประมาณ 16GB, Q6_K อยู่ที่ประมาณ 21GB, FP8 อยู่ที่ประมาณ 27GB และ BF16 เต็มรูปแบบอยู่ที่ประมาณ 54–56GB ขั้นต่ำที่ทำได้จริงในปัจจุบันคือการ์ด 24GB — RTX 3090, RTX 4090 หรือคลาส A6000 — ที่ระดับ Q4

จังหวะเวลามีความสำคัญ: น้ำหนักโมเดลทางการที่ใช้กับ vLLM หรือ SGLang มักจะใช้งานได้ภายในไม่กี่วันหลังปล่อย แต่ควอนไทเซชัน GGUF และ AWQ จากชุมชนจะตามหลังไปประมาณหนึ่งถึงสองสัปดาห์ ดังนั้นรูปแบบ "ดึงแล้วรัน" แบบ Ollama จะยังไม่มีในวันวางจำหน่าย ต้นทุนแฝงคือค่าไฟฟ้า เครื่องที่เงียบ และเวลาของคุณ ข้อดีคือความเป็นส่วนตัว — ไม่มีข้อมูลใดออกจากเครื่องของคุณ — และต้นทุนส่วนเพิ่มเป็นศูนย์ ซึ่งยิ่งคุ้มเมื่อคุณใช้ GPU กับโมเดลอื่นๆ ด้วย

เส้นทางที่ 2: ระดับฟรีแบบโฮสต์ — ฟรีในเรื่องเงิน แต่แลกมาด้วยข้อจำกัด

เมื่อ weights ถูกปล่อยออกมา คาดว่าจะมีโควต้าสำหรับการประเมินผลจาก Alibaba Cloud และฟรีเทียร์จากโฮสต์ serverless ทั่วไป รูปแบบที่คาดว่าจะเป็นคือแบบเดียวกับที่ Alibaba ใช้สำหรับ Qwen3.8-Max อยู่แล้ว: โควต้าผู้ใช้ใหม่ 1M token, เฉพาะภูมิภาคสิงคโปร์, ใช้ได้ 90 วัน, ไม่มีการสะสม – และ reasoning tokens ถูกคิดค่าใช้จ่ายเป็น output ดังนั้นโมเดลที่คิดหาเหตุผลโดยค่าเริ่มต้นสามารถเผาผลาญโควต้าทั้งหมดได้ในหนึ่งสุดสัปดาห์ของการทำโปรโตไทป์ สิ่งที่คุณจ่ายจริงๆ คือ rate limits, การล็อกภูมิภาค, วันหมดอายุ, และพรอมพ์ต์ของคุณที่ถูกส่งไปยังบุคคลที่สาม ฟรีเทียร์คือทางลาดสำหรับประเมินโมเดล ไม่ใช่สถานที่สำหรับปรับใช้มัน

เส้นทาง 3: ระดับฟรีของ OrcaRouter — วางแผนไว้ ยังไม่เปิดใช้งาน

เนื่องจากคำค้นหาคือคำว่า "ฟรี" ตามตัวอักษร เราจะพูดให้ตรงไปตรงมา: OrcaRouter วางแผนที่จะมีระดับฟรีสำหรับ Qwen3.8-27B เมื่อค่าน้ำหนักถูกปล่อยออกมาเท่านั้น ตอนนี้ยังไม่เปิดใช้งานจริง ยังไม่มีเอนด์พอยต์ให้เรียกใช้ และฉันจะไม่วางตัวอย่างชั่วคราวเอาไว้ เราจะประกาศเมื่อมีอะไรให้ประกาศจริงๆ สิ่งที่เราโฮสต์อยู่ในวันนี้คือ Qwen3.8-Max ที่ราคา $2/$6 ต่อ 1M โทเค็น โดยไม่มีการบวกเพิ่ม — และรุ่น 27B ยังไม่ได้อยู่บนแพลตฟอร์ม เพราะยังไม่มีใครสามารถให้บริการมันได้

สิ่งที่คุณใช้ได้ฟรีตอนนี้

หากความต้องการของคุณคือ "โมเดลโอเพนคลาส 27B ที่ฉันสามารถรันได้โดยไม่ต้องจ่ายเงิน" คุณไม่จำเป็นต้องรอ คำตอบที่ตรงไปตรงมาในระดับเดียวกันคือ Qwen3.6-27B ซึ่งเป็นรุ่นก่อนหน้าโดยตรงของโมเดลที่คุณกำลังรอ

Comparison of Qwen3.6-27B and Nemotron 3.5 Lightning 30B A3B, which you can run free today, against Qwen3.8-27B, which is not yet released.

Qwen3.6-27B อยู่ภายใต้สัญญาอนุญาต Apache 2.0 เป็นโมเดลแบบ dense ขนาด 27.8B พารามิเตอร์ รองรับบริบท 262K และรับอินพุตทั้งข้อความ รูปภาพ และวิดีโอแบบเนทีฟ ไฟล์ GGUF แบบ Q4_K_M มีขนาดประมาณ 16.5GB และรันได้ประมาณ 25 โทเคนต่อวินาทีบน GPU สำหรับผู้บริโภคขนาด 24GB (16–18 โทเคนต่อวินาทีบน M4 Max) ตัวเลขที่ผู้พัฒนารายงานจากโมเดลการ์ด: SWE-Bench Verified 77.2, MMLU-Pro 86.2, AIME 2026 94.1, GPQA Diamond 87.8 และ MMMU 82.9 หาก Qwen3.8-27B คือ "27B" รุ่นนี้คือ 27B ที่คุณสามารถสัมผัสได้จริงในวันนี้ — ตระกูลเดียวกัน การออกแบบแบบ dense เดียวกัน และเปิดให้ใช้งานแล้ว

Nemotron 3.5 Lightning 30B A3Bเป็นโมเดลที่มาในรูปแบบที่แตกต่างออกไป และให้ใช้ฟรีเช่นกัน: เปิดตัวเมื่อวันที่ 11 สิงหาคม 2026 ภายใต้ไลเซนส์ OpenMDW 1.1 ของ NVIDIA เป็นโมเดล Mixture-of-Experts ที่มีพารามิเตอร์รวม 30B ใช้งานจริงประมาณ 3B สถาปัตยกรรมไฮบริด Mamba-2 รองรับบริบทสูงสุด 1M — เช็คพอยต์ NVFP4 มีขนาดประมาณ 21.6GB ส่วน Q4 GGUF ประมาณ 25GB ต้องใช้การ์ดจอ 24GB ขึ้นไป เนื่องจากพารามิเตอร์ทั้งหมด 30 พันล้านตัวต้องโหลดเข้าหน่วยความจำ แม้ว่าจะมีเพียงประมาณ 3 พันล้านตัวที่ทำงานต่อโทเคน รายงานแรก ๆ ระบุว่าทำงานได้ใกล้ 45 โทเคนต่อวินาทีบน GPU ตัวเดียว โมเดลนี้สร้างขึ้นสำหรับเลเยอร์การทำงานของเอเจนต์ — การเรียกใช้เครื่องมือ การตรวจสอบ การจัดรูปแบบ — ไม่ใช่การให้เหตุผลระดับแนวหน้า หากปริมาณงานของคุณเป็นงานพื้นฐานปริมาณมากของเอเจนต์ มันสามารถเอาชนะโมเดล dense 27B ในงานจริงของคุณได้

และหากสิ่งที่คุณต้องการโดยเฉพาะคือ API โฮสต์ฟรีในตอนนี้ แทนที่จะติดตั้งในเครื่อง "ฟรี" ที่จริงใจเพียงอย่างเดียวคือโควตาของ Alibaba Qwen3.8-Max: 1M โทเค็น ภูมิภาคสิงคโปร์ 90 วัน มันไม่ใช่ 27B และเป็นเพียงสิทธิ์การประเมิน ไม่ใช่บริการ — ใช้มันเพื่อลองพฤติกรรมของ Qwen3.8 ตอนนี้ แล้วค่อยย้ายไปที่อื่น

เมื่อคำแนะนำนี้ผิด

หากคุณมี GPU ขนาด 24GB+ อยู่แล้ว กรอบความคิดแบบ "รอ tier ฟรี" นั้นผิดสำหรับคุณ ในวันที่ weights ถูกปล่อยออกมา vLLM บน weights อย่างเป็นทางการคือ tier ฟรีของคุณ คุณจะรอเพื่อความสะดวกที่คุณไม่จำเป็นต้องใช้ รอประมาณสองสัปดาห์ก็ต่อเมื่อคุณต้องการลำดับขั้น quantization แบบ GGUF ที่ผ่านการปรับแต่งมาอย่างดีเท่านั้น

หากคุณกำลังสร้างต้นแบบตามสัญญา APIโควตาฟรีแบบโฮสต์ (เมื่อ 27B มีให้ใช้งานแล้ว) อาจมีต้นทุนต่ำกว่าเวลาที่คุณเสียไป — แม้จะมีการหมดอายุ 90 วันและการล็อกภูมิภาค การเช่าเครื่อง GPU เพื่อสร้างต้นแบบหนึ่งสัปดาห์ก็มักเป็นเส้นทางที่แพงกว่า

หากใบอนุญาตกลายเป็น Tongyi Qianwen แทนที่จะเป็น Apache,"free weights" จะไม่ได้หมายความว่าสามารถนำไปใช้เชิงพาณิชย์ได้อย่างอิสระเกินเกณฑ์ 100 ล้าน MAU โปรดอ่านไฟล์ LICENSE ใน repository จริงก่อนที่คุณจะสร้างอะไรบนพื้นฐานของมัน — นั่นคือหนทางที่พบบ่อยที่สุดที่ "free open-weights" จะกลายเป็นใบแจ้งหนี้

และถ้า Alibaba เลื่อนกำหนดอีกครั้ง — มันเกินกำหนดที่สัญญาไว้แล้วสองวัน — ทุกสัปดาห์ที่ผ่านไปทำให้ Qwen3.6-27B กลายเป็นตัวเลือกที่ถูกต้อง แทนที่จะเป็นเพียงมาตรการชั่วคราว

A timeline from announcement to free local run of Qwen3.8-27B.

บรรทัดล่าง

ไม่มี Qwen3.8-27B API แบบฟรี เพราะไม่มี Qwen3.8-27B อยู่ที่ไหนเลย เมื่อมีการปล่อย weights ออกมา ช่องทางฟรีสามทางคือ การโฮสต์เอง (จ่ายด้วยฮาร์ดแวร์) ฟรีเทียร์แบบโฮสต์ (จ่ายด้วยข้อจำกัด) และฟรีเทียร์ที่ OrcaRouter วางแผนไว้ ซึ่งยังไม่เปิดใช้งาน และเราจะแจ้งให้ทราบเมื่อเปิดใช้งานแล้ว วันนี้สิ่งที่ใกล้เคียงฟรีที่สุดคือ Qwen3.6-27B บนฮาร์ดแวร์ของคุณเอง การรอไม่ได้ทำให้คุณเสียอะไรนอกจากตัว 27B ส่วนการรันรุ่นก่อนหน้าก็ไม่ทำให้คุณเสียอะไรนอกจาก GPU ที่คุณสามารถนำไปใช้งานอื่นได้ในระหว่างนี้

การเปรียบเทียบในบทความนี้1

ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน

© 2026 OrcaRouter

สำหรับผู้ให้บริการ

ให้บริการแพลตฟอร์มการอนุมานอยู่หรือไม่ นำโมเดลของคุณขึ้น OrcaRouter

providers@orcarouter.ai

เข้าร่วมคอมมูนิตี้ของเรา

Discordsupport@orcarouter.aiXGitHubYouTube