
Dots กับ Qwen 3.8 Max: ความแตกต่างอยู่ที่ตำแหน่งที่คุณได้รับอนุญาตให้ย้ายมัน
- typesafeใหม่TypeSafe: Jev 1.132026-09-24$0.04 / $0.00 ต่อ 1 ล้านโทเค็น · 349 tok/s
- OpenAIใหม่OpenAI: GPT-6 Luna2026-09-2237ความฉลาด
- OpenAIใหม่OpenAI: GPT-6 Sol2026-09-2248ความฉลาด
- Anthropicใหม่Anthropic: Claude Opus 5.52026-09-2258ความฉลาด
- xAIใหม่Grok 4.72026-09-2146ความฉลาด
- Orcaใหม่Orca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 ต่อ 1 ล้านโทเค็น · 210 tok/s
- Orcaใหม่Orca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 ต่อ 1 ล้านโทเค็น · 680 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040ความฉลาด
- OpenAIOpenAI: GPT-6 Astra2026-09-0453ความฉลาด77การเขียนโค้ด
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241ความฉลาด76การเขียนโค้ด
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245ความฉลาด76การเขียนโค้ด
- AnthropicAnthropic: Claude Fable 5.12026-09-0153ความฉลาด82การเขียนโค้ด
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 ต่อ 1 ล้านโทเค็น · 49 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 ต่อ 1 ล้านโทเค็น · 102 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642ความฉลาด72การเขียนโค้ด
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 ต่อ 1 ล้านโทเค็น · 219 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845ความฉลาด75การเขียนโค้ด
- obsidianQwen3.8 27B2026-08-1534ความฉลาด68การเขียนโค้ด
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236ความฉลาด69การเขียนโค้ด
- xAISpaceXAI: Grok 4.62026-08-1244ความฉลาด77การเขียนโค้ด
Qwen 3.8 Max เปิดตัวเมื่อวันที่ 3 สิงหาคม 2026 และเป็นระดับความสามารถสูงสุดของ Alibaba จนถึงปัจจุบัน: เป็นมัลติโหมดโดยกำเนิด รับข้อความ รูปภาพ และวิดีโอ แล้วส่งคืนข้อความ ภายในหน้าต่างบริบทขนาด 1,000,000 โทเคน ให้บริการผ่านรูปแบบการเชื่อมต่อสามแบบ — ที่เข้ากันได้กับ OpenAI, เข้ากันได้กับ Anthropic และ DashScope แบบเนทีฟ — จากปักกิ่ง สิงคโปร์ โตเกียว แฟรงก์เฟิร์ต และเวอร์จิเนีย ในราคา $2.00 ต่อโทเคนอินพุตหนึ่งล้านโทเคน และ $6.00 ต่อโทเคนเอาต์พุตหนึ่งล้านโทเคน โดยการอ่านจากแคชอยู่ที่ $0.25 Dots คือเอเจนต์ที่ทำงานตลอดเวลาของบริษัท ประกาศเปิดตัวที่ DevDay เมื่อวันที่ 29 กันยายน 2026: มันมีคอมพิวเตอร์คลาวด์และเบราว์เซอร์เป็นของตัวเอง เข้าถึงแอปมากกว่า 4,000 แอป ทำงานบน GPT-6 Astra และรวมอยู่ใน Pro และ Business Premium เมื่อวางเทียบกัน คำถามที่น่าสนใจไม่ใช่ว่าตัวไหนเก่งกว่า แต่เป็นว่าแต่ละตัวได้รับอนุญาตให้อยู่ได้กี่ที่ และใครเป็นคนตัดสิน
นั่นไม่ใช่ความแตกต่างเชิงนามธรรม มันคือความแตกต่างที่ตัดสินว่าเครื่องมือหนึ่งจะมีให้ใช้ในตลาดของคุณหรือไม่เลย ว่ามันจะถูกตรวจสอบโดยทีมคอมพลายแอนซ์ของคุณได้หรือไม่ และว่างานที่คุณสร้างบนมันจะอยู่รอดเมื่อข้อกำหนดเปลี่ยนแปลงหรือไม่ ความสามารถเป็นส่วนที่ง่ายของการเปรียบเทียบนี้ ส่วนความสามารถในการพอร์ตคือส่วนที่ต้องมาจบเอาทีหลังและแลกมาด้วยค่าใช้จ่ายสูง
สามวิธีในการเรียกใช้โมเดลเดียว
รูปแบบไวร์ฟอร์แมตดูเหมือนรายละเอียดทางวิศวกรรมเล็ก ๆ จนกระทั่งคุณต้องย้ายแอปพลิเคชันระหว่างผู้ให้บริการ ส่วนต่อประสานที่เข้ากันได้กับ OpenAI หมายความว่าไลบรารีไคลเอนต์ที่มีอยู่ทำงานได้โดยไม่ต้องมีเลเยอร์แปลความ ส่วนแบบที่เข้ากันได้กับ Anthropic หมายความว่าโค้ดเบสที่เขียนตามรูปแบบข้อความของผู้ให้บริการรายอื่นไม่จำเป็นต้องเขียนใหม่ อินเทอร์เฟซ DashScope แบบเนทีฟเปิดเผยชุดคุณสมบัติเต็มรูปแบบ รวมถึงสวิตช์เปิดปิดการคิด สามส่วนต่อประสานสำหรับหนึ่งโมเดลหมายความว่าต้นทุนในการสลับคือ base URL กับคีย์ ไม่ใช่การรีแฟกเตอร์
สิ่งนั้นสำคัญที่สุดเมื่อมันหายไป ไม่มีอะไรเกี่ยวกับจุดที่ให้รูปแบบ URL หรือคีย์ เพราะจุดไม่ใช่สิ่งที่คุณเรียกใช้ — มันคือสิ่งที่คุณพูดคุยด้วยภายในอินเทอร์เฟซของคนอื่น การย้ายตรรกะของเอเจนต์ของคุณไปที่อื่นหมายถึงการสร้างมันขึ้นใหม่ จากนั้นเชื่อมต่อคอนเนกเตอร์สี่พันตัวที่มันพึ่งพาอีกครั้ง แล้วจึงค้นพบว่าตัวไหนในนั้นทำงานในแบบที่คุณไม่ได้จดบันทึกไว้
• สิ่งที่คุณกำลังซื้อ — เวิร์กเกอร์แบบโฮสต์ภายใน ChatGPT, Slack และ Teams (Dots) เทียบกับเอนด์พอยต์โมเดลที่คุณเรียกใช้ได้จากทุกที่ (Qwen 3.8 Max)
• อินเทอร์เฟซ — ไม่มีเผยแพร่สำหรับจุด เมื่อเทียบกับพื้นผิวที่เข้ากันได้กับ OpenAI, ที่เข้ากันได้กับ Anthropic และ DashScope แบบเนทีฟ (Qwen 3.8 Max)
• รันที่ไหน — คอมพิวเตอร์บนคลาวด์ของ OpenAI พร้อมเบราว์เซอร์ของตัวเอง (Dots) เทียบกับห้าภูมิภาคที่ให้บริการทั่วเอเชีย ยุโรป และอเมริกาเหนือ (Qwen 3.8 Max)
• การควบคุมการใช้เหตุผล — ไม่ได้เปิดเผยสำหรับจุด เทียบกับ enable_thinking สวิตช์ หรือ reasoning.effort บน Responses API (Qwen 3.8 Max)
• ต้นทุนต่อหน่วย — dot แรกถูกรวมอยู่ใน Pro หรือ Business Premium โดยโควตายังไม่เปิดเผย (Dots) เทียบกับ $2.00 ต่ออินพุต 1 ล้าน และ $6.00 ต่อเอาต์พุต 1 ล้าน การอ่านจากแคช $0.25 (Qwen 3.8 Max)
• หลักฐานอิสระ — เดโมจากผู้ขายและคำแถลงความสามารถ ไม่มีเบนช์มาร์กแม้แต่จุดเดียว เทียบกับ Artificial Analysis Intelligence Index ที่ 45.4 อยู่อันดับที่ 15 จาก 145 โมเดลที่วัด และ 92.8 บน GPQA Diamond (Qwen 3.8 Max)
จุดที่โมเดลไปถึง ในตัวเลขที่คุณตรวจสอบได้
โปรไฟล์ที่เผยแพร่ของ Qwen 3.8 Max จัดอยู่ในระดับ mid-frontier และควรค่าแก่การอ่านอย่างแม่นยำมากกว่าแบบใช้ความรู้สึกโดยรวม ดัชนี AA Intelligence Index ที่ 45.4 ซึ่งจัดให้อยู่ในอันดับที่ 15 จาก 145 โมเดลที่วัดผล ทำให้มันอยู่ในสิบเปอร์เซ็นต์แรกโดยไม่ถึงจุดสูงสุด AA Coding Index ที่ 76.2 ในอันดับที่ 9 จาก 138 นั้นแข็งแกร่งกว่า และ 88.8 บน Terminal-Bench 2.1 ถือเป็นตัวเลขการทำงานแบบเอเจนต์ที่สูงจริง ๆ — สูงกว่า 88.0 ของ GPT-5.6 Sol บนบอร์ดเดียวกัน จุดที่อ่อนกว่าเมื่อเทียบกันคือความสามารถในการเรียกคืนบริบทยาวที่ 80.3 ซึ่งต่ำกว่า 88.7 ของ Kimi K3 และ 83 ของ MiniMax M3 แม้จะมีขนาดหน้าต่างที่เทียบเคียงได้ และ SciCode ที่ 52.1
การวางตำแหน่งของ Alibaba เอง ในคู่มือการโยกย้ายของบริษัท วางโมเดลนี้ให้เทียบตรงกับ GPT-5.5, Claude Opus 4.7 และ Gemini 3.1 Pro และการตีความตัวเลขอย่างตรงไปตรงมาก็คือ นี่เป็นโมเดลที่คุณจะเลือกใช้เมื่อการผสมผสานระหว่างการทำงานของเอเจนต์ที่แข็งแกร่งกับอินพุตหลายรูปแบบสำคัญกว่าการเป็นที่หนึ่งในตารางอันดับความฉลาด ตัวเลขทั้งหมดนั้นเป็นการวัดจากบุคคลที่สามที่มาพร้อมแหล่งอ้างอิงในแค็ตตาล็อกของเรา ไม่ใช่คำกล่าวอ้างของผู้ขาย ซึ่งเป็นเหตุผลที่ทำให้ตัวเลขเหล่านี้มีค่ามากกว่าสไลด์เปิดตัว
ตัวเลขหนึ่งตัวหายไป และควรพูดออกมาดัง ๆ แทนที่จะเติมลงไป: แค็ตตาล็อกของเราไม่ได้ระบุความยาวเอาต์พุตสูงสุดสำหรับโมเดลนี้ บริบทขนาดหนึ่งล้านโทเคนมีบันทึกไว้ ส่วนเพดานเอาต์พุตต่อการตอบกลับหนึ่งครั้งไม่มีระบุ

สิ่งที่ Dots ไม่ได้บอกคุณ และทำไมมันจึงเป็นทางเลือกด้านการออกแบบ
OpenAI เผยแพร่ประโยคเดียวเกี่ยวกับค่าดอต และในนั้นไม่มีตัวเลขอยู่เลย: ดอตแรกถูกรวมอยู่ใน Pro และ Business Premium โดยมีขีดจำกัดแบบขยายในเดือนแรก และไม่มีการตัดลดขีดจำกัดการใช้งาน ChatGPT สำหรับบทสนทนาที่ใช้ดอตนั้น นอกเหนือจากนั้นไม่มีตัวเลขโควต้าใช้งาน ไม่มีราคาดอตที่สอง ไม่มีอัตราค่าความจุเพิ่มเติม และไม่มีต้นทุนต่องาน แพ็กเกจ Pro 500 ราคา 500 ดอลลาร์ต่อเดือนเป็นโควต้าใช้งานบวกโหมด Ultrafast มากกว่าจะเป็นอัตราคิดค่าต่อดอต ดังนั้นแม้แต่แพ็กเกจที่แพงที่สุดก็ยังไม่แปลงเป็นต้นทุนต่อหน่วยของงานเอเจนต์ได้
มันชวนให้ตีความว่านั่นเป็นช่องว่างของเอกสาร แต่ที่แม่นยำกว่าคือตีความว่ามันเป็นเรื่องของประเภทสินค้า: สินค้าที่คิดราคาตามจำนวนที่นั่ง (seat) ไม่สามารถมีราคาต่อหน่วยได้ เพราะจุดสำคัญของที่นั่งก็คือต้นทุนส่วนเพิ่มในการใช้งานมันมองไม่เห็น นั่นสะดวกจริงสำหรับงานสำรวจ และไม่สะดวกจริงสำหรับสิ่งใดก็ตามที่คุณต้องระบุหรือจัดสรรให้กับโปรเจกต์ ลูกค้า หรือรายการงบประมาณ
สังเกตว่าผลิตภัณฑ์ทั้งสองถูกปรับให้เหมาะกับอะไร Qwen 3.8 Max ถูกปรับให้เหมาะกับการถูกเรียกใช้จากที่ไหนก็ได้ โดยอะไรก็ได้ ในรูปแบบใดก็ตามที่ผู้เรียกใช้อยู่แล้ว ส่วน A dot ถูกปรับให้เหมาะกับการใช้งานในที่เดียว ผ่านอินเทอร์เฟซเดียว โดยซ่อนกลไกเบื้องหลังไว้ ทั้งสองเป็นการออกแบบที่สอดคล้องกันในตัวเอง พวกมันเพียงตอบคำถามคนละข้อ และหนึ่งในนั้นตอบคำถามว่า "ฉันย้ายมันไปทีหลังได้ไหม" ด้วยคำว่าไม่

สองคำตอบสำหรับคำถามที่ว่า "จะเกิดอะไรขึ้นถ้าผู้ขายรายนี้เปลี่ยนแปลง"
คำถามเรื่องการพอร์ตจะกลายเป็นรูปธรรมทันทีที่ผู้ขายปรับราคา ประกาศเลิกใช้ตัวระบุ หรือเปลี่ยนสิ่งที่การสมัครใช้บริการครอบคลุม สำหรับโมเดลแบบคิดตามการใช้งานที่มีรูปแบบการรับส่งข้อมูลสามแบบ การตอบสนองเป็นไปอย่างกลไก: ชี้ไคลเอนต์ไปยัง base URL อีกแห่ง หรือเปลี่ยนสตริงโมเดลหนึ่งค่า แล้วแอปพลิเคชันก็ยังทำงานต่อไป ไม่มีอะไรอื่นให้พอร์ต เพราะโมเดลไม่เคยเป็นสิ่งใดนอกจากคำเรียกหนึ่งครั้ง
สำหรับ dot การตอบสนองต่อการเปลี่ยนแปลงเงื่อนไขคือการหยุด คอมพิวเตอร์ เบราว์เซอร์ ตัวเชื่อมต่อ และโควตาการใช้งาน ล้วนเป็นของ OpenAI และไม่มีสิ่งใดในนั้นที่ส่งออกได้ นั่นไม่ใช่การวิจารณ์ผลิตภัณฑ์ แต่เป็นคำอธิบายตามจริงของการเช่าใช้ แต่มันหมายความว่างานที่คุณสร้างขึ้นทั้งหมดภายใน dot มีเส้นทางการย้ายระบบที่ต้องผ่านการเขียนใหม่ และนั่นเป็นข้อเท็จจริงที่ควรคิดรวมไว้ในราคา ก่อนที่คุณจะสร้างสิ่งที่คุณตั้งใจจะพึ่งพาเป็นเวลาหนึ่งปี
OrcaRouter ถูกสร้างขึ้นมาสำหรับกรณีแรก Qwen 3.8 Max ถูกกำหนดเส้นทางเป็น qwen/qwen3.8-maxในราคาตามรายการของผู้ให้บริการของ Alibaba โดยบวกเพิ่ม 0% (markup) ในแคตตาล็อกเดียวกันกับโมเดลอื่นอีกกว่า 200 รายการที่อยู่เบื้องหลังคีย์เดียว พร้อมด้วย การสลับสำรองอัตโนมัติข้ามผู้ให้บริการต้นทาง และ DSL สำหรับการกำหนดเส้นทาง เพื่อประกอบโมเดลหลายตัวเข้าเป็นคำขอเดียว นั่นคือสิ่งที่ทำให้คำถามเรื่องสามภูมิภาคตอบได้ในฝั่งของคุณเอง ไม่ใช่ฝั่งของผู้ขาย: ตัวระบุเดียวกันไปถึงโมเดลได้ไม่ว่าจะให้บริการอยู่ที่ใด และการเปลี่ยนแปลงอัตราค่าบริการจาก Alibaba จะปรากฏบนบิลของคุณในวันเดียวกัน แทนที่จะเป็นตอนต่ออายุครั้งถัดไป สิ่งที่มันไปไม่ถึงคือสิ่งใดก็ตามที่อยู่ภายในเครื่องหมายจุด — ไม่มีปลายทางสำหรับสิ่งนั้น ไม่มีตัวระบุ และไม่มีสติปัญญาทดแทนให้สลับเข้ามา
คำถามที่ควรถามก่อนที่คุณจะตัดสินใจ
ให้ถามว่า งานของคุณจะเกิดอะไรขึ้นในวันที่ผู้ขายเปลี่ยนสิ่งที่คุณควบคุมไม่ได้ ถ้าคำตอบคือ "เราแค่เปลี่ยนสตริงแล้วไปต่อ" แปลว่าคุณกำลังซื้อโมเดล และแบบที่คิดตามปริมาณการใช้งานคือตัวเลือกที่น่าซื้อมากกว่า ถ้าคำตอบคือ "เราคงต้องสร้างมันใหม่ทั้งหมด" แปลว่าคุณกำลังซื้อผลิตภัณฑ์ และคุณควรซื้อมันอย่างตั้งใจ — โดยรู้ว่าความสะดวกที่คุณกำลังจ่ายนั้น ต้องแลกมาด้วยความสามารถในการย้อนกลับ
ไม่มีคำตอบไหนผิด การซื้อความพกพาที่คุณจะไม่มีวันได้ใช้ ก็สิ้นเปลืองพอ ๆ กับการซื้อความสะดวกสบายที่คุณจะต้องหาทางหนีให้พ้น ความผิดพลาดคือการไม่รู้ว่าคุณซื้อสิ่งไหนมา

การเปรียบเทียบในบทความนี้2
ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
