
Step 5 Preview กับ Qwen 3.8 Max Prime: หนึ่งจุดดัชนี สี่ดอลลาร์สามสิบแปดเซนต์
- Orcaใหม่Orca: OrcaCyber Zero 1.52026-10-10$3.00 / $7.50 ต่อ 1 ล้านโทเค็น
- openaiใหม่OpenAI: GPT-6.1 Sol2026-09-2952ความฉลาด
- anthropicใหม่Anthropic: Claude Sonnet 5.52026-09-2856ความฉลาด
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 ต่อ 1 ล้านโทเค็น · 113 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238ความฉลาด
- OpenAIOpenAI: GPT-6 Sol2026-09-2248ความฉลาด
- AnthropicAnthropic: Claude Opus 5.52026-09-2258ความฉลาด
- xAIGrok 4.72026-09-2146ความฉลาด
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 ต่อ 1 ล้านโทเค็น · 52 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 ต่อ 1 ล้านโทเค็น · 423 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040ความฉลาด
- OpenAIOpenAI: GPT-6 Astra2026-09-0453ความฉลาด77การเขียนโค้ด
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241ความฉลาด76การเขียนโค้ด
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245ความฉลาด76การเขียนโค้ด
- AnthropicAnthropic: Claude Fable 5.12026-09-0153ความฉลาด82การเขียนโค้ด
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 ต่อ 1 ล้านโทเค็น · 62 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 ต่อ 1 ล้านโทเค็น · 399 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642ความฉลาด72การเขียนโค้ด
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 ต่อ 1 ล้านโทเค็น · 230 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845ความฉลาด75การเขียนโค้ด
เริ่มจากสิ่งที่ช่องค้นหาจะไม่บอกคุณ Qwen 3.8 Max Prime ไม่ใช่โมเดล แต่เป็นช่องทางให้บริการ (serving lane) — น้ำหนักชุดเดียวกับ Qwen3.8-Max ที่ผู้ขายนำออกให้ใช้ทั่วไปเมื่อวันที่ 3 สิงหาคม 2026 แล้วขายภายใต้ ID โมเดลที่สองในราคาเป็นสองเท่าของเรตการ์ดระหว่างประเทศพอดี Step 5 Preview เรือธงแบบปิดของ StepFun เปิด API เมื่อวันที่ 20 กันยายน 2026 และเป็นโมเดลในความหมายปกติ นั่นคือ ปลายทางเดียว ราคาเดียว ชุดน้ำหนักเดียวที่คุณถือไว้ไม่ได้ ฉะนั้นการเทียบกันแบบตรงไปตรงมาครั้งนี้จึงเป็นการจับโมเดลที่ผ่านการวัดมาแล้วมาเทียบกับชั้นบริการที่ยังไม่ได้วัด และผลคำนวณที่ออกมาก็ตรงไปตรงมายิ่งกว่าที่ผู้ขายรายใดจะกล้าใส่ลงในสไลด์ บนดัชนี Artificial Analysis Intelligence Index ที่เป็นอิสระ ทั้งสองห่างกันอยู่หนึ่งคะแนน คือ 44 ต่อ 45 และในแง่ต้นทุนต่อหนึ่งงานที่ทำสำเร็จ ทั้งสองห่างกันที่ 1.03 ดอลลาร์ ต่อ 5.41 ดอลลาร์ หนึ่งคะแนน กับสี่ดอลลาร์สามสิบแปดเซนต์ ต่อหนึ่งงาน — และนั่นยังไม่นับความเร็วที่ Prime เรียกเก็บเงินจริง ซึ่งคุณยังไม่ได้จ่ายซื้อเลยด้วยซ้ำ
สิ่งที่จะกล่าวต่อไปคือการแยกตัวเลขนั้นออกเป็นส่วน ๆ ว่า มันมาจากไหน เหตุใด Qwen ID มาตรฐานจึงเป็นครึ่งที่แพงกว่าอยู่แล้วในการเปรียบเทียบ ก่อนที่ Prime จะทำให้สิ่งใดเป็นสองเท่า และเงินสี่ดอลลาร์ต่องานที่เพิ่มขึ้นนั้นกำลังซื้ออะไรและไม่ได้ซื้ออะไร
ชื่อนี้กำลังทำหน้าที่ที่ตัวผลิตภัณฑ์ไม่ได้ทำ
อาลีบาบาประกาศเปิดตัว Prime — 优速模式 (โหมดเร็ว) — ในงานประชุมหยุนชีเมื่อวันที่ 22 กันยายน 2026 และเผยแพร่เป็นรายการหนึ่งในตารางราคาของ Model Studio เอกสารของอาลีบาบาเองระบุไว้อย่างชัดเจนว่าเกิดอะไรขึ้นบ้าง: ความเร็วเอาต์พุตเพิ่มขึ้นเป็น 1.5 ถึง 2 เท่าของ API มาตรฐาน และตามคำกล่าวของผู้ให้บริการ ความสามารถและข้อจำกัดการใช้งานเหมือนกับโมเดลต้นฉบับทุกประการ ไม่มีจำนวนพารามิเตอร์ใหม่ ไม่มีสัญญาเอนด์พอยต์ใหม่ ไม่มีความสามารถใดที่ ID มาตรฐานไม่มี คุณเพียงเปลี่ยนชื่อโมเดลในเนื้อหาคำขอ ก็เข้าสู่ช่องทางด่วนได้แล้ว

นั่นทำให้คำค้นหากลายเป็นกับดัก ใครก็ตามที่กำลังมองหาเรือธงของ Qwen ที่ใหม่กว่า Qwen3.8-Max จะพบ "Prime" และอ่านมันเป็นหมายเลขเวอร์ชัน มันคือราคา ทุกสิ่งที่ชื่อสื่อถึงเกี่ยวกับความสามารถนั้นมาจาก Qwen3.8-Max เอง: โมเดล sparse mixture-of-experts ขนาด 2.4 ล้านล้านพารามิเตอร์ โดยมีพารามิเตอร์ที่ทำงานอยู่ประมาณ 95 พันล้านตัวต่อโทเคน ผู้เชี่ยวชาญ 512 คนต่อเลเยอร์ และบริบทขนาด 983,616 โทเคนบนการกำหนดค่าที่คณะกรรมการอิสระทดสอบ
Step 5 Preview ไม่มีความกำกวมแบบเดียวกัน และมีปัญหาตรงกันข้าม StepFun ระบุว่ามีพารามิเตอร์รวมประมาณ 6 แสนล้านตัว โดยเปิดใช้งาน 2.7 หมื่นล้านตัว รองรับอินพุตข้อความ รูปภาพ และวิดีโอ หน้าต่างบริบท 1M โทเคน และเพดานเอาต์พุต 64,000 โทเคนที่ระบุไว้ในเอกสาร โดยเลือกความพยายามในการให้เหตุผลได้ที่ระดับต่ำ กลาง หรือสูง เป็นโมเดลแบบกรรมสิทธิ์ มีการสัญญาว่าจะมีเช็กพอยต์ BF16 ภายในวันที่ 15 ตุลาคม 2026 และยังไม่ได้เผยแพร่ มิเรอร์ชุมชนของบิลด์ BF16 แพร่กระจายบน Hugging Face ตั้งแต่วันที่ API เปิด แต่การอัปโหลดซ้ำไม่ถือเป็นการเปิดตัว และ StepFun ยังไม่ได้เผยแพร่ประกาศเกี่ยวกับเวตแบบเปิด
ดังนั้นคู่นี้จึงเอนเอียงไปข้างหนึ่งอย่างแท้จริงก่อนที่เบนช์มาร์กจะปรากฏขึ้นแม้แต่ตัวเดียว: โมเดลที่เปิดให้ดูตัวอย่างซึ่งอาจกลายเป็นไฟล์ดาวน์โหลดได้ในภายหลัง เทียบกับระดับการให้บริการที่ปรับราคาใหม่ของโมเดลหนึ่งที่จะไม่เป็นเช่นนั้น
หนึ่งจุดดัชนีมีค่าใช้จ่ายเท่าไร
โมเดลทั้งสองถูกทดสอบโดยผู้ประเมินอิสระรายเดียวกัน และนี่คือจุดที่การเปรียบเทียบเริ่มทำให้เรื่องราวของความถูกกว่าต่อโทเคนอึดอัดใจ อ่านต่อ 10 ตุลาคม 2026:
• Index — Step 5 Preview 44 สูงกว่าค่ามัธยฐาน 26 ของโมเดลที่เทียบเคียงได้อย่างมาก ส่วน Qwen3.8-Max บนบิลด์ 0902 ได้ 45 มากกว่าอยู่หนึ่งคะแนน
• ต้นทุนต่องานจัดทำดัชนีที่เสร็จสมบูรณ์อยู่ที่ $1.03 เทียบกับ $5.41 ดีกว่าถึงกว่าห้าเท่า
• ราคาเอาต์พุต — $2.70 เทียบกับ $6.00 ต่อล้านโทเค็นบน ID มาตรฐาน ซึ่งจะกลายเป็น $9.902 เมื่อคุณเปลี่ยนไปใช้ Prime Step 5 Preview ถูกกว่ามาตรฐาน 2.2 เท่า และถูกกว่า Prime 3.7 เท่า
• ราคาอินพุต — $1.00 เทียบกับ $2.00 มาตรฐาน และ $3.301 บน Prime เป็นภาพสะท้อนของคอลัมน์เอาต์พุต และเป็นสิ่งที่สำคัญกว่ามากเมื่อคุณอ่านรายละเอียดต้นทุนด้านล่าง
• แคชฮิต — 0.10 ดอลลาร์ต่อล้านโทเคนบน Step 5 Preview คิดเป็นส่วนลด 90 เปอร์เซ็นต์; 0.25 ดอลลาร์บน Qwen3.8-Max คิดเป็นส่วนลด 87.5 เปอร์เซ็นต์ ซึ่งหน้าของผู้ขายเองปัดเป็น 88 เปอร์เซ็นต์
• เอาต์พุตโทเค็นต่อวินาที — 87 เทียบกับ 35.4 ในกรณีนี้ Qwen เป็นตัวที่ช้า และช้ากว่าประมาณสองเท่าครึ่ง
คอลัมน์ต่อโทเคนกับคอลัมน์ต่องานให้ผลไม่ตรงกัน และคอลัมน์ต่องานคือคอลัมน์ที่ควรเชื่อถือ ด้วยเหตุผลที่จะปรากฏให้เห็นก็ต่อเมื่อคุณเปิดรายละเอียดต้นทุน ในการรันดัชนีของ Step 5 Preview จาก $1.03 นั้น $0.85 อยู่ฝั่งอินพุต และ $0.17 เป็นเอาต์พุต ในรอบของ Qwen3.8-Max จาก $5.41 นั้น $4.76 อยู่ฝั่งอินพุต และ $0.65 เป็นเอาต์พุต ราคาป้ายห่างกันราวสองเท่า ส่วนค่าใช้จ่ายต่องานห่างกันถึงห้าเท่า เพราะการรันของ Qwen ป้อนโทเคนอินพุตประมาณ 9.9 พันล้านโทเคนผ่านฮาร์เนส เทียบกับ 5.5 พันล้านของ Step 5 Preview และเพราะปริมาณส่วนใหญ่เป็นทราฟฟิกแคชที่ถูกอ่านซ้ำด้วยส่วนลดใดก็ตามที่ผู้ให้บริการให้ไว้ แทนที่จะเป็นอัตราที่ประกาศไว้
Step 5 Preview ถูกบอร์ดอธิบายว่ามีความละเอียดมาก โดยมีเอาต์พุตโทเคนราว 160 ล้านโทเคนทั่วทั้งชุด เทียบกับค่ามัธยฐานที่ 82 ล้าน — และ Qwen3.8-Max ก็ถูกอธิบายด้วยถ้อยคำเดียวกันเป๊ะ โดยอยู่ที่ราว 190 ล้าน เมื่อเทียบกับค่ามัธยฐานเดียวกัน ทั้งสองตัวนี้ไม่ใช่โมเดลที่ตอบสั้น หากความยาวของเอาต์พุตคือสิ่งที่คุณหวังจะปรับให้เหมาะสม ทั้งสองคอลัมน์ก็ไม่ได้ช่วยคุณเลย

การเปรียบเทียบนี้มีช่องโหว่ และช่องโหว่นั้นมีรูปร่างเป็น Prime
ตัวเลขทุกตัวในส่วนก่อนหน้านี้ถูกวัดบน Qwen3.8-Max ID มาตรฐาน ไม่มีตัวเลขใดถูกวัดบน Prime
นั่นไม่ใช่เรื่องเล็กๆ ทางเทคนิค จุดขายทั้งหมดของ Prime คือโทเคนมาถึงเร็วขึ้น และตัวเลขความเร็วเพียงตัวเดียวบนบอร์ดสำหรับตระกูลนี้คือ 35.4 โทเคนเอาต์พุตต่อวินาทีของ ID มาตรฐาน — ซึ่งช้าที่สุดในสาม ID ที่กล่าวถึงตรงนี้อย่างห่างไกล และเป็นแถวเดียวที่ Qwen3.8-Max ไม่ได้แค่แพง แต่ยังมีประสิทธิภาพต่ำอย่างเห็นได้ชัด ถ้า Prime ทำได้ถึงขอบบนของช่วงที่ Alibaba ระบุ 35.4 นั้นจะกลายเป็นประมาณ 70 ซึ่งยังต่ำกว่า 87 ของ Step 5 Preview ในขณะที่มีค่าใช้จ่ายต่อโทเคนเอาต์พุตสูงกว่า 3.7 เท่า ถ้าทำได้แค่ขอบล่างของช่วง ก็จะกลายเป็นประมาณ 53
ตัวเลขเหล่านั้นเป็นการประมาณการที่อิงจากตัวคูณที่ผู้ขายระบุ ไม่ใช่ผลจากการวัด และควรติดป้ายกำกับว่าเป็นเช่นนั้น เท่าที่เราหาได้ ไม่มีใครเคยเผยแพร่การทดสอบทรูพุตแบบอิสระของ Prime mode เลย ตัวเลข 1.5 ถึง 2 เท่าเป็นของ Alibaba เอง และเป็นข้ออ้างที่รับน้ำหนักเพียงข้อเดียวภายใต้ทั้งระดับนี้
รายละเอียดเชิงโครงสร้างเพียงหนึ่งเดียวที่สนับสนุน Prime คือกฎการจำกัดอัตรา และเป็นเรื่องง่ายที่จะมองข้ามไป เอกสารของ Alibaba ระบุว่าภายใต้ Prime เมื่อปริมาณการเรียกถึงขีดจำกัดอัตรา หากแพลตฟอร์มยังมีทรัพยากรเหลืออยู่ คำขอจะไม่ถูกจำกัด — ดังนั้นปริมาณงานที่คุณใช้ได้จะไม่ต่ำกว่าขีดจำกัดที่ระบุไว้ นั่นคือเพดานอ่อนที่มีพื้นแข็ง: ภายใต้การแย่งชิงทรัพยากรคุณจะได้ตามขีดจำกัด ภายใต้ความจุที่ว่างคุณอาจได้มากกว่า สำหรับลูปของเอเจนต์ที่ยิงคำขอแบบต่อเนื่องหลายสิบครั้ง สิ่งนี้สำคัญยิ่งกว่าค่ามัธยฐาน เพราะคำขอที่ช้าที่สุดเป็นตัวกำหนดว่าลูปจะจบลงเมื่อใด นี่ยังเป็นคำอธิบายที่ชัดเจนที่สุดว่าทำไม Prime ถึงมีอยู่ในฐานะผลิตภัณฑ์ตั้งแต่แรก Alibaba กำลังขายตำแหน่งในคิวจากความจุที่ตนสร้างไว้แล้ว และคิดเงินเป็นสองเท่าสำหรับสิทธิ์ในการได้รับบริการก่อนจากความจุนั้น
สิ่งที่เรตการ์ดทั้งสองใบบอกเมื่อนำมาวางเทียบกัน
Alibaba เผยแพร่แถว Qwen ของตนติดกัน ซึ่งทำให้การคำนวณของระดับนี้ลงตัวเป็นพิเศษ บนหน้าสากล แถว Prime ระบุว่าอินพุต $3.301 และเอาต์พุต $9.902 ต่อล้านโทเค็น เทียบกับ $1.65 และ $4.951 สำหรับ ID มาตรฐานและสำหรับ pin 0902 ของมัน นั่นคือ 2.0 พอดีในทั้งสองคอลัมน์ — ไม่ใช่ค่าประมาณที่ปัดเศษ แต่เป็นอัตราส่วนตามจริงของตัวเลขที่เผยแพร่ หน้าตาราคาภาษาอังกฤษของ StepFun ระบุ Step 5 Preview ไว้ที่อินพุต $1.00, $0.10 เมื่อแคชฮิต และเอาต์พุต $2.70 โดยอินพุตแบบแคชมิสส์รวมต้นทุนการเขียนเนื้อหาใหม่ลงในแคช ตัวเลขแคชฮิตที่ผู้ขายเผยแพร่คือส่วนลด 90 เปอร์เซ็นต์; คณะกรรมการอิสระบันทึกไว้ 95 เปอร์เซ็นต์จากเอกสารชุดเดียวกัน และเป็นเรื่องที่ควรรู้ว่าคุณกำลังอ้างอิงตัวเลขใดในสองตัวนี้ในการคำนวณ
วางการ์ดสามใบไว้ในคอลัมน์เดียว แล้วรูปร่างก็ชัดเจน เอาต์พุต Prime $9.902 เอาต์พุต Qwen มาตรฐาน $6.00 ตามบันทึกของบอร์ด และ $4.951 บนหน้าสากลของ Alibaba เอง เอาต์พุต Step 5 Preview $2.70 และในเลนราคาถูกที่ไม่มีใครโฆษณา การอ่านแคชของ Step 5 Preview อยู่ที่ $0.10 เทียบกับ $0.25 ของ Qwen — ซึ่งสำคัญกว่าคอลัมน์เอาต์พุตสำหรับภาระงานใดก็ตามที่ใช้คำนำหน้าเดิมซ้ำ
คำเตือนหนึ่งเรื่องเกี่ยวกับตัวเลขที่ล้าสมัย เพราะโมเดลตระกูลนี้ถูกปรับราคามากกว่าหนึ่งครั้งในเจ็ดสัปดาห์ ราคาอินพุต 2 ดอลลาร์และเอาต์พุต 6 ดอลลาร์สำหรับ Qwen3.8-Max ที่ถูกอ้างอิงกันแพร่หลายนั้นเป็นพาดหัวข่าวตอนเปิดตัวในเดือนสิงหาคม และยังคงเป็นตัวเลขที่แท็บสิงคโปร์ของ Alibaba แสดงอยู่ ตอนนี้แถวสำหรับลูกค้าต่างประเทศและทั่วโลกอ่านเป็น $1.65 และ $4.951 แล้ว ถ้าคุณกำลังคำนวณค่าใช้จ่าย ให้ใช้ตารางราคาสำหรับภูมิภาคของคุณ และอ่านใหม่อีกครั้งในวันที่คุณตัดสินใจใช้งานจริง
สองวิธีในการอ่าน 2×
เนื่องจาก Prime เป็นโมเดลเดียวกันในราคาสองเท่าของ standard ID ส่วนเพิ่มจึงกำหนดราคาได้ง่ายแต่ยากที่จะให้เหตุผล ที่ระดับสูงสุดของ Alibaba คุณจ่าย 2 เท่าเพื่อความเร็ว 2 เท่า ซึ่งต้นทุนเท่าเดิมต่อวินาทีของเวลาแฝงที่ลดลง ที่ระดับล่าง คุณจ่าย 2 เท่าเพื่อ 1.5 เท่า คิดเป็นส่วนเพิ่ม 33 เปอร์เซ็นต์ต่อวินาทีที่ประหยัดได้ ทั้งสองระดับไม่เกินเหตุสำหรับงานแบบโต้ตอบ แต่ก็ไม่สามารถให้เหตุผลได้สำหรับงานแบตช์ข้ามคืน นั่นคือเหตุผลที่คำแนะนำมาตรฐานเกี่ยวกับระดับนี้ — การเรียกที่ไวต่อเวลาแฝงบน Prime ส่วนอื่นๆ ทั้งหมดบน standard ID — ก็เป็นคำแนะนำที่ถูกต้องเช่นกัน
การเปรียบเทียบกับ Step 5 Preview คือจุดที่เหตุผลเปลี่ยนรูปไป และนี่คือส่วนที่กรอบ "vs" ทำให้มองเห็นได้ชัด Prime ไม่ได้แข่งขันกับ Step 5 Preview ในเรื่องราคาเลยด้วยซ้ำ ID มาตรฐานมีราคาแพงกว่าต่อโทเคนเอาต์พุตอยู่แล้วเมื่อเทียบกับ Step 5 Preview แพงกว่าห้าเท่าต่องานที่เสร็จสมบูรณ์หนึ่งงาน และได้คะแนนสูงกว่าหนึ่งคะแนน Prime ทวีคูณด้านต้นทุนของสมการที่แพ้อยู่แล้ว และซื้อความเร็วกลับคืนมา ซึ่ง Step 5 Preview มีมากกว่าโดยไม่เสียค่าใช้จ่าย ถ้าสิ่งที่คุณต้องการจากตระกูลนี้คือความเร็ว คำกล่าวที่ตรงไปตรงมาคือ โมเดลที่อยู่อีกด้านของหน้านี้ให้ 87 โทเคนต่อวินาทีที่ $2.70 ต่อโทเคนเอาต์พุตหนึ่งล้านโทเคน และเลนเร็วให้ช่วงที่ไปได้สูงสุด ตามตัวเลขของ Alibaba เอง ประมาณ 70 ที่ $9.902
นั่นไม่ใช่ข้อโต้แย้งว่า Step 5 Preview ชนะ มันเป็นข้อโต้แย้งว่าคุณค่าของ Prime นั้นอยู่ภายในสายผลิตภัณฑ์ของ Alibaba เองทั้งหมด และข้อสนับสนุนสำหรับมันนั้นขึ้นอยู่กับเวิร์กโหลดที่ความได้เปรียบหนึ่งจุดในดัชนีของ Qwen3.8-Max, คอนเท็กซ์ 983,616 โทเคนของมัน หรือโปรไฟล์งานที่แตกต่างของมัน ทำงานที่คอนเท็กซ์ 1M โทเคนของ Step 5 Preview ไม่ทำ ซึ่งเป็นการเปรียบเทียบที่ยังไม่มีใครรันได้ เพราะแถว Prime ไม่มีอยู่ในบอร์ดอิสระใดๆ

สิ่งนี้จะลงเอยอย่างไรสำหรับผู้ซื้อ
ทั้งสองตัวนี้ไม่มีอยู่ใน OrcaRouter ส่วน Step 5 Preview สามารถเข้าถึงได้ผ่าน API ของ StepFun เองและแพลตฟอร์มบุคคลที่สามจำนวนหนึ่ง ขณะที่ Prime เป็นระดับหนึ่งของ Alibaba Cloud Model Studio ที่ให้บริการผ่าน endpoint ซึ่งจำกัดขอบเขตตาม workspace และคุณสามารถตรวจสอบข้อกล่าวอ้างทั้งสองกับแค็ตตาล็อกของเราได้ในนาทีเดียวกับที่อ่านสิ่งนี้ ซึ่งเป็นการทดสอบที่ดีกว่าการเพียงเชื่อคำพูดของเรา
เส้นทาง What we do ของเราเป็นผลิตภัณฑ์อีกตัวในตระกูลเดียวกัน และบังเอิญเป็นตัวที่การคำนวณในบทความนี้ชี้กลับมาหาเรื่อย ๆ Qwen3.8-Max มาตรฐานและพินแบบระบุวันที่ Qwen3.8-Max-0902 อยู่ในแคตตาล็อกบนคีย์เดียวกับพี่น้องอย่าง Qwen3.8-Max-Preview, Qwen3.8-Flash และ Qwen3.8-27B พร้อมกับโมเดลอื่นอีกกว่า 200 ตัว โดยมีราคาตั้งต้นของผู้ให้บริการที่ส่งผ่านมาด้วยมาร์กอัป 0 เปอร์เซ็นต์ สองสิ่งตามมาจากตรงนี้ และทั้งสองล้วนมีผลต่อการตัดสินใจข้างต้น ข้อแรกคือ การเปลี่ยนแปลงเรตการ์ดที่ Alibaba จะปรากฏฝั่งเราในวันเดียวกับที่ Alibaba ประกาศ — ซึ่งเป็นคุณสมบัติที่คุณต้องการพอดีจากผู้ให้บริการที่ปรับราคาตระกูลนี้ไปแล้วถึงสองครั้งในเจ็ดสัปดาห์ ข้อที่สองคือ ฐานของคุณจะไม่ใช่การเดิมพันกับผู้ให้บริการรายเดียวอีกต่อไป: ID มาตรฐานคือระดับที่คุณมีแนวโน้มจะเก็บไว้บนเส้นทางเริ่มต้นของคุณมากที่สุด และการเก็บมันไว้หลังเลเยอร์การจัดเส้นทางแทนที่จะเป็นการเชื่อมต่อโดยตรง คือสิ่งที่ทำให้การตัดสินใจเรื่อง Prime ย้อนกลับได้เป็นรายเอนด์พอยต์แทนที่จะเป็นรายสัญญา
หากคุณกำลังเลือกระหว่างสองชื่อในชื่อบทความนี้ การแยกทางเลือกนั้นตรงไปตรงมา จงเลือก Step 5 Preview เมื่อคุณต้องการคะแนน อินพุตวิดีโอและรูปภาพ และส่วนลดแคช 90 เปอร์เซ็นต์ และยอมรับว่าคุณกำลังเช่า preview ซึ่งเช็กพอยต์เป็นเพียงคำสัญญาสำหรับวันที่ 15 ตุลาคม มากกว่าเป็นใบอนุญาต จงเลือก Qwen 3.8 Max Prime เฉพาะเมื่อคุณผูกพันกับ Qwen3.8-Max อยู่แล้ว และได้วัดจากพรอมป์ของคุณเองแล้วว่า 35 โทเคนต่อวินาทีของ ID มาตรฐานคือสิ่งที่ทำให้คุณเสียเงิน — และประเมินการตัดสินใจนั้นเทียบกับ 2× ไม่ใช่ 1.5× เพราะระดับบนสุดของช่วงผู้ขายไม่ใช่ตัวเลขที่คุณจะเห็นในการใช้งานจริง
การวัดที่จะยุติเรื่องนี้ยังไม่มี และเป็นการดีกว่าที่จะพูดตรง ๆ อย่างนั้นแทนที่จะตกแต่งให้ดูดี มีใครสักคนต้องรัน Prime ผ่านฮาร์เนสที่รัน Step 5 Preview ด้วย เผยแพร่การกระจายของทรูพุตแทนที่จะเป็นตัวคูณ และวางตัวเลขต้นทุนต่องานไว้ข้างจุดดัชนีที่มันซื้อได้ จนถึงตอนนั้น ตัวเลขเดียวที่ทั้งสองฝ่ายมีร่วมกันคือเรตการ์ดสองใบ และทั้งสองพูดสิ่งเดียวกันจากทิศทางตรงกันข้าม: เลนเร็วเป็นวิธีที่แพงที่สุดในการซื้อโทเคน Qwen3.8-Max และเป็นวิธีที่ช้าที่สุดในการซื้อหนึ่งวินาทีของเวลาจริง เมื่อเทียบกับสิ่งที่ทางเลือกอื่นคิดค่าสำหรับวินาทีเดียวกัน
การเปรียบเทียบในบทความนี้1
ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
