การ์ดชื่อเรื่องที่สร้างขึ้นสำหรับ Step 5 Preview กับ Qwen 3.8 Max Prime อ่านว่า 'หนึ่งจุดดัชนี, สี่ดอลลาร์สามสิบแปดเซนต์' พร้อมชิปแสดงสถิติสามอัน: Artificial Analysis Intelligence Index 44 ต่อ 45, ต้นทุนต่องานดัชนี $1.03 ต่อ $5.41, และราคาเอาต์พุต $2.70 ต่อ $9.902 ต่อล้านโทเค็น โลโก้ OrcaRouter อยู่ในแถบสีขาวที่มุมขวาล่าง
Guides & Insights

Step 5 Preview กับ Qwen 3.8 Max Prime: หนึ่งจุดดัชนี สี่ดอลลาร์สามสิบแปดเซนต์

ผู้เขียน

Rowan Sterling

วันที่เผยแพร่

โมเดลล่าสุด · 20ดูโมเดลทั้งหมด →
เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
กลับไปยังโพสต์ทั้งหมด

เริ่มจากสิ่งที่ช่องค้นหาจะไม่บอกคุณ Qwen 3.8 Max Prime ไม่ใช่โมเดล แต่เป็นช่องทางให้บริการ (serving lane) — น้ำหนักชุดเดียวกับ Qwen3.8-Max ที่ผู้ขายนำออกให้ใช้ทั่วไปเมื่อวันที่ 3 สิงหาคม 2026 แล้วขายภายใต้ ID โมเดลที่สองในราคาเป็นสองเท่าของเรตการ์ดระหว่างประเทศพอดี Step 5 Preview เรือธงแบบปิดของ StepFun เปิด API เมื่อวันที่ 20 กันยายน 2026 และเป็นโมเดลในความหมายปกติ นั่นคือ ปลายทางเดียว ราคาเดียว ชุดน้ำหนักเดียวที่คุณถือไว้ไม่ได้ ฉะนั้นการเทียบกันแบบตรงไปตรงมาครั้งนี้จึงเป็นการจับโมเดลที่ผ่านการวัดมาแล้วมาเทียบกับชั้นบริการที่ยังไม่ได้วัด และผลคำนวณที่ออกมาก็ตรงไปตรงมายิ่งกว่าที่ผู้ขายรายใดจะกล้าใส่ลงในสไลด์ บนดัชนี Artificial Analysis Intelligence Index ที่เป็นอิสระ ทั้งสองห่างกันอยู่หนึ่งคะแนน คือ 44 ต่อ 45 และในแง่ต้นทุนต่อหนึ่งงานที่ทำสำเร็จ ทั้งสองห่างกันที่ 1.03 ดอลลาร์ ต่อ 5.41 ดอลลาร์ หนึ่งคะแนน กับสี่ดอลลาร์สามสิบแปดเซนต์ ต่อหนึ่งงาน — และนั่นยังไม่นับความเร็วที่ Prime เรียกเก็บเงินจริง ซึ่งคุณยังไม่ได้จ่ายซื้อเลยด้วยซ้ำ

สิ่งที่จะกล่าวต่อไปคือการแยกตัวเลขนั้นออกเป็นส่วน ๆ ว่า มันมาจากไหน เหตุใด Qwen ID มาตรฐานจึงเป็นครึ่งที่แพงกว่าอยู่แล้วในการเปรียบเทียบ ก่อนที่ Prime จะทำให้สิ่งใดเป็นสองเท่า และเงินสี่ดอลลาร์ต่องานที่เพิ่มขึ้นนั้นกำลังซื้ออะไรและไม่ได้ซื้ออะไร

ชื่อนี้กำลังทำหน้าที่ที่ตัวผลิตภัณฑ์ไม่ได้ทำ

อาลีบาบาประกาศเปิดตัว Prime — 优速模式 (โหมดเร็ว) — ในงานประชุมหยุนชีเมื่อวันที่ 22 กันยายน 2026 และเผยแพร่เป็นรายการหนึ่งในตารางราคาของ Model Studio เอกสารของอาลีบาบาเองระบุไว้อย่างชัดเจนว่าเกิดอะไรขึ้นบ้าง: ความเร็วเอาต์พุตเพิ่มขึ้นเป็น 1.5 ถึง 2 เท่าของ API มาตรฐาน และตามคำกล่าวของผู้ให้บริการ ความสามารถและข้อจำกัดการใช้งานเหมือนกับโมเดลต้นฉบับทุกประการ ไม่มีจำนวนพารามิเตอร์ใหม่ ไม่มีสัญญาเอนด์พอยต์ใหม่ ไม่มีความสามารถใดที่ ID มาตรฐานไม่มี คุณเพียงเปลี่ยนชื่อโมเดลในเนื้อหาคำขอ ก็เข้าสู่ช่องทางด่วนได้แล้ว

Generated two-column comparison scoreboard for Step 5 Preview and Qwen 3.8 Max Prime across six shared rows: what the name refers to, 'a model' against 'a serving lane for Qwen3.8-Max'; Artificial Analysis Intelligence Index 44 against 45, measured on the standard Qwen ID with no Prime row; cost per index task $1.03 against $5.41; output price $2.70 against $9.902 per million tokens; output speed 87 against 35.4 tokens per second, again measured on the standard ID; and weights, 'proprietary, BF16 checkpoint promised 15 October' against 'proprietary, none'. A footer reads that index, speed and cost-per-task figures are per Artificial Analysis and were measured on the standard Qwen3.8-Max ID rather than on Prime, and that rate cards are Alibaba's international list price and StepFun's own. The OrcaRouter logo sits in a white strip at the bottom right.

นั่นทำให้คำค้นหากลายเป็นกับดัก ใครก็ตามที่กำลังมองหาเรือธงของ Qwen ที่ใหม่กว่า Qwen3.8-Max จะพบ "Prime" และอ่านมันเป็นหมายเลขเวอร์ชัน มันคือราคา ทุกสิ่งที่ชื่อสื่อถึงเกี่ยวกับความสามารถนั้นมาจาก Qwen3.8-Max เอง: โมเดล sparse mixture-of-experts ขนาด 2.4 ล้านล้านพารามิเตอร์ โดยมีพารามิเตอร์ที่ทำงานอยู่ประมาณ 95 พันล้านตัวต่อโทเคน ผู้เชี่ยวชาญ 512 คนต่อเลเยอร์ และบริบทขนาด 983,616 โทเคนบนการกำหนดค่าที่คณะกรรมการอิสระทดสอบ

Step 5 Preview ไม่มีความกำกวมแบบเดียวกัน และมีปัญหาตรงกันข้าม StepFun ระบุว่ามีพารามิเตอร์รวมประมาณ 6 แสนล้านตัว โดยเปิดใช้งาน 2.7 หมื่นล้านตัว รองรับอินพุตข้อความ รูปภาพ และวิดีโอ หน้าต่างบริบท 1M โทเคน และเพดานเอาต์พุต 64,000 โทเคนที่ระบุไว้ในเอกสาร โดยเลือกความพยายามในการให้เหตุผลได้ที่ระดับต่ำ กลาง หรือสูง เป็นโมเดลแบบกรรมสิทธิ์ มีการสัญญาว่าจะมีเช็กพอยต์ BF16 ภายในวันที่ 15 ตุลาคม 2026 และยังไม่ได้เผยแพร่ มิเรอร์ชุมชนของบิลด์ BF16 แพร่กระจายบน Hugging Face ตั้งแต่วันที่ API เปิด แต่การอัปโหลดซ้ำไม่ถือเป็นการเปิดตัว และ StepFun ยังไม่ได้เผยแพร่ประกาศเกี่ยวกับเวตแบบเปิด

ดังนั้นคู่นี้จึงเอนเอียงไปข้างหนึ่งอย่างแท้จริงก่อนที่เบนช์มาร์กจะปรากฏขึ้นแม้แต่ตัวเดียว: โมเดลที่เปิดให้ดูตัวอย่างซึ่งอาจกลายเป็นไฟล์ดาวน์โหลดได้ในภายหลัง เทียบกับระดับการให้บริการที่ปรับราคาใหม่ของโมเดลหนึ่งที่จะไม่เป็นเช่นนั้น

หนึ่งจุดดัชนีมีค่าใช้จ่ายเท่าไร

โมเดลทั้งสองถูกทดสอบโดยผู้ประเมินอิสระรายเดียวกัน และนี่คือจุดที่การเปรียบเทียบเริ่มทำให้เรื่องราวของความถูกกว่าต่อโทเคนอึดอัดใจ อ่านต่อ 10 ตุลาคม 2026:

• Index — Step 5 Preview 44 สูงกว่าค่ามัธยฐาน 26 ของโมเดลที่เทียบเคียงได้อย่างมาก ส่วน Qwen3.8-Max บนบิลด์ 0902 ได้ 45 มากกว่าอยู่หนึ่งคะแนน

• ต้นทุนต่องานจัดทำดัชนีที่เสร็จสมบูรณ์อยู่ที่ $1.03 เทียบกับ $5.41 ดีกว่าถึงกว่าห้าเท่า

• ราคาเอาต์พุต — $2.70 เทียบกับ $6.00 ต่อล้านโทเค็นบน ID มาตรฐาน ซึ่งจะกลายเป็น $9.902 เมื่อคุณเปลี่ยนไปใช้ Prime Step 5 Preview ถูกกว่ามาตรฐาน 2.2 เท่า และถูกกว่า Prime 3.7 เท่า

• ราคาอินพุต — $1.00 เทียบกับ $2.00 มาตรฐาน และ $3.301 บน Prime เป็นภาพสะท้อนของคอลัมน์เอาต์พุต และเป็นสิ่งที่สำคัญกว่ามากเมื่อคุณอ่านรายละเอียดต้นทุนด้านล่าง

• แคชฮิต — 0.10 ดอลลาร์ต่อล้านโทเคนบน Step 5 Preview คิดเป็นส่วนลด 90 เปอร์เซ็นต์; 0.25 ดอลลาร์บน Qwen3.8-Max คิดเป็นส่วนลด 87.5 เปอร์เซ็นต์ ซึ่งหน้าของผู้ขายเองปัดเป็น 88 เปอร์เซ็นต์

• เอาต์พุตโทเค็นต่อวินาที — 87 เทียบกับ 35.4 ในกรณีนี้ Qwen เป็นตัวที่ช้า และช้ากว่าประมาณสองเท่าครึ่ง

คอลัมน์ต่อโทเคนกับคอลัมน์ต่องานให้ผลไม่ตรงกัน และคอลัมน์ต่องานคือคอลัมน์ที่ควรเชื่อถือ ด้วยเหตุผลที่จะปรากฏให้เห็นก็ต่อเมื่อคุณเปิดรายละเอียดต้นทุน ในการรันดัชนีของ Step 5 Preview จาก $1.03 นั้น $0.85 อยู่ฝั่งอินพุต และ $0.17 เป็นเอาต์พุต ในรอบของ Qwen3.8-Max จาก $5.41 นั้น $4.76 อยู่ฝั่งอินพุต และ $0.65 เป็นเอาต์พุต ราคาป้ายห่างกันราวสองเท่า ส่วนค่าใช้จ่ายต่องานห่างกันถึงห้าเท่า เพราะการรันของ Qwen ป้อนโทเคนอินพุตประมาณ 9.9 พันล้านโทเคนผ่านฮาร์เนส เทียบกับ 5.5 พันล้านของ Step 5 Preview และเพราะปริมาณส่วนใหญ่เป็นทราฟฟิกแคชที่ถูกอ่านซ้ำด้วยส่วนลดใดก็ตามที่ผู้ให้บริการให้ไว้ แทนที่จะเป็นอัตราที่ประกาศไว้

Step 5 Preview ถูกบอร์ดอธิบายว่ามีความละเอียดมาก โดยมีเอาต์พุตโทเคนราว 160 ล้านโทเคนทั่วทั้งชุด เทียบกับค่ามัธยฐานที่ 82 ล้าน — และ Qwen3.8-Max ก็ถูกอธิบายด้วยถ้อยคำเดียวกันเป๊ะ โดยอยู่ที่ราว 190 ล้าน เมื่อเทียบกับค่ามัธยฐานเดียวกัน ทั้งสองตัวนี้ไม่ใช่โมเดลที่ตอบสั้น หากความยาวของเอาต์พุตคือสิ่งที่คุณหวังจะปรับให้เหมาะสม ทั้งสองคอลัมน์ก็ไม่ได้ช่วยคุณเลย

Screenshot of the Artificial Analysis model page for Qwen3.8 Max (0902), showing an Intelligence Index of 45 ranked 32 of 227 with a comparable-model median of 26, speed ranked 190 of 227, cost ranked 105 of 227 and verbosity ranked 103 of 227, pricing of $2.00 per million input tokens and $6.00 per million output tokens with an 88 percent cache discount, a measured cost of $5.41 per index task, 190 million output tokens generated across the run against an 82 million median, about 35 output tokens per second, and a 984k-token context.

การเปรียบเทียบนี้มีช่องโหว่ และช่องโหว่นั้นมีรูปร่างเป็น Prime

ตัวเลขทุกตัวในส่วนก่อนหน้านี้ถูกวัดบน Qwen3.8-Max ID มาตรฐาน ไม่มีตัวเลขใดถูกวัดบน Prime

นั่นไม่ใช่เรื่องเล็กๆ ทางเทคนิค จุดขายทั้งหมดของ Prime คือโทเคนมาถึงเร็วขึ้น และตัวเลขความเร็วเพียงตัวเดียวบนบอร์ดสำหรับตระกูลนี้คือ 35.4 โทเคนเอาต์พุตต่อวินาทีของ ID มาตรฐาน — ซึ่งช้าที่สุดในสาม ID ที่กล่าวถึงตรงนี้อย่างห่างไกล และเป็นแถวเดียวที่ Qwen3.8-Max ไม่ได้แค่แพง แต่ยังมีประสิทธิภาพต่ำอย่างเห็นได้ชัด ถ้า Prime ทำได้ถึงขอบบนของช่วงที่ Alibaba ระบุ 35.4 นั้นจะกลายเป็นประมาณ 70 ซึ่งยังต่ำกว่า 87 ของ Step 5 Preview ในขณะที่มีค่าใช้จ่ายต่อโทเคนเอาต์พุตสูงกว่า 3.7 เท่า ถ้าทำได้แค่ขอบล่างของช่วง ก็จะกลายเป็นประมาณ 53

ตัวเลขเหล่านั้นเป็นการประมาณการที่อิงจากตัวคูณที่ผู้ขายระบุ ไม่ใช่ผลจากการวัด และควรติดป้ายกำกับว่าเป็นเช่นนั้น เท่าที่เราหาได้ ไม่มีใครเคยเผยแพร่การทดสอบทรูพุตแบบอิสระของ Prime mode เลย ตัวเลข 1.5 ถึง 2 เท่าเป็นของ Alibaba เอง และเป็นข้ออ้างที่รับน้ำหนักเพียงข้อเดียวภายใต้ทั้งระดับนี้

รายละเอียดเชิงโครงสร้างเพียงหนึ่งเดียวที่สนับสนุน Prime คือกฎการจำกัดอัตรา และเป็นเรื่องง่ายที่จะมองข้ามไป เอกสารของ Alibaba ระบุว่าภายใต้ Prime เมื่อปริมาณการเรียกถึงขีดจำกัดอัตรา หากแพลตฟอร์มยังมีทรัพยากรเหลืออยู่ คำขอจะไม่ถูกจำกัด — ดังนั้นปริมาณงานที่คุณใช้ได้จะไม่ต่ำกว่าขีดจำกัดที่ระบุไว้ นั่นคือเพดานอ่อนที่มีพื้นแข็ง: ภายใต้การแย่งชิงทรัพยากรคุณจะได้ตามขีดจำกัด ภายใต้ความจุที่ว่างคุณอาจได้มากกว่า สำหรับลูปของเอเจนต์ที่ยิงคำขอแบบต่อเนื่องหลายสิบครั้ง สิ่งนี้สำคัญยิ่งกว่าค่ามัธยฐาน เพราะคำขอที่ช้าที่สุดเป็นตัวกำหนดว่าลูปจะจบลงเมื่อใด นี่ยังเป็นคำอธิบายที่ชัดเจนที่สุดว่าทำไม Prime ถึงมีอยู่ในฐานะผลิตภัณฑ์ตั้งแต่แรก Alibaba กำลังขายตำแหน่งในคิวจากความจุที่ตนสร้างไว้แล้ว และคิดเงินเป็นสองเท่าสำหรับสิทธิ์ในการได้รับบริการก่อนจากความจุนั้น

สิ่งที่เรตการ์ดทั้งสองใบบอกเมื่อนำมาวางเทียบกัน

Alibaba เผยแพร่แถว Qwen ของตนติดกัน ซึ่งทำให้การคำนวณของระดับนี้ลงตัวเป็นพิเศษ บนหน้าสากล แถว Prime ระบุว่าอินพุต $3.301 และเอาต์พุต $9.902 ต่อล้านโทเค็น เทียบกับ $1.65 และ $4.951 สำหรับ ID มาตรฐานและสำหรับ pin 0902 ของมัน นั่นคือ 2.0 พอดีในทั้งสองคอลัมน์ — ไม่ใช่ค่าประมาณที่ปัดเศษ แต่เป็นอัตราส่วนตามจริงของตัวเลขที่เผยแพร่ หน้าตาราคาภาษาอังกฤษของ StepFun ระบุ Step 5 Preview ไว้ที่อินพุต $1.00, $0.10 เมื่อแคชฮิต และเอาต์พุต $2.70 โดยอินพุตแบบแคชมิสส์รวมต้นทุนการเขียนเนื้อหาใหม่ลงในแคช ตัวเลขแคชฮิตที่ผู้ขายเผยแพร่คือส่วนลด 90 เปอร์เซ็นต์; คณะกรรมการอิสระบันทึกไว้ 95 เปอร์เซ็นต์จากเอกสารชุดเดียวกัน และเป็นเรื่องที่ควรรู้ว่าคุณกำลังอ้างอิงตัวเลขใดในสองตัวนี้ในการคำนวณ

วางการ์ดสามใบไว้ในคอลัมน์เดียว แล้วรูปร่างก็ชัดเจน เอาต์พุต Prime $9.902 เอาต์พุต Qwen มาตรฐาน $6.00 ตามบันทึกของบอร์ด และ $4.951 บนหน้าสากลของ Alibaba เอง เอาต์พุต Step 5 Preview $2.70 และในเลนราคาถูกที่ไม่มีใครโฆษณา การอ่านแคชของ Step 5 Preview อยู่ที่ $0.10 เทียบกับ $0.25 ของ Qwen — ซึ่งสำคัญกว่าคอลัมน์เอาต์พุตสำหรับภาระงานใดก็ตามที่ใช้คำนำหน้าเดิมซ้ำ

คำเตือนหนึ่งเรื่องเกี่ยวกับตัวเลขที่ล้าสมัย เพราะโมเดลตระกูลนี้ถูกปรับราคามากกว่าหนึ่งครั้งในเจ็ดสัปดาห์ ราคาอินพุต 2 ดอลลาร์และเอาต์พุต 6 ดอลลาร์สำหรับ Qwen3.8-Max ที่ถูกอ้างอิงกันแพร่หลายนั้นเป็นพาดหัวข่าวตอนเปิดตัวในเดือนสิงหาคม และยังคงเป็นตัวเลขที่แท็บสิงคโปร์ของ Alibaba แสดงอยู่ ตอนนี้แถวสำหรับลูกค้าต่างประเทศและทั่วโลกอ่านเป็น $1.65 และ $4.951 แล้ว ถ้าคุณกำลังคำนวณค่าใช้จ่าย ให้ใช้ตารางราคาสำหรับภูมิภาคของคุณ และอ่านใหม่อีกครั้งในวันที่คุณตัดสินใจใช้งานจริง

สองวิธีในการอ่าน 2×

เนื่องจาก Prime เป็นโมเดลเดียวกันในราคาสองเท่าของ standard ID ส่วนเพิ่มจึงกำหนดราคาได้ง่ายแต่ยากที่จะให้เหตุผล ที่ระดับสูงสุดของ Alibaba คุณจ่าย 2 เท่าเพื่อความเร็ว 2 เท่า ซึ่งต้นทุนเท่าเดิมต่อวินาทีของเวลาแฝงที่ลดลง ที่ระดับล่าง คุณจ่าย 2 เท่าเพื่อ 1.5 เท่า คิดเป็นส่วนเพิ่ม 33 เปอร์เซ็นต์ต่อวินาทีที่ประหยัดได้ ทั้งสองระดับไม่เกินเหตุสำหรับงานแบบโต้ตอบ แต่ก็ไม่สามารถให้เหตุผลได้สำหรับงานแบตช์ข้ามคืน นั่นคือเหตุผลที่คำแนะนำมาตรฐานเกี่ยวกับระดับนี้ — การเรียกที่ไวต่อเวลาแฝงบน Prime ส่วนอื่นๆ ทั้งหมดบน standard ID — ก็เป็นคำแนะนำที่ถูกต้องเช่นกัน

การเปรียบเทียบกับ Step 5 Preview คือจุดที่เหตุผลเปลี่ยนรูปไป และนี่คือส่วนที่กรอบ "vs" ทำให้มองเห็นได้ชัด Prime ไม่ได้แข่งขันกับ Step 5 Preview ในเรื่องราคาเลยด้วยซ้ำ ID มาตรฐานมีราคาแพงกว่าต่อโทเคนเอาต์พุตอยู่แล้วเมื่อเทียบกับ Step 5 Preview แพงกว่าห้าเท่าต่องานที่เสร็จสมบูรณ์หนึ่งงาน และได้คะแนนสูงกว่าหนึ่งคะแนน Prime ทวีคูณด้านต้นทุนของสมการที่แพ้อยู่แล้ว และซื้อความเร็วกลับคืนมา ซึ่ง Step 5 Preview มีมากกว่าโดยไม่เสียค่าใช้จ่าย ถ้าสิ่งที่คุณต้องการจากตระกูลนี้คือความเร็ว คำกล่าวที่ตรงไปตรงมาคือ โมเดลที่อยู่อีกด้านของหน้านี้ให้ 87 โทเคนต่อวินาทีที่ $2.70 ต่อโทเคนเอาต์พุตหนึ่งล้านโทเคน และเลนเร็วให้ช่วงที่ไปได้สูงสุด ตามตัวเลขของ Alibaba เอง ประมาณ 70 ที่ $9.902

นั่นไม่ใช่ข้อโต้แย้งว่า Step 5 Preview ชนะ มันเป็นข้อโต้แย้งว่าคุณค่าของ Prime นั้นอยู่ภายในสายผลิตภัณฑ์ของ Alibaba เองทั้งหมด และข้อสนับสนุนสำหรับมันนั้นขึ้นอยู่กับเวิร์กโหลดที่ความได้เปรียบหนึ่งจุดในดัชนีของ Qwen3.8-Max, คอนเท็กซ์ 983,616 โทเคนของมัน หรือโปรไฟล์งานที่แตกต่างของมัน ทำงานที่คอนเท็กซ์ 1M โทเคนของ Step 5 Preview ไม่ทำ ซึ่งเป็นการเปรียบเทียบที่ยังไม่มีใครรันได้ เพราะแถว Prime ไม่มีอยู่ในบอร์ดอิสระใดๆ

Generated rate-card infographic comparing three published price lists in one column: Qwen 3.8 Max Prime at $3.301 input and $9.902 output per million tokens, the standard qwen3.8-max and qwen3.8-max-0902 IDs at $1.65 and $4.951 on Alibaba's international page against the $2 and $6 still shown on its Singapore tab, and Step 5 Preview at $1.00 input, $0.10 cached input and $2.70 output from StepFun's English pricing page. A footer reads that the Prime row is exactly 2.0 times the standard row on both columns and that all figures are vendor list prices read on 10 October 2026.

สิ่งนี้จะลงเอยอย่างไรสำหรับผู้ซื้อ

ทั้งสองตัวนี้ไม่มีอยู่ใน OrcaRouter ส่วน Step 5 Preview สามารถเข้าถึงได้ผ่าน API ของ StepFun เองและแพลตฟอร์มบุคคลที่สามจำนวนหนึ่ง ขณะที่ Prime เป็นระดับหนึ่งของ Alibaba Cloud Model Studio ที่ให้บริการผ่าน endpoint ซึ่งจำกัดขอบเขตตาม workspace และคุณสามารถตรวจสอบข้อกล่าวอ้างทั้งสองกับแค็ตตาล็อกของเราได้ในนาทีเดียวกับที่อ่านสิ่งนี้ ซึ่งเป็นการทดสอบที่ดีกว่าการเพียงเชื่อคำพูดของเรา

เส้นทาง What we do ของเราเป็นผลิตภัณฑ์อีกตัวในตระกูลเดียวกัน และบังเอิญเป็นตัวที่การคำนวณในบทความนี้ชี้กลับมาหาเรื่อย ๆ Qwen3.8-Max มาตรฐานและพินแบบระบุวันที่ Qwen3.8-Max-0902 อยู่ในแคตตาล็อกบนคีย์เดียวกับพี่น้องอย่าง Qwen3.8-Max-Preview, Qwen3.8-Flash และ Qwen3.8-27B พร้อมกับโมเดลอื่นอีกกว่า 200 ตัว โดยมีราคาตั้งต้นของผู้ให้บริการที่ส่งผ่านมาด้วยมาร์กอัป 0 เปอร์เซ็นต์ สองสิ่งตามมาจากตรงนี้ และทั้งสองล้วนมีผลต่อการตัดสินใจข้างต้น ข้อแรกคือ การเปลี่ยนแปลงเรตการ์ดที่ Alibaba จะปรากฏฝั่งเราในวันเดียวกับที่ Alibaba ประกาศ — ซึ่งเป็นคุณสมบัติที่คุณต้องการพอดีจากผู้ให้บริการที่ปรับราคาตระกูลนี้ไปแล้วถึงสองครั้งในเจ็ดสัปดาห์ ข้อที่สองคือ ฐานของคุณจะไม่ใช่การเดิมพันกับผู้ให้บริการรายเดียวอีกต่อไป: ID มาตรฐานคือระดับที่คุณมีแนวโน้มจะเก็บไว้บนเส้นทางเริ่มต้นของคุณมากที่สุด และการเก็บมันไว้หลังเลเยอร์การจัดเส้นทางแทนที่จะเป็นการเชื่อมต่อโดยตรง คือสิ่งที่ทำให้การตัดสินใจเรื่อง Prime ย้อนกลับได้เป็นรายเอนด์พอยต์แทนที่จะเป็นรายสัญญา

หากคุณกำลังเลือกระหว่างสองชื่อในชื่อบทความนี้ การแยกทางเลือกนั้นตรงไปตรงมา จงเลือก Step 5 Preview เมื่อคุณต้องการคะแนน อินพุตวิดีโอและรูปภาพ และส่วนลดแคช 90 เปอร์เซ็นต์ และยอมรับว่าคุณกำลังเช่า preview ซึ่งเช็กพอยต์เป็นเพียงคำสัญญาสำหรับวันที่ 15 ตุลาคม มากกว่าเป็นใบอนุญาต จงเลือก Qwen 3.8 Max Prime เฉพาะเมื่อคุณผูกพันกับ Qwen3.8-Max อยู่แล้ว และได้วัดจากพรอมป์ของคุณเองแล้วว่า 35 โทเคนต่อวินาทีของ ID มาตรฐานคือสิ่งที่ทำให้คุณเสียเงิน — และประเมินการตัดสินใจนั้นเทียบกับ 2× ไม่ใช่ 1.5× เพราะระดับบนสุดของช่วงผู้ขายไม่ใช่ตัวเลขที่คุณจะเห็นในการใช้งานจริง

การวัดที่จะยุติเรื่องนี้ยังไม่มี และเป็นการดีกว่าที่จะพูดตรง ๆ อย่างนั้นแทนที่จะตกแต่งให้ดูดี มีใครสักคนต้องรัน Prime ผ่านฮาร์เนสที่รัน Step 5 Preview ด้วย เผยแพร่การกระจายของทรูพุตแทนที่จะเป็นตัวคูณ และวางตัวเลขต้นทุนต่องานไว้ข้างจุดดัชนีที่มันซื้อได้ จนถึงตอนนั้น ตัวเลขเดียวที่ทั้งสองฝ่ายมีร่วมกันคือเรตการ์ดสองใบ และทั้งสองพูดสิ่งเดียวกันจากทิศทางตรงกันข้าม: เลนเร็วเป็นวิธีที่แพงที่สุดในการซื้อโทเคน Qwen3.8-Max และเป็นวิธีที่ช้าที่สุดในการซื้อหนึ่งวินาทีของเวลาจริง เมื่อเทียบกับสิ่งที่ทางเลือกอื่นคิดค่าสำหรับวินาทีเดียวกัน

การเปรียบเทียบในบทความนี้1

ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน

© 2026 OrcaRouter

สำหรับผู้ให้บริการ

ให้บริการแพลตฟอร์มการอนุมานอยู่หรือไม่ นำโมเดลของคุณขึ้น OrcaRouter

providers@orcarouter.ai

เข้าร่วมคอมมูนิตี้ของเรา

Discordsupport@orcarouter.aiXGitHubYouTube