
Step 5 Preview เทียบกับ GPT-6 Astra: ราคาอินพุตสิบเท่าแลกกับคะแนนดัชนีเก้าคะแนน
- Orcaใหม่Orca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 ต่อ 1 ล้านโทเค็น
- orcaใหม่Orca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 ต่อ 1 ล้านโทเค็น
- deepseekใหม่DeepSeek: DeepSeek V4.1 Flash2026-09-1040ความฉลาด
- openaiOpenAI: GPT-6 Astra2026-09-0453ความฉลาด77การเขียนโค้ด
- googleGoogle: Gemini 3.8 Flash2026-09-0241ความฉลาด76การเขียนโค้ด
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245ความฉลาด76การเขียนโค้ด
- anthropicAnthropic: Claude Fable 5.12026-09-0153ความฉลาด82การเขียนโค้ด
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 ต่อ 1 ล้านโทเค็น
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642ความฉลาด72การเขียนโค้ด
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 ต่อ 1 ล้านโทเค็น
- z-aiZ.ai: GLM 5.32026-08-1845ความฉลาด75การเขียนโค้ด
- obsidianQwen3.8 27B2026-08-1534ความฉลาด68การเขียนโค้ด
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236ความฉลาด69การเขียนโค้ด
- grokSpaceXAI: Grok 4.62026-08-1244ความฉลาด77การเขียนโค้ด
- metaMeta: Muse Spark 1.22026-08-0540ความฉลาด72การเขียนโค้ด
- qwenQwen: Qwen3.8 Max2026-08-0345ความฉลาด76การเขียนโค้ด
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135ความฉลาด69การเขียนโค้ด
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 ต่อ 1 ล้านโทเค็น
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
สองโมเดลนี้ถูกประกาศห่างกันสิบเจ็ดวัน และตั้งราคาไว้ราวกับอยู่คนละดาวกันเลย Step 5 Preview โมเดล sparse mixture-of-experts ขนาด 600B พารามิเตอร์ของ StepFun ที่ประกาศเมื่อวันที่ 20 กันยายน 2026 คิดราคา 1.00 ดอลลาร์ต่ออินพุตหนึ่งล้านโทเคน และ 2.70 ดอลลาร์ต่อเอาต์พุตหนึ่งล้านโทเคน GPT-6 Astra โมเดลเรือธงของผู้พัฒนารายนี้ที่เปิดตัวเมื่อวันที่ 3 กันยายน 2026 คิดราคา 10.00 และ 50.00 ดอลลาร์สำหรับหน่วยเดียวกัน เมื่ออินพุตต่ำกว่าเกณฑ์ 272K โทเคน — และ 20.00 กับ 75.00 ดอลลาร์เมื่อเกินเกณฑ์นั้น นั่นคือราคาอินพุตสิบเท่า และราคาเอาต์พุตประมาณสิบแปดเท่า สำหรับโมเดลที่ได้คะแนนสูงกว่าเก้าคะแนนบน Intelligence Index อิสระ คือ 53 ต่อ 44 คำถามว่า Astra ดีกว่าหรือไม่นั้นไม่ต้องสงสัย แต่คำถามว่าช่องว่างนั้นคุ้มค่ากับเงินเพิ่มสามสิบดอลลาร์ต่อเอาต์พุตหนึ่งล้านโทเคนในงานของคุณหรือไม่ต่างหาก และคำตอบจะเปลี่ยนไปสองครั้งระหว่างบทความนี้
แต่ละโมเดลใช้สำหรับอะไร
Step 5 Preview ถูกสร้างและวางจำหน่ายสำหรับงานแบบเอเจนต์: การเขียนโค้ดด้วย AI, วิศวกรรมซอฟต์แวร์, งานองค์ความรู้ระดับมืออาชีพ, การเงิน สถาปัตยกรรมได้รับการปรับให้เหมาะกับสิ่งนี้ — พารามิเตอร์รวม 600B โดยมีประมาณ 27B ที่ทำงานต่อโทเคน, บริบท 1M โทเคน, อินพุตข้อความและภาพ, และการให้เหตุผลด้วยการคิดแบบขยาย StepFun ข้ามสาย Step 4.x ทั้งหมดเพื่อมาถึงจุดนี้ โดยก้าวตรงจาก Step-3.7-Flash ไปยัง Step 5
GPT-6 Astra เป็นเรือธงอเนกประสงค์ของ OpenAI: คอนเท็กซ์ 1M โทเคน, เอาต์พุตสูงสุด 128K โทเคน, อินพุตรับข้อความ รูปภาพ และไฟล์, เอาต์พุตเป็นข้อความ, วันตัดองค์ความรู้ 30 เมษายน 2026 และรองรับการให้เหตุผล การเขียนโค้ด และเวิร์กโฟลว์แบบเอเจนต์ิก มันคือโมเดลที่องค์กรเลือกใช้เมื่อคำตอบต้องถูกต้อง และค่าใช้จ่ายโทเคนไม่ใช่ข้อจำกัดที่ผูกมัด
• ดัชนีความฉลาด — Step 5 Preview 44 กับ GPT-6 Astra 53
• พารามิเตอร์ — Step 5 Preview 600B ทั้งหมด / 27B ที่ใช้งาน เทียบกับ GPT-6 Astra ที่ไม่เปิดเผย
• บริบทและเพดานเอาต์พุต — ทั้งคู่มีบริบท 1M โทเคน; Astra ระบุหน้าต่าง 1,050,000 โทเคน และเพดานเอาต์พุต 128K ส่วน StepFun ยังไม่เปิดเผยเพดานเอาต์พุต
• รูปแบบการป้อนข้อมูล — ข้อความและรูปภาพ เทียบกับ ข้อความ รูปภาพ และไฟล์
• ความเร็วเอาต์พุต — Step 5 Preview 99.8 โทเคน/วินาที เทียบกับ GPT-6 Astra 59.3 โทเคน/วินาที
• ราคาต่อ 1M โทเค็น — $1.00 ขาเข้า / $2.70 ขาออก เทียบกับ $10.00 ขาเข้า / $50.00 ขาออก เมื่ออินพุตต่ำกว่า 272K และเพิ่มเป็น $20.00 / $75.00 เมื่อสูงกว่านั้น
• แคช — Step 5 Preview ส่วนลด 95% เทียบกับ GPT-6 Astra ที่มีส่วนลดการอ่าน 90% พร้อมอัตราการเขียนแคช 12.50 ดอลลาร์ต่อล้าน
• ค่าใช้จ่ายต่อหนึ่งงานใน Intelligence Index — Step 5 Preview $0.71 เทียบกับ GPT-6 Astra $3.26

ใบแจ้งหนี้ ทีละบรรทัด
ราคาของ Step 5 Preview แบบคงที่และถูก: ขาเข้า $1.00 ขาออก $2.70 พร้อมส่วนลดแคช 95% ซึ่งทำให้อินพุตที่แคชไว้อยู่ที่ประมาณ $0.05 ต่อล้านโทเค็น เมื่อใช้ส่วนผสมแบบ 7:2:1 ของแคชฮิต อินพุต และเอาต์พุต — แนวปฏิบัติที่บล็อกนี้ใช้กับทราฟฟิกของเอเจนต์ — อัตราผสมจะอยู่ที่ประมาณ $0.51 ต่อล้านโทเค็น และต้นทุนต่องาน Intelligence Index อยู่ที่ $0.71 เป็นอันดับ 27 จาก 200 ข้อควรระวังคือความเยิ่นเย้อ: โมเดลสร้างโทเค็นเอาต์พุต 160M บน Index นั้น เทียบกับค่ามัธยฐาน 92M ดังนั้นจำนวนโทเค็นดิบจึงสูงกว่าที่ราคาหน้าป้ายบ่งชี้
ราคาของ GPT-6 Astra เป็นแบบขั้นบันได และขั้นบันไดคือส่วนที่ควรอ่านอย่างละเอียด ต่ำกว่า 272K โทเค็นอินพุตต่อคำขอ ราคาอยู่ที่ $10.00 และ $50.00; สูงกว่านั้น $20.00 และ $75.00 ขั้นบันไดถูกเลือกโดยจำนวนโทเค็นอินพุตของแต่ละคำขอ ซึ่งสำคัญกว่าที่ฟังดู สำหรับโมเดลที่ขายด้วยบริบท 1M โทเค็น — การเรียกใช้บริบทขนาดใหญ่เพียงครั้งเดียวจะข้ามเส้นและเพิ่มอัตราค่าใช้จ่ายสำหรับคำขอทั้งหมดเป็นสองเท่า การอ่านแคชอยู่ที่ $1.00 ต่อล้าน ซึ่งเป็นส่วนลด 90% และการเขียนแคชอยู่ที่ $12.50 ต่อล้าน ที่ส่วนผสม 7:2:1 เดียวกัน อัตราผสมจะอยู่ที่ประมาณ $7.70 ต่อล้านโทเค็น และค่าใช้จ่ายต่องาน Index อยู่ที่ $3.26 เป็นอันดับที่ 71 จาก 200
Astra ไปคนละทางในเรื่องความยาวของคำตอบ และเป็นโมเดลที่กระชับกว่าในที่นี้: 60M โทเคนเอาต์พุตบน Index เทียบกับ 160M ของ Step 5 Preview อยู่อันดับ 27 จาก 200 ในด้านนั้น การมีโทเคนน้อยลงในอัตราที่สูงขึ้นช่วยลดช่องว่างลงในลักษณะที่ตัวคูณแบบดิบกล่าวเกินจริง แต่มันไม่ได้ปิดช่องว่างนั้น — ตัวเลขต้นทุนต่องานได้หักลบความยาวของคำตอบ พฤติกรรมแคช และราคาออกมาด้วยกันแล้ว และ $3.26 เทียบกับ $0.71 ก็ยังเป็นความต่าง 4.6 เท่า
เก้าคะแนนดัชนีซื้ออะไรได้บ้าง
ตัวเลขเด่นของ Astra เป็นของ OpenAI เองและยังไม่มีการทำซ้ำ: 96.1 ใน GPQA Diamond, 72.6% ใน OSWorld 2.0, 97.6% ใน FrontierMath Tier 4, 57.2% ใน Humanity's Last Exam เมื่อใช้เครื่องมือ และประมาณ 57.9% ใน Terminal-Bench 4.0 ตัวเลข ARC-AGI-3 เป็นตัวที่ต้องจัดการอย่างระมัดระวัง — OpenAI รายงาน 99.9% ภายใต้ฮาร์เนสแบบ provider-adapter ของตัวเอง และ 62.7% บนฮาร์เนสมาตรฐาน และความต่าง 37 จุดระหว่างฮาร์เนสเป็นการบอกอะไรเกี่ยวกับฮาร์เนสอย่างน้อยไม่น้อยไปกว่าที่บอกเกี่ยวกับโมเดล
ตัวเลขที่เผยแพร่ของ Step 5 Preview อยู่ในช่วงเดียวกันในงานเอเจนต์ที่มันถูกสร้างขึ้นมาเพื่อ และมีข้อแม้เดียวกัน: 33.3% บน Terminal-Bench 4.0, 80.5 บน ProgramBench, 67.7 บน DeepSWE v1.1 และ 49.0 บน StepCodeBench ทั้งหมดมาจาก StepFun และไม่มีผลใดถูกทำซ้ำโดยอิสระ ต่างค่าย ต่างฮาร์เนส ไม่มีการรันร่วมกัน — ซึ่งนั่นคือเหตุผลที่ช่องว่าง 9 คะแนนที่วัดโดยอิสระจึงเป็นตัวเลขที่มีประโยชน์มากกว่าตัวเลขใด ๆ เหล่านี้
ช่องว่างนั้นมีจริงและไม่ใช่เล็ก ๆ บนบอร์ดที่มี 200 โมเดล 53 และ 44 อยู่ในอันดับที่สามและอันดับที่ยี่สิบสี่ และความแตกต่างนั้นปรากฏออกมาเป็นงานคนละประเภท มากกว่าจะเป็นคะแนนที่ต่างกันในงานเดียวกัน: ชัยชนะที่ Astra เผยแพร่กระจุกตัวอยู่ที่การให้เหตุผลระยะยาวและการใช้คอมพิวเตอร์ ซึ่งเป็นจุดที่อันดับต้น ๆ ของบอร์ดฉีกตัวออกไป หากภาระงานของคุณอยู่ตรงนั้น เก้าคะแนนนั้นมีค่ามากกว่าใบแจ้งหนี้
ข้อควรระวังหนึ่งประการเกี่ยวกับคะแนนของ Astra Artificial Analysis ปรับปรุง Intelligence Index และตัวเลขของโมเดลเดียวกันอาจคลาดเคลื่อนไปตามสแนปช็อตที่จัดทำห่างกันหลายสัปดาห์ — 52.8, 53 และ 54.7 ปรากฏทั้งหมดในเนื้อหาที่เผยแพร่เกี่ยวกับโมเดลนี้ภายในเดือนเดียวกัน ตัวเลข 53 บนหน้าของโมเดลปัจจุบันคือตัวเลขที่ควรใช้ และการเปรียบเทียบใด ๆ ที่นำสแนปช็อต Astra เวอร์ชันเก่ามาวางข้างตัวเลข Step 5 Preview ปัจจุบัน ก็เท่ากับวัดด้วยไม้บรรทัดคนละอัน

ความเร็วและความหน่วงเป็นสองคำถามที่แตกต่างกัน
ในด้านความเร็วในการสร้าง บอร์ดจัดอันดับอิสระชัดเจนมาก: 99.8 โทเคนเอาต์พุตต่อวินาทีสำหรับ Step 5 Preview เทียบกับ 59.3 สำหรับ GPT-6 Astra ซึ่งยังช้ากว่าค่าเฉลี่ย 70 โทเคนต่อวินาทีของโมเดลที่วัดด้วย ในลูปการเขียนโค้ดแบบโต้ตอบ นั่นคือความแตกต่างระหว่างคำแนะนำกับการหยุดรอ และมันทบต้นสะสมตลอดเซสชันเหมือนกับส่วนลดแคช
ความหน่วงเป็นเรื่องที่ซับซ้อนกว่า และตัวเลขเพียงตัวเดียวทำให้เข้าใจผิดในเรื่องนี้ Astra จะจัดเส้นทางการให้เหตุผลก่อนที่จะส่งออก ดังนั้นเวลาถึงโทเคนแรกกับเวลาถึงคำตอบที่ใช้งานได้จึงไม่ใช่การวัดเดียวกัน และตัวเลขที่เผยแพร่สำหรับเรื่องนี้ก็กระจายกว้างมาก ขึ้นอยู่กับว่านับการให้เหตุผลด้วยหรือไม่ จากทราฟฟิกของเราเองในช่วงเจ็ดวันที่ผ่านมา ค่ามัธยฐานเวลาถึงโทเคนแรกของ GPT-6 Astra อยู่ที่ 6.72 วินาที โดยเปอร์เซ็นไทล์ที่ 95 อยู่ที่ 10.00 วินาที — เป็นตัวเลขที่ผู้เรียกใช้ประสบจริงผ่านเอนด์พอยต์ของเรา Artificial Analysis ระบุว่าเวลาถึงโทเคนแรกของ Step 5 Preview อยู่ที่ 2.96 วินาทีบนชุดทดสอบของตนเอง และตัวเลขสองตัวนี้ไม่ได้วัดด้วยวิธีเดียวกัน จึงไม่ควรนำมาลบกัน
จุดที่ความไม่สมมาตรของแคชส่งผลจริง
ทั้งสองโมเดลให้ส่วนลดกับพรีฟิกซ์ที่ซ้ำกันอย่างมาก และทั้งคู่คิดค่าบริการสำหรับการเขียนพรีฟิกซ์เหล่านั้น โดยความแตกต่างระหว่างทั้งสองอยู่ที่ 20 เท่าในการอ่าน ส่วนลดแคช 95% ของ Step 5 Preview ทำให้อินพุตที่แคชไว้อยู่ที่ประมาณ $0.05 ต่อล้านโทเคน GPT-6 Astra อ่านแคชที่ $1.00 ต่อล้าน — ส่วนลด 90% จากอัตราพื้นฐานที่สูงกว่า 10 เท่า — และเขียนที่ $12.50 ต่อล้าน
สำหรับลูปของเอเจนต์ที่ส่งพรอมต์ระบบและบริบทของที่เก็บโค้ดเดิมซ้ำในทุกเทิร์น อัตราการอ่านคือสิ่งที่ทบต้น และส่วนลดที่ลึกกว่าของโมเดลที่ถูกกว่าก็มีค่ามากกว่าส่วนลดที่ตื้นกว่าของโมเดลที่แพงกว่า ส่วนผสมของ Astra ยังคงอยู่ที่ประมาณ $7.70 ต่อล้านโทเคน เทียบกับ $0.51 ของ Step 5 Preview ที่ส่วนผสม 7:2:1 เดียวกัน — ความแตกต่าง 15 เท่าที่เซสชันยาวไม่ทำให้ช่องว่างแคบลง แต่กลับกว้างขึ้น
รันทั้งสองจากคีย์เดียว
GPT-6 Astra เปิดใช้งานแล้วบน OrcaRouter ภายใต้ openai/gpt-6-astra ในอัตราตามที่ OpenAI ประกาศไว้ — 10.00 และ 50.00 ดอลลาร์ต่อล้านโทเคนสำหรับปริมาณที่ต่ำกว่าเกณฑ์ 272K และ 20.00 และ 75.00 ดอลลาร์สำหรับปริมาณที่เกินเกณฑ์ — ส่งผ่านโดยไม่บวกเพิ่มแม้แต่บาทเดียว ดังนั้นหากผู้ให้บริการปรับราคา ฝั่งเราจะอัปเดตให้ทันทีในวันเดียวกัน แทนที่จะรอถึงรอบบิลถัดไป ข้อมูลเทเลเมตรีเจ็ดวันของเราเองบนเอนด์พอยต์ดังกล่าวแสดงค่ามัธยฐานที่ 6.72 วินาที และเปอร์เซ็นไทล์ที่ 95 ที่ 10.00 วินาทีสำหรับเวลาถึงโทเคนแรกตามที่กล่าวข้างต้น พร้อมด้วยปริมาณทราฟฟิก 277.9 ล้านโทเคนที่ไหลผ่านเอนด์พอยต์นี้ในสัปดาห์ที่ผ่านมา
Step 5 Preview ไม่ได้อยู่ในแค็ตตาล็อกของเรา และเราไม่ได้จัดเส้นทางให้มัน มันทำงานบน API และ Studio ของ StepFun เอง และนั่นคือที่เดียวที่มันทำงานได้จนกว่าเช็กพอยต์วันที่ 15 ตุลาคมจะมาถึง ความไม่สมมาตรนั้นไม่ใช่ข้อบกพร่องของการเปรียบเทียบ แต่คือตัวการเปรียบเทียบเอง ครึ่งที่ถูกของคู่นี้คือครึ่งที่คุณต้องไปเรียกจากที่อื่น และครึ่งที่คุณนำเข้าสู่โปรดักชันได้วันนี้ตั้งอยู่หลัง API เดียวสำหรับโมเดลมากกว่า 200 ตัว: GPT-6 Astra ในอัตราข้างต้น, GLM-5.3 ที่ $1.26 และ $3.96, DeepSeek V4 Pro, Claude Opus 5 และอื่น ๆ พร้อมการสลับสำรองอัตโนมัติข้ามผู้ให้บริการที่ช่วยตรึงเส้นทางให้มั่นคงเมื่อความจุของผู้ให้บริการเปลี่ยนแปลง และ routing DSL ที่ทำให้งานเริ่มต้นแบบประหยัดแล้วค่อยยกระดับเมื่อจำเป็นเท่านั้น กฎการยกระดับนั้นคือคำตอบที่แท้จริงสำหรับช่องว่างราคาสิบเท่า: งานส่วนใหญ่ไม่จำเป็นต้องใช้รุ่นท็อปสุดของกระดาน และเลเยอร์การจัดเส้นทางคือวิธีที่คุณหยุดจ่ายสำหรับส่วนที่ไม่จำเป็น

ใครควรเลือกอันไหน
ถ้าภาระงานของคุณคือเอเจนต์ระยะยาวที่ต้องทำงานยากให้สำเร็จอย่างถูกต้อง — การใช้คอมพิวเตอร์ การวิจัยหลายขั้นตอน งานที่คำตอบผิดมีต้นทุนสูงกว่าค่าโทเคน — การนำอยู่เก้าคะแนนของ GPT-6 Astra คือส่วนที่ถูกที่สุดของการตัดสินใจ และใบแจ้งหนี้คือราคาที่ต้องจ่ายสำหรับความสามารถนั้น ใช้มันเป็นเป้าหมายสำหรับการยกระดับ ไม่ใช่ค่าเริ่มต้น และระวังเกณฑ์ 272K: คำขอที่ใหญ่เกินไปเพียงครั้งเดียวจะทำให้อัตราสำหรับทุกอย่างในคำขอนั้นเพิ่มเป็นสองเท่า
ถ้าภาระงานของคุณเป็นข้อความแบบเอเจนต์ปริมาณสูง — การสร้างโค้ด, การรีแฟกเตอร์, การสกัดข้อมูลแบบมีโครงสร้าง, ลูปภายในของผู้ช่วยเขียนโค้ด — Step 5 Preview นำหน้าในทุกสิ่งที่ใบแจ้งหนี้และนาฬิกาใส่ใจ และเก้าคะแนนดัชนีไม่น่าจะอยู่รอดเมื่อเจอการกระจายงานที่ไม่ได้อยู่บนสุดของตารางอันดับ จุดที่ต้องระวังไม่ได้อยู่ที่ประสิทธิภาพ: โมเดลนี้เป็นกรรมสิทธิ์ โดยไม่มีสัญญาอนุญาตที่เผยแพร่ ไม่มีการอนุญาตให้ใช้เชิงพาณิชย์ และไม่มีเช็คพอยต์จนถึงวันที่ 15 ตุลาคม คุณสามารถเรียกใช้มันได้ แต่คุณไม่สามารถเป็นเจ้าของมัน ปรับแต่งละเอียด หรือส่งมอบสิ่งที่ต่อยอดจากมันได้
หากคำตอบยังไม่ชัดเจน แนวทางที่เหมาะสมคือการแยกตามระดับมากกว่าการเลือกอย่างใดอย่างหนึ่ง จงกำหนดเส้นทางทราฟฟิกทั่วไปไปยังโมเดลระดับกลาง และสงวน Astra ไว้สำหรับคำขอที่ต้องการระดับสูงสุดของบอร์ด — ทั้งสองปลายของกฎนี้อยู่ภายใต้คีย์เดียวจากฝั่งเรา ดังนั้นการแยกนี้จึงมีต้นทุนเป็นกฎการกำหนดเส้นทางหนึ่งข้อ ไม่ใช่สัญญาฉบับที่สอง การจ่ายในอัตราระดับเรือธงให้กับงานที่โมเดลระดับกลางทำเสร็จได้อย่างถูกต้อง คือความผิดพลาดที่การเปรียบเทียบนี้มุ่งพูดถึงจริง ๆ
