การ์ดชื่อเรื่องที่สร้างขึ้นมีชื่อว่า 'Step 5 Preview vs GPT-6 Astra — ราคาสูงกว่าสิบเท่า' พร้อมสองคอลัมน์: Step 5 Preview ที่ AA Index 44, รวม 600B / ใช้งาน 27B, ราคา $1.00 / $2.70, ราคาผสม $0.51 และ 99.8 โทเคน/วินาที; GPT-6 Astra ที่ AA Index 53, ราคา $10.00 / $50.00, ราคาผสม $7.70 และ 59.3 โทเคน/วินาที ข้อความส่วนท้ายระบุว่า 'ตัวเลขทั้งสองอ้างอิงตาม Artificial Analysis Intelligence Index; ราคาของ Astra เพิ่มเป็น $20 / $75 เมื่อใช้โทเคนอินพุตเกิน 272K'
Guides & Insights

Step 5 Preview เทียบกับ GPT-6 Astra: ราคาอินพุตสิบเท่าแลกกับคะแนนดัชนีเก้าคะแนน

ผู้เขียน

Gideon Frost

วันที่เผยแพร่

โมเดลล่าสุด · 20ดูโมเดลทั้งหมด
เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
กลับไปยังโพสต์ทั้งหมด

สองโมเดลนี้ถูกประกาศห่างกันสิบเจ็ดวัน และตั้งราคาไว้ราวกับอยู่คนละดาวกันเลย Step 5 Preview โมเดล sparse mixture-of-experts ขนาด 600B พารามิเตอร์ของ StepFun ที่ประกาศเมื่อวันที่ 20 กันยายน 2026 คิดราคา 1.00 ดอลลาร์ต่ออินพุตหนึ่งล้านโทเคน และ 2.70 ดอลลาร์ต่อเอาต์พุตหนึ่งล้านโทเคน GPT-6 Astra โมเดลเรือธงของผู้พัฒนารายนี้ที่เปิดตัวเมื่อวันที่ 3 กันยายน 2026 คิดราคา 10.00 และ 50.00 ดอลลาร์สำหรับหน่วยเดียวกัน เมื่ออินพุตต่ำกว่าเกณฑ์ 272K โทเคน — และ 20.00 กับ 75.00 ดอลลาร์เมื่อเกินเกณฑ์นั้น นั่นคือราคาอินพุตสิบเท่า และราคาเอาต์พุตประมาณสิบแปดเท่า สำหรับโมเดลที่ได้คะแนนสูงกว่าเก้าคะแนนบน Intelligence Index อิสระ คือ 53 ต่อ 44 คำถามว่า Astra ดีกว่าหรือไม่นั้นไม่ต้องสงสัย แต่คำถามว่าช่องว่างนั้นคุ้มค่ากับเงินเพิ่มสามสิบดอลลาร์ต่อเอาต์พุตหนึ่งล้านโทเคนในงานของคุณหรือไม่ต่างหาก และคำตอบจะเปลี่ยนไปสองครั้งระหว่างบทความนี้

แต่ละโมเดลใช้สำหรับอะไร

Step 5 Preview ถูกสร้างและวางจำหน่ายสำหรับงานแบบเอเจนต์: การเขียนโค้ดด้วย AI, วิศวกรรมซอฟต์แวร์, งานองค์ความรู้ระดับมืออาชีพ, การเงิน สถาปัตยกรรมได้รับการปรับให้เหมาะกับสิ่งนี้ — พารามิเตอร์รวม 600B โดยมีประมาณ 27B ที่ทำงานต่อโทเคน, บริบท 1M โทเคน, อินพุตข้อความและภาพ, และการให้เหตุผลด้วยการคิดแบบขยาย StepFun ข้ามสาย Step 4.x ทั้งหมดเพื่อมาถึงจุดนี้ โดยก้าวตรงจาก Step-3.7-Flash ไปยัง Step 5

GPT-6 Astra เป็นเรือธงอเนกประสงค์ของ OpenAI: คอนเท็กซ์ 1M โทเคน, เอาต์พุตสูงสุด 128K โทเคน, อินพุตรับข้อความ รูปภาพ และไฟล์, เอาต์พุตเป็นข้อความ, วันตัดองค์ความรู้ 30 เมษายน 2026 และรองรับการให้เหตุผล การเขียนโค้ด และเวิร์กโฟลว์แบบเอเจนต์ิก มันคือโมเดลที่องค์กรเลือกใช้เมื่อคำตอบต้องถูกต้อง และค่าใช้จ่ายโทเคนไม่ใช่ข้อจำกัดที่ผูกมัด

• ดัชนีความฉลาด — Step 5 Preview 44 กับ GPT-6 Astra 53

• พารามิเตอร์ — Step 5 Preview 600B ทั้งหมด / 27B ที่ใช้งาน เทียบกับ GPT-6 Astra ที่ไม่เปิดเผย

• บริบทและเพดานเอาต์พุต — ทั้งคู่มีบริบท 1M โทเคน; Astra ระบุหน้าต่าง 1,050,000 โทเคน และเพดานเอาต์พุต 128K ส่วน StepFun ยังไม่เปิดเผยเพดานเอาต์พุต

• รูปแบบการป้อนข้อมูล — ข้อความและรูปภาพ เทียบกับ ข้อความ รูปภาพ และไฟล์

• ความเร็วเอาต์พุต — Step 5 Preview 99.8 โทเคน/วินาที เทียบกับ GPT-6 Astra 59.3 โทเคน/วินาที

• ราคาต่อ 1M โทเค็น — $1.00 ขาเข้า / $2.70 ขาออก เทียบกับ $10.00 ขาเข้า / $50.00 ขาออก เมื่ออินพุตต่ำกว่า 272K และเพิ่มเป็น $20.00 / $75.00 เมื่อสูงกว่านั้น

• แคช — Step 5 Preview ส่วนลด 95% เทียบกับ GPT-6 Astra ที่มีส่วนลดการอ่าน 90% พร้อมอัตราการเขียนแคช 12.50 ดอลลาร์ต่อล้าน

• ค่าใช้จ่ายต่อหนึ่งงานใน Intelligence Index — Step 5 Preview $0.71 เทียบกับ GPT-6 Astra $3.26

Generated two-column comparison scoreboard titled 'Step 5 Preview vs GPT-6 Astra — the scoreboard'. The left column gives Step 5 Preview the rows AA Index 44, parameters 600B total / 27B active, price $1.00 / $2.70, cache discount 95%, cost per index task $0.71 and output speed 99.8 tokens/sec. The right column gives GPT-6 Astra the rows AA Index 53, parameters undisclosed, price $10.00 / $50.00, cache discount 90%, cost per index task $3.26 and output speed 59.3 tokens/sec. A footer reads 'Both figures per Artificial Analysis Intelligence Index; Astra pricing rises to $20 / $75 above 272K input tokens.'

ใบแจ้งหนี้ ทีละบรรทัด

ราคาของ Step 5 Preview แบบคงที่และถูก: ขาเข้า $1.00 ขาออก $2.70 พร้อมส่วนลดแคช 95% ซึ่งทำให้อินพุตที่แคชไว้อยู่ที่ประมาณ $0.05 ต่อล้านโทเค็น เมื่อใช้ส่วนผสมแบบ 7:2:1 ของแคชฮิต อินพุต และเอาต์พุต — แนวปฏิบัติที่บล็อกนี้ใช้กับทราฟฟิกของเอเจนต์ — อัตราผสมจะอยู่ที่ประมาณ $0.51 ต่อล้านโทเค็น และต้นทุนต่องาน Intelligence Index อยู่ที่ $0.71 เป็นอันดับ 27 จาก 200 ข้อควรระวังคือความเยิ่นเย้อ: โมเดลสร้างโทเค็นเอาต์พุต 160M บน Index นั้น เทียบกับค่ามัธยฐาน 92M ดังนั้นจำนวนโทเค็นดิบจึงสูงกว่าที่ราคาหน้าป้ายบ่งชี้

ราคาของ GPT-6 Astra เป็นแบบขั้นบันได และขั้นบันไดคือส่วนที่ควรอ่านอย่างละเอียด ต่ำกว่า 272K โทเค็นอินพุตต่อคำขอ ราคาอยู่ที่ $10.00 และ $50.00; สูงกว่านั้น $20.00 และ $75.00 ขั้นบันไดถูกเลือกโดยจำนวนโทเค็นอินพุตของแต่ละคำขอ ซึ่งสำคัญกว่าที่ฟังดู สำหรับโมเดลที่ขายด้วยบริบท 1M โทเค็น — การเรียกใช้บริบทขนาดใหญ่เพียงครั้งเดียวจะข้ามเส้นและเพิ่มอัตราค่าใช้จ่ายสำหรับคำขอทั้งหมดเป็นสองเท่า การอ่านแคชอยู่ที่ $1.00 ต่อล้าน ซึ่งเป็นส่วนลด 90% และการเขียนแคชอยู่ที่ $12.50 ต่อล้าน ที่ส่วนผสม 7:2:1 เดียวกัน อัตราผสมจะอยู่ที่ประมาณ $7.70 ต่อล้านโทเค็น และค่าใช้จ่ายต่องาน Index อยู่ที่ $3.26 เป็นอันดับที่ 71 จาก 200

Astra ไปคนละทางในเรื่องความยาวของคำตอบ และเป็นโมเดลที่กระชับกว่าในที่นี้: 60M โทเคนเอาต์พุตบน Index เทียบกับ 160M ของ Step 5 Preview อยู่อันดับ 27 จาก 200 ในด้านนั้น การมีโทเคนน้อยลงในอัตราที่สูงขึ้นช่วยลดช่องว่างลงในลักษณะที่ตัวคูณแบบดิบกล่าวเกินจริง แต่มันไม่ได้ปิดช่องว่างนั้น — ตัวเลขต้นทุนต่องานได้หักลบความยาวของคำตอบ พฤติกรรมแคช และราคาออกมาด้วยกันแล้ว และ $3.26 เทียบกับ $0.71 ก็ยังเป็นความต่าง 4.6 เท่า

เก้าคะแนนดัชนีซื้ออะไรได้บ้าง

ตัวเลขเด่นของ Astra เป็นของ OpenAI เองและยังไม่มีการทำซ้ำ: 96.1 ใน GPQA Diamond, 72.6% ใน OSWorld 2.0, 97.6% ใน FrontierMath Tier 4, 57.2% ใน Humanity's Last Exam เมื่อใช้เครื่องมือ และประมาณ 57.9% ใน Terminal-Bench 4.0 ตัวเลข ARC-AGI-3 เป็นตัวที่ต้องจัดการอย่างระมัดระวัง — OpenAI รายงาน 99.9% ภายใต้ฮาร์เนสแบบ provider-adapter ของตัวเอง และ 62.7% บนฮาร์เนสมาตรฐาน และความต่าง 37 จุดระหว่างฮาร์เนสเป็นการบอกอะไรเกี่ยวกับฮาร์เนสอย่างน้อยไม่น้อยไปกว่าที่บอกเกี่ยวกับโมเดล

ตัวเลขที่เผยแพร่ของ Step 5 Preview อยู่ในช่วงเดียวกันในงานเอเจนต์ที่มันถูกสร้างขึ้นมาเพื่อ และมีข้อแม้เดียวกัน: 33.3% บน Terminal-Bench 4.0, 80.5 บน ProgramBench, 67.7 บน DeepSWE v1.1 และ 49.0 บน StepCodeBench ทั้งหมดมาจาก StepFun และไม่มีผลใดถูกทำซ้ำโดยอิสระ ต่างค่าย ต่างฮาร์เนส ไม่มีการรันร่วมกัน — ซึ่งนั่นคือเหตุผลที่ช่องว่าง 9 คะแนนที่วัดโดยอิสระจึงเป็นตัวเลขที่มีประโยชน์มากกว่าตัวเลขใด ๆ เหล่านี้

ช่องว่างนั้นมีจริงและไม่ใช่เล็ก ๆ บนบอร์ดที่มี 200 โมเดล 53 และ 44 อยู่ในอันดับที่สามและอันดับที่ยี่สิบสี่ และความแตกต่างนั้นปรากฏออกมาเป็นงานคนละประเภท มากกว่าจะเป็นคะแนนที่ต่างกันในงานเดียวกัน: ชัยชนะที่ Astra เผยแพร่กระจุกตัวอยู่ที่การให้เหตุผลระยะยาวและการใช้คอมพิวเตอร์ ซึ่งเป็นจุดที่อันดับต้น ๆ ของบอร์ดฉีกตัวออกไป หากภาระงานของคุณอยู่ตรงนั้น เก้าคะแนนนั้นมีค่ามากกว่าใบแจ้งหนี้

ข้อควรระวังหนึ่งประการเกี่ยวกับคะแนนของ Astra Artificial Analysis ปรับปรุง Intelligence Index และตัวเลขของโมเดลเดียวกันอาจคลาดเคลื่อนไปตามสแนปช็อตที่จัดทำห่างกันหลายสัปดาห์ — 52.8, 53 และ 54.7 ปรากฏทั้งหมดในเนื้อหาที่เผยแพร่เกี่ยวกับโมเดลนี้ภายในเดือนเดียวกัน ตัวเลข 53 บนหน้าของโมเดลปัจจุบันคือตัวเลขที่ควรใช้ และการเปรียบเทียบใด ๆ ที่นำสแนปช็อต Astra เวอร์ชันเก่ามาวางข้างตัวเลข Step 5 Preview ปัจจุบัน ก็เท่ากับวัดด้วยไม้บรรทัดคนละอัน

Screenshot of the Artificial Analysis model page for GPT-6 Astra, showing OpenAI as the creator with a September 2026 release date, an Intelligence Index of 53 at rank 3 of 200, output speed 59.3 tokens per second at rank 101 of 200, cost per Intelligence Index task $3.26 at rank 71 of 200, verbosity 60M output tokens at rank 27 of 200, pricing of $10.00 per million input tokens and $50.00 per million output tokens with a 90% cache discount, and technical specifications listing reasoning, text and image input, a 1M-token context window and an April 30, 2026 knowledge cutoff.

ความเร็วและความหน่วงเป็นสองคำถามที่แตกต่างกัน

ในด้านความเร็วในการสร้าง บอร์ดจัดอันดับอิสระชัดเจนมาก: 99.8 โทเคนเอาต์พุตต่อวินาทีสำหรับ Step 5 Preview เทียบกับ 59.3 สำหรับ GPT-6 Astra ซึ่งยังช้ากว่าค่าเฉลี่ย 70 โทเคนต่อวินาทีของโมเดลที่วัดด้วย ในลูปการเขียนโค้ดแบบโต้ตอบ นั่นคือความแตกต่างระหว่างคำแนะนำกับการหยุดรอ และมันทบต้นสะสมตลอดเซสชันเหมือนกับส่วนลดแคช

ความหน่วงเป็นเรื่องที่ซับซ้อนกว่า และตัวเลขเพียงตัวเดียวทำให้เข้าใจผิดในเรื่องนี้ Astra จะจัดเส้นทางการให้เหตุผลก่อนที่จะส่งออก ดังนั้นเวลาถึงโทเคนแรกกับเวลาถึงคำตอบที่ใช้งานได้จึงไม่ใช่การวัดเดียวกัน และตัวเลขที่เผยแพร่สำหรับเรื่องนี้ก็กระจายกว้างมาก ขึ้นอยู่กับว่านับการให้เหตุผลด้วยหรือไม่ จากทราฟฟิกของเราเองในช่วงเจ็ดวันที่ผ่านมา ค่ามัธยฐานเวลาถึงโทเคนแรกของ GPT-6 Astra อยู่ที่ 6.72 วินาที โดยเปอร์เซ็นไทล์ที่ 95 อยู่ที่ 10.00 วินาที — เป็นตัวเลขที่ผู้เรียกใช้ประสบจริงผ่านเอนด์พอยต์ของเรา Artificial Analysis ระบุว่าเวลาถึงโทเคนแรกของ Step 5 Preview อยู่ที่ 2.96 วินาทีบนชุดทดสอบของตนเอง และตัวเลขสองตัวนี้ไม่ได้วัดด้วยวิธีเดียวกัน จึงไม่ควรนำมาลบกัน

จุดที่ความไม่สมมาตรของแคชส่งผลจริง

ทั้งสองโมเดลให้ส่วนลดกับพรีฟิกซ์ที่ซ้ำกันอย่างมาก และทั้งคู่คิดค่าบริการสำหรับการเขียนพรีฟิกซ์เหล่านั้น โดยความแตกต่างระหว่างทั้งสองอยู่ที่ 20 เท่าในการอ่าน ส่วนลดแคช 95% ของ Step 5 Preview ทำให้อินพุตที่แคชไว้อยู่ที่ประมาณ $0.05 ต่อล้านโทเคน GPT-6 Astra อ่านแคชที่ $1.00 ต่อล้าน — ส่วนลด 90% จากอัตราพื้นฐานที่สูงกว่า 10 เท่า — และเขียนที่ $12.50 ต่อล้าน

สำหรับลูปของเอเจนต์ที่ส่งพรอมต์ระบบและบริบทของที่เก็บโค้ดเดิมซ้ำในทุกเทิร์น อัตราการอ่านคือสิ่งที่ทบต้น และส่วนลดที่ลึกกว่าของโมเดลที่ถูกกว่าก็มีค่ามากกว่าส่วนลดที่ตื้นกว่าของโมเดลที่แพงกว่า ส่วนผสมของ Astra ยังคงอยู่ที่ประมาณ $7.70 ต่อล้านโทเคน เทียบกับ $0.51 ของ Step 5 Preview ที่ส่วนผสม 7:2:1 เดียวกัน — ความแตกต่าง 15 เท่าที่เซสชันยาวไม่ทำให้ช่องว่างแคบลง แต่กลับกว้างขึ้น

รันทั้งสองจากคีย์เดียว

GPT-6 Astra เปิดใช้งานแล้วบน OrcaRouter ภายใต้ openai/gpt-6-astra ในอัตราตามที่ OpenAI ประกาศไว้ — 10.00 และ 50.00 ดอลลาร์ต่อล้านโทเคนสำหรับปริมาณที่ต่ำกว่าเกณฑ์ 272K และ 20.00 และ 75.00 ดอลลาร์สำหรับปริมาณที่เกินเกณฑ์ — ส่งผ่านโดยไม่บวกเพิ่มแม้แต่บาทเดียว ดังนั้นหากผู้ให้บริการปรับราคา ฝั่งเราจะอัปเดตให้ทันทีในวันเดียวกัน แทนที่จะรอถึงรอบบิลถัดไป ข้อมูลเทเลเมตรีเจ็ดวันของเราเองบนเอนด์พอยต์ดังกล่าวแสดงค่ามัธยฐานที่ 6.72 วินาที และเปอร์เซ็นไทล์ที่ 95 ที่ 10.00 วินาทีสำหรับเวลาถึงโทเคนแรกตามที่กล่าวข้างต้น พร้อมด้วยปริมาณทราฟฟิก 277.9 ล้านโทเคนที่ไหลผ่านเอนด์พอยต์นี้ในสัปดาห์ที่ผ่านมา

Step 5 Preview ไม่ได้อยู่ในแค็ตตาล็อกของเรา และเราไม่ได้จัดเส้นทางให้มัน มันทำงานบน API และ Studio ของ StepFun เอง และนั่นคือที่เดียวที่มันทำงานได้จนกว่าเช็กพอยต์วันที่ 15 ตุลาคมจะมาถึง ความไม่สมมาตรนั้นไม่ใช่ข้อบกพร่องของการเปรียบเทียบ แต่คือตัวการเปรียบเทียบเอง ครึ่งที่ถูกของคู่นี้คือครึ่งที่คุณต้องไปเรียกจากที่อื่น และครึ่งที่คุณนำเข้าสู่โปรดักชันได้วันนี้ตั้งอยู่หลัง API เดียวสำหรับโมเดลมากกว่า 200 ตัว: GPT-6 Astra ในอัตราข้างต้น, GLM-5.3 ที่ $1.26 และ $3.96, DeepSeek V4 Pro, Claude Opus 5 และอื่น ๆ พร้อมการสลับสำรองอัตโนมัติข้ามผู้ให้บริการที่ช่วยตรึงเส้นทางให้มั่นคงเมื่อความจุของผู้ให้บริการเปลี่ยนแปลง และ routing DSL ที่ทำให้งานเริ่มต้นแบบประหยัดแล้วค่อยยกระดับเมื่อจำเป็นเท่านั้น กฎการยกระดับนั้นคือคำตอบที่แท้จริงสำหรับช่องว่างราคาสิบเท่า: งานส่วนใหญ่ไม่จำเป็นต้องใช้รุ่นท็อปสุดของกระดาน และเลเยอร์การจัดเส้นทางคือวิธีที่คุณหยุดจ่ายสำหรับส่วนที่ไม่จำเป็น

Screenshot of the OrcaRouter model page for GPT-6 Astra at www.orcarouter.ai/models/openai/gpt-6-astra, showing the model id openai/gpt-6-astra with NEW, FLAGSHIP and FEATURED badges, a 1M-token context and 128K max output, text, image and file input with text output, best-for tags for reasoning, coding and agentic work, input pricing of $10.00 and output pricing of $50.00 per million tokens, a seven-day median time to first token of 6.72 seconds and a 95th percentile of 10.00 seconds, 277.9M tokens of seven-day traffic, and the chat-completions and responses endpoints behind the OrcaRouter API.

ใครควรเลือกอันไหน

ถ้าภาระงานของคุณคือเอเจนต์ระยะยาวที่ต้องทำงานยากให้สำเร็จอย่างถูกต้อง — การใช้คอมพิวเตอร์ การวิจัยหลายขั้นตอน งานที่คำตอบผิดมีต้นทุนสูงกว่าค่าโทเคน — การนำอยู่เก้าคะแนนของ GPT-6 Astra คือส่วนที่ถูกที่สุดของการตัดสินใจ และใบแจ้งหนี้คือราคาที่ต้องจ่ายสำหรับความสามารถนั้น ใช้มันเป็นเป้าหมายสำหรับการยกระดับ ไม่ใช่ค่าเริ่มต้น และระวังเกณฑ์ 272K: คำขอที่ใหญ่เกินไปเพียงครั้งเดียวจะทำให้อัตราสำหรับทุกอย่างในคำขอนั้นเพิ่มเป็นสองเท่า

ถ้าภาระงานของคุณเป็นข้อความแบบเอเจนต์ปริมาณสูง — การสร้างโค้ด, การรีแฟกเตอร์, การสกัดข้อมูลแบบมีโครงสร้าง, ลูปภายในของผู้ช่วยเขียนโค้ด — Step 5 Preview นำหน้าในทุกสิ่งที่ใบแจ้งหนี้และนาฬิกาใส่ใจ และเก้าคะแนนดัชนีไม่น่าจะอยู่รอดเมื่อเจอการกระจายงานที่ไม่ได้อยู่บนสุดของตารางอันดับ จุดที่ต้องระวังไม่ได้อยู่ที่ประสิทธิภาพ: โมเดลนี้เป็นกรรมสิทธิ์ โดยไม่มีสัญญาอนุญาตที่เผยแพร่ ไม่มีการอนุญาตให้ใช้เชิงพาณิชย์ และไม่มีเช็คพอยต์จนถึงวันที่ 15 ตุลาคม คุณสามารถเรียกใช้มันได้ แต่คุณไม่สามารถเป็นเจ้าของมัน ปรับแต่งละเอียด หรือส่งมอบสิ่งที่ต่อยอดจากมันได้

หากคำตอบยังไม่ชัดเจน แนวทางที่เหมาะสมคือการแยกตามระดับมากกว่าการเลือกอย่างใดอย่างหนึ่ง จงกำหนดเส้นทางทราฟฟิกทั่วไปไปยังโมเดลระดับกลาง และสงวน Astra ไว้สำหรับคำขอที่ต้องการระดับสูงสุดของบอร์ด — ทั้งสองปลายของกฎนี้อยู่ภายใต้คีย์เดียวจากฝั่งเรา ดังนั้นการแยกนี้จึงมีต้นทุนเป็นกฎการกำหนดเส้นทางหนึ่งข้อ ไม่ใช่สัญญาฉบับที่สอง การจ่ายในอัตราระดับเรือธงให้กับงานที่โมเดลระดับกลางทำเสร็จได้อย่างถูกต้อง คือความผิดพลาดที่การเปรียบเทียบนี้มุ่งพูดถึงจริง ๆ

© 2026 OrcaRouter

สำหรับผู้ให้บริการ

ให้บริการแพลตฟอร์มการอนุมานอยู่หรือไม่ นำโมเดลของคุณขึ้น OrcaRouter

providers@orcarouter.ai

เข้าร่วมคอมมูนิตี้ของเรา

Discordsupport@orcarouter.aiXGitHubYouTube