การ์ดชื่อเรื่องที่สร้างขึ้นมีชื่อว่า 'Step 5 Preview — สิ่งที่ repo บอก' โดยแสดงหกแถว: พารามิเตอร์ทั้งหมด 600B, เปิดใช้งานต่อโทเค็น 27B, หน้าต่างบริบท 1M โทเค็น, อินพุตเป็นข้อความและรูปภาพ, AA Intelligence Index 44 และราคา $1.00 ขาเข้า / $2.70 ขาออก ส่วนท้ายระบุว่า 'StepFun ประกาศเมื่อวันที่ 20 กันยายน 2026; น้ำหนักโมเดลมีกำหนดออกวันที่ 15 ตุลาคม 2026 ตัวเลขดัชนีอ้างอิงจาก Artificial Analysis'
Engineering & Research

ประกาศเปิดตัว Step 5 Preview แล้ว: สิ่งที่เรือธง 600B ของ StepFun ส่งมอบจริง และสิ่งที่ยังขาดอยู่

ผู้เขียน

Gideon Frost

วันที่เผยแพร่

โมเดลล่าสุด · 20ดูโมเดลทั้งหมด
เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
กลับไปยังโพสต์ทั้งหมด

StepFun ประกาศเปิดตัว Step 5 Previewเมื่อวันที่ 20 กันยายน 2026 — โมเดลเรือธงแบบ sparse mixture-of-experts ขนาด 6 แสนล้านพารามิเตอร์ ที่มีพารามิเตอร์ทำงานจริง 27B ต่อโทเคน หน้าต่างบริบท 1M โทเคน รองรับอินพุตรูปภาพแบบเนทีฟ และได้คะแนน Artificial Analysis Intelligence Index 44 โดย API เปิดให้ใช้งานในวันเดียวกัน สิ่งที่ยังไม่เปิดคือตัวโมเดลเอง: รีโพซิทอรี Hugging Face stepfun-ai/Step-5-Preview-BF16มีอยู่แล้วในช่วงบ่ายของวันประกาศ และมีไฟล์อยู่เพียงไฟล์เดียวคือ .gitattributes โดยไม่มีไฟล์น้ำหนัก ไม่มีสัญญาอนุญาต ไม่มีการ์ดโมเดล และไม่มีการตั้งค่าใด ๆ เอกสารของ StepFun เองระบุว่า การเปิดน้ำหนักโมเดลจะเกิดขึ้นในวันที่ 15 ตุลาคม 2026 ดังนั้นสรุปหนึ่งบรรทัดที่ตรงไปตรงมาของการเปิดตัวครั้งนี้ก็คือ โมเดลนี้เรียกใช้งานได้วันนี้ และดาวน์โหลดได้ในอีกราวสามสัปดาห์ครึ่ง ซึ่งเป็นสองสิ่งที่แตกต่างกัน นี่ก็เป็นโมเดลเดียวกันกับที่บล็อกนี้ได้รายงานไปเมื่อช่วงเช้าของวันนี้ในฐานะข้อมูลรั่วไหลที่ยังไม่ได้ประกาศ โดยถูกวัดผลด้วย benchmark ภายใต้แท็กทดสอบก่อนที่ StepFun จะเผยแพร่หน้าสินค้า — เป็นเครื่องเตือนใจที่มีประโยชน์ว่า พรีวิวสามารถเปลี่ยนจากของรั่วไหลกลายเป็นการเปิดตัวได้โดยที่ตัวเลขไม่เปลี่ยนแปลงแม้แต่ตัวเดียว

repo นี้เป็นเพียงตัวยึดตำแหน่ง และนั่นคือเรื่องราวทั้งหมด

เมื่อผู้จัดจำหน่ายเผยแพร่ค่าน้ำหนัก รีโพซิทอรีคือหลักฐาน มันมีไฟล์ไลเซนส์ มีไฟล์คอนฟิกที่ระบุจำนวนพารามิเตอร์อยู่ข้างใน มี README ที่บอกการใช้งานตามจุดประสงค์และตารางการประเมิน และมีไฟล์ safetensors แบบแบ่งส่วน (shards) ซึ่งขนาดรวมจะบอกคุณได้ว่าจำนวนพารามิเตอร์ที่อ้างมานั้นเป็นของจริงหรือไม่ stepfun-ai/Step-5-Preview-BF16ไม่มีสิ่งเหล่านั้นเลย บันทึกใน Hugging Face API ของมันแสดงเวลาที่สร้างไว้ที่ 2026-09-20T03:52Z ยอดดาวน์โหลดเป็นศูนย์ ไลก์สองครั้ง อ็อบเจกต์คอนฟิกว่างเปล่า ไม่มี pipeline_tag ไม่มีไลเซนส์ และมีไฟล์ในกลุ่มเดียวกันเพียงไฟล์เดียว หน้ารวมขององค์กร StepFun แสดงรายการนี้ และไม่แสดงรีโพซิทอรี Step 5 อื่นใดเลย — ไม่มีบิลด์ FP8 ไม่มีบิลด์ NVFP4 ไม่มี GGUF ไม่มีตัวแปรแบบควอนไทซ์ใด ๆ ที่เคยมาพร้อมกับ Step-3.7-Flash ในเดือนมิถุนายน

อ่านสิ่งนั้นเป็นเรื่องกำหนดการ ไม่ใช่เรื่องลึกลับ คำต่อท้าย BF16 ในชื่อ repo คือสิ่งที่บอกใบ้ให้เห็น: แล็บที่ตั้งใจจะเผยแพร่ checkpoint แบบ bfloat16 ก่อน — รูปแบบที่คุณใช้ fine-tune และ quantise ต่อจากนั้น ก่อนที่บิลด์สำหรับ serving อย่าง FP8 และ NVFP4 จะมาถึง — จะตั้งชื่อ repository แบบนั้นตั้งแต่ตอนสร้าง แล้วค่อยเติมเนื้อหาในภายหลัง StepFun ระบุวันที่ 15 ตุลาคมในเอกสารประกาศของตัวเอง จนถึงตอนนั้น repository ก็เป็นเพียงการอ้างถึงความตั้งใจ และสิ่งเดียวที่มันพิสูจน์ได้คือ StepFun ได้จอง namespace ไว้แล้ว

เรื่องนี้สำคัญด้วยเหตุผลในทางปฏิบัติ คำว่า Preview ที่เป็นคำต่อท้ายและน้ำหนักที่หายไปคือสัญญาณเดียวกันที่ชี้ไปในทิศทางเดียวกัน: โมเดลนี้เรียกใช้งานได้ ราคาถูกกำหนดไว้แล้ว และอาร์ติแฟกต์ที่คุณจะรันบนฮาร์ดแวร์ของคุณเองยังไม่มีอยู่ แผนใดก็ตามที่ตั้งสมมติฐานว่ามี Step 5 Preview แบบโฮสต์เองก่อนกลางเดือนตุลาคม ถือเป็นแผนที่ไม่มีอาร์ติแฟกต์รองรับอยู่เบื้องหลัง

อะไรคือสิ่งที่ถูกประกาศออกมาจริงๆ

การวางกรอบของ StepFun นั้นแคบและเจาะจง: Step 5 Preview เป็นโมเดลฐานสำหรับงานเอเจนต์ในโลกจริง — การเขียนโค้ดด้วย AI, วิศวกรรมซอฟต์แวร์, งานความรู้ระดับวิชาชีพ และการเงิน — โดยเน้นที่บริบทยาว การเรียกใช้เครื่องมือแบบหลายรอบ และการทำงานอย่างต่อเนื่อง มากกว่าคุณภาพการสนทนา บริษัทข้ามไลน์ Step 4.x ไปทั้งหมด โดยก้าวจาก Step-3.7-Flash ตรงไปยัง Step 5 ซึ่งในตัวมันเองก็เป็นการประกาศว่าโมเดลนี้ถือเป็นก้าวที่ยิ่งใหญ่เพียงใด

รายละเอียดด้านวันที่หนึ่งน่าสังเกต เพราะเป็นเรื่องประเภทที่ทำให้ปฏิทินการจัดซื้อสะดุด: Artificial Analysis ระบุวันที่ของโมเดลนี้เป็นวันที่ 18 กันยายน 2026 ซึ่งเป็นสองวันก่อนการประกาศของ StepFun เอง บอร์ดจะให้คะแนนโมเดลเมื่อสามารถเข้าถึงโมเดลนั้นได้ และช่องว่างสองวันนั้นคือความล่าช้าปกติระหว่างโมเดลที่เริ่มเรียกใช้ได้กับการที่ผู้ขายเขียนถึงมัน การประกาศของ StepFun — วันที่ 20 กันยายน โดย API และ Studio เปิดในวันเดียวกัน — เป็นวันที่ควรอ้างอิง และวันที่ 15 ตุลาคมของ weights มาจากเอกสารเดียวกัน

ข้อกำหนดตามที่เผยแพร่:

• จำนวนพารามิเตอร์ทั้งหมด — 600B, โมเดลผสมผู้เชี่ยวชาญแบบสแปร์ส

• แอ็กทีฟต่อโทเคน — 27B คิดเป็นประมาณ 4.5% ของทั้งหมด ซึ่งเป็นอัตราส่วนที่เบาบางอย่างผิดปกติ

• หน้าต่างบริบท — 1M โทเค็น

• อินพุต — รองรับข้อความและรูปภาพโดยตรง; เอาต์พุตเป็นข้อความเท่านั้น

• การให้เหตุผล — ใช่ ด้วยการคิดแบบขยาย

• ราคา — $1.00 ต่อหนึ่งล้านโทเคนอินพุต, $2.70 ต่อหนึ่งล้านโทเคนเอาต์พุต พร้อมส่วนลดแคช 95%

• ความพร้อมใช้งาน — API และ Studio เปิดให้ใช้งานตั้งแต่ {{1}}20 กันยายน{{/1}}; เวทมีกำหนดการใน {{2}}15 ตุลาคม{{/2}}

คำกล่าวอ้างด้านประสิทธิภาพที่ StepFun นำเสนอเป็นหลักก็คือ การแบ่ง 600B/27B ทำให้โมเดลอยู่บน Pareto frontier — ความสามารถต่อหน่วยการประมวลผล — และบริษัทวางกรอบเรื่องนี้ว่าเป็นสามรุ่นของความพยายามเดียวกัน จาก Step-3.5-Flash ผ่าน Step-3.7-Flash มาจนถึงรุ่นนี้ มันเป็นเรื่องราวที่สอดคล้องกัน และอัตราส่วนแบบ sparse คือกลไก: เมื่อมี 27B ที่ใช้งานจริง ต้นทุนการให้บริการต่อโทเคนจะอยู่ในช่วงของโมเดลที่เล็กกว่ามาก ขณะที่ขนาดรวม 600B เป็นเรื่องของพื้นที่หน่วยความจำที่ใช้เป็นหลัก

คำกล่าวอ้างของผู้ขาย และตัวเลขจากบุคคลที่สามที่อยู่ข้าง ๆ คำกล่าวอ้างเหล่านั้น

ตัวเลขสองประเภทปรากฏในเอกสารเปิดตัว และไม่ควรตีความด้วยวิธีเดียวกัน การประเมินของ StepFun เองคือประเภทแรก: ข้ออ้างเรื่องต้นทุนต่อ task เดียวที่หนึ่งในแปดของ Claude Opus 5; อันดับสองรองจากทั้ง GPT-6 Astra หรือ Claude Opus 5 บน ALE-CLI, FrontierFinance และ DRACO; การรันปรับแต่ง GPU kernel เป็นเวลา 24 ชั่วโมงที่ยกระดับประสิทธิภาพสูงสุดของ MLA kernel ขึ้นเป็น 508 TFLOPS เทียบกับ 493 ของ Claude Opus 5; การทดลอง post-training อัตโนมัติที่ขยับ Qwen3-30B-A3B จาก 53.3% เป็น 60% บน AIME24; DeepSWE v1.1 ที่ 67.7% และ StepCodeBench ภายในของตัวเองที่ 49.0% StepFun สร้าง StepCodeBench ขึ้นเอง — คลังโค้ด 553 แห่ง งาน 9 ประเภท ภาษาโปรแกรม 33 ภาษา — ซึ่งทำให้มันเป็นเครื่องมือที่สมเหตุสมผลสำหรับการวัดโมเดลของตัวเอง และไม่ใช่เครื่องมือที่เป็นอิสระ

คลาสที่สองถูกวัดโดยคนอื่น และเป็นส่วนที่ต้องวางแผนรับมือ Artificial Analysis ให้คะแนน Step 5 Preview ที่ 44 บน Intelligence Index v4.3.2 โดยจัดอันดับที่ 24 จาก 200 โมเดล — อยู่ระดับเดียวกับ Kimi K3 ตามหลัง GLM-5.3 อยู่หนึ่งคะแนน และอยู่ระดับเดียวกับการตั้งค่า reasoning effort ระดับ medium ของ Claude Opus 5 บน Terminal-Bench 4.0 บอร์ดเดียวกันบันทึกไว้ที่ 33.3% นำหน้า DeepSeek V4.1 Flash ที่ 26.8% และนำหน้า Kimi K3 อย่างมากที่ประมาณ 12.6% ความเร็วในการส่งออกวัดได้ 99.8 โทเคนต่อวินาที และเวลาถึงโทเคนแรก 2.96 วินาที — ทั้งคู่มาจากการรันอิสระครั้งเดียวกัน และทั้งคู่เป็นตัวเลขประเภทที่ตัดสินว่าลูปของเอเจนต์ให้ความรู้สึกโต้ตอบได้หรือไม่

ตัวเลขจากบุคคลที่สามตัวหนึ่งชี้ไปในทางตรงกันข้าม และสมควรได้อยู่ข้าง ๆ ราคา การรันดัชนีครั้งเดียวกันใช้โทเคนเอาต์พุต 160M สำหรับ Step 5 Preview เทียบกับค่ามัธยฐานที่ 92M ในบรรดาโมเดลที่ถูกให้คะแนน — โมเดลนี้ช่างพูด ที่ $2.70 ต่อโทเคนเอาต์พุตหนึ่งล้านตัว ความช่างพูดนั้นไม่ได้มาฟรี: โทเคนเอาต์พุต 160M คิดเป็นประมาณ $432 จาก $922.84 ซึ่งเป็นค่าใช้จ่ายทั้งหมดของการรัน และบนโมเดลที่คิดราคาสูงกว่าสามเท่า มันจะเป็นรายการที่ครองใบแจ้งหนี้ ราคาที่ประกาศต่ำกับจำนวนโทเคนต่องานที่สูงเป็นสองครึ่งของตัวเลขเดียวกัน และค่าใช้จ่ายต่องานดัชนี — $0.71 — คือตัวเลขที่มีทั้งสองอย่างอยู่ในตัวแล้ว

Screenshot of the Artificial Analysis model page for Step 5 Preview, showing StepFun as the creator and a September 2026 release date, an Intelligence Index of 44 at rank 24 of 200, output speed 99.8 tokens per second at rank 45 of 200, cost per Intelligence Index task $0.71 at rank 27 of 200, verbosity 160M output tokens at rank 64 of 200, pricing of $1.00 per million input tokens and $2.70 per million output tokens with a 95% cache discount, and technical specifications listing reasoning, text and image input, and a 1M-token context window.

สิ่งที่ข้อมูลรั่วไหลคาดการณ์ถูก และอีกหนึ่งเรื่องที่ยังไม่ได้ข้อยุติ

บทความก่อนหน้านี้ของบล็อกนี้เขียนขึ้นจากการรันประเมินที่เปิดเผยออกมาก่อนการประกาศใด ๆ และได้ทำเครื่องหมายข้อกล่าวอ้างที่ยืนยันไม่ได้ไว้ การประกาศได้คลี่คลายข้อกล่าวอ้างส่วนใหญ่เหล่านั้น คู่ 600B/27B ตอนนี้เป็นข้อมูลที่ผู้ขายระบุเอง ไม่ใช่การอนุมาน หน้าต่างบริบทขนาด 1M โทเคน ตอนนี้อยู่ในสเปกของ StepFun เอง ไม่ใช่แค่บนเว็บบอร์ดของบุคคลที่สาม ราคา $1.00 และ $2.70 คือราคาที่แน่นอนแล้ว ชื่อคือ Step 5 Preview ไม่ใช่ชื่อทางเลือกตามข่าวลือ

สิ่งที่ประกาศไม่ได้ทำคือการคลี่คลายความขัดแย้งเรื่องหน้าต่างบริบทที่การรายงานข่าวหลุดยกขึ้นมา ชุดการกำหนดค่าของบุคคลที่สามอีกชุดหนึ่งซึ่งแพร่กระจายอยู่ในเครื่องมือสำหรับนักพัฒนา ระบุว่าโมเดลนี้มีบริบท 350,000 โทเคน โดยมีเอาต์พุตสูงสุด 64,000 โทเคน หน้าต่าง 1M กับหน้าต่าง 350k เป็นผลิตภัณฑ์ที่ต่างกันซึ่งมีต้นทุนหน่วยความจำต่างกัน และเพดานเอาต์พุต 64k ถือเป็นข้อจำกัดตายตัวต่อ Exactly งานแบบเอเจนต์ระยะยาวที่โมเดลนี้ถูกขายเพื่อรองรับโดยตรง ประกาศของ StepFun ระบุว่า 1M และไม่ได้กล่าวถึงเพดานเอาต์พุต การรู้ว่าการจัดเส้นทางของคุณจะไปลงเอยที่แบบไหนเป็นเรื่องที่ควรค่า ก่อนที่คุณจะสร้างไปป์ไลน์ที่ขึ้นอยู่กับคำตอบ และนั่นเป็นคำถามสำหรับเอกสารของผู้ขาย มากกว่าจะเป็นคำถามสำหรับลีดเดอร์บอร์ด

อีกสิ่งหนึ่งที่การเปิดตัวไม่ได้เปลี่ยนแปลงคือการทำซ้ำโดยอิสระ ทุกแถวการวัดประสิทธิภาพด้านบนที่ไม่ได้มาจาก Artificial Analysis เป็นของ StepFun เอง รันบนชุดทดสอบของ StepFun และยังไม่มีบุคคลที่สามรายใดได้ทำซ้ำผลลัพธ์เชิงเอเจนต์ รูปแบบจากเรือธงของแล็บจีนในปีนี้คือดัชนีรวมยังคงเชื่อถือได้ ขณะที่แถวพาดหัวของผู้ขายคลาดเคลื่อน ให้ใช้ค่าดัชนีรวมเป็นตัวเลขสำหรับการวางแผน

สิ่งที่คุณสามารถโทรได้วันนี้ และสิ่งที่ควรกำหนดเส้นทางในระหว่างนี้

Step 5 Preview ไม่ได้อยู่ในแค็ตตาล็อกของเรา และ OrcaRouter ก็ไม่ได้จัดเส้นทางให้มัน — ฝั่ง StepFun มี API สาธารณะและ Studio ซึ่งเป็นที่ที่มันทำงานอยู่ สิ่งที่เรามีคือชุดโมเดลที่มันถูกนำไปวัดเปรียบเทียบ ภายใต้คีย์เดียว: DeepSeek V4.1 Flash ราคา $0.15 ขาเข้า และ $0.60 ขาออก ต่อล้าน, GLM-5.3 ที่ $1.26 และ $3.96 เทียบกับ $1.40 และ $4.40 ที่ Z.ai ระบุไว้, Claude Opus 5 ที่ $5.00 และ $25.00 และ Kimi K3 อยู่เคียงข้างกัน นั่นคือรูปร่างในทางปฏิบัติของสามสัปดาห์ข้างหน้า: พรีวิวที่คุณนำไปวัดเปรียบเทียบได้ และชุดโมเดลสำหรับโปรดักชันที่คุณพึ่งพาได้จริง, เข้าถึงได้ผ่าน API เดียวสำหรับโมเดลกว่า 200 รายการ โดยราคาตามที่ผู้ให้บริการระบุไว้ถูกส่งผ่านไปโดยบวกเพิ่ม 0% — ดังนั้นหากราคาของ StepFun เปลี่ยนแปลงก่อนเดือนตุลาคม ตัวเลขที่คุณต้องจ่ายก็จะเปลี่ยนตามในวันเดียวกัน ไม่ใช่ตอนต่ออายุ

การสลับไปใช้ระบบสำรองอัตโนมัติ (automatic failover) มีค่ามากกว่าปกติในช่วงเวลานี้ เพราะรูปแบบความล้มเหลวของ preview ไม่ใช่ว่ามันแย่ — แต่ว่ามันถูกจำกัดเรื่องขีดความสามารถ โมเดลที่เปิด API ในวันประกาศและยังไม่มี weights ก็คือโมเดลที่ฝูงเซิร์ฟเวอร์ให้บริการยังอยู่ระหว่างการสร้าง และ endpoint ของ preview ที่ประสิทธิภาพตกตอนตี 2 ก็จะลาก agent loop ของคุณไปด้วยกัน จงวาง preview ไว้หลัง router ที่มีโมเดลที่ผ่านการพิสูจน์แล้วเป็น fallback แล้วคุณจะได้สัญญาณด้านคุณภาพบน workload ของคุณเอง โดยไม่ต้องเดิมพันเส้นทาง production กับฝูงเซิร์ฟเวอร์ที่ยังไม่ผ่านการพิสูจน์

Screenshot of the Hugging Face repository page for stepfun-ai/Step-5-Preview-BF16, showing the repository created on September 20, 2026 with one contributor, a single initial commit and a single file listed, .gitattributes at 1.52 kB, with no model card, no license and no configuration.

วันที่สำคัญคือวันที่ 15 ตุลาคม

ทุกอย่างข้างต้นเป็นเพียงข้อสันนิษฐานชั่วคราวในแง่หนึ่งที่เจาะจง นั่นคือ ค่าน้ำหนักคือสิ่งทำให้โมเดลคงอยู่ถาวร พรีวิวแบบปิดในราคา $1.00 และ $2.70 เป็นราคาที่ดีจากผู้ให้บริการรายเดียว และเช็กพอยต์ BF16 ภายใต้สัญญาอนุญาตที่เผยแพร่แล้วเป็นราคาที่ไม่มีผู้ให้บริการรายใดควบคุมได้อีกต่อไป StepFun ได้ประกาศมุ่งมั่นกับทางเลือกที่สองสำหรับวันที่ 15 ตุลาคม และชื่อรีโพซิทอรีที่บริษัทจองไว้แล้วก็ระบุว่า bfloat16 มาเป็นอันดับแรก

สิ่งที่ต้องจับตาดูระหว่างนี้ไปจนถึงตอนนั้นมีขอบเขตแคบและตรวจสอบได้ คลังเก็บโค้ดจะถูกเติมเต็มหรือไม่ — และด้วยสัญญาอนุญาตใด ไฟล์คอนฟิกยืนยันขนาดรวม 600B และขนาดแอกทีฟ 27B หรือไม่ StepFun เผยแพร่เพดานเอาต์พุตควบคู่กับหน้าต่างบริบทหรือไม่ ซึ่งจะคลี่คลายคำถามเรื่อง 350k/64k ได้หรือเปล่า ราคาจะยังคงเดิมไหมเมื่อพรีวิวหมดส่วนต่อท้ายนั้น สี่คำตอบนี้เป็นตัวตัดสินว่า Step 5 Preview จะกลายเป็นโมเดลที่คุณโฮสต์เอง เป็นโมเดลที่คุณเช่า หรือเป็นโมเดลที่คุณทดสอบวัดผลครั้งเดียวแล้วผ่านไป จนกว่าคลังเก็บโค้ดจะมีอะไรมากกว่าแค่ .gitattributesอยู่ในนั้น การประกาศนี้ก็เป็นจุดเริ่มต้นของเรื่องราวมากกว่าจะเป็นจุดจบของมัน

Generated two-column infographic titled 'Step 5 Preview — live today vs promised October 15'. The left card 'Callable now' lists rows: API and Studio open September 20, price $1.00 in / $2.70 out, AA Intelligence Index 44, 1M-token context, output speed 99.8 tokens/sec. The right card 'Promised October 15' lists rows: BF16 weights, licence terms, config with parameter counts, output ceiling. A footer reads 'The announcement covers the left card; the right card is unconfirmed until the repository is filled.'

การเปรียบเทียบในบทความนี้1

ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน

© 2026 OrcaRouter

สำหรับผู้ให้บริการ

ให้บริการแพลตฟอร์มการอนุมานอยู่หรือไม่ นำโมเดลของคุณขึ้น OrcaRouter

providers@orcarouter.ai

เข้าร่วมคอมมูนิตี้ของเรา

Discordsupport@orcarouter.aiXGitHubYouTube