การ์ด hero ที่สร้างขึ้นโดยมีหัวเรื่องว่า 'Space Bunny — หน้าอ้างอิง' พร้อมคำบรรยายใต้หัวเรื่องว่า 'โมเดลเดียว สองชื่อ: space-bunny และ space-bunny-alpha' การ์ดด้านซ้ายหัวข้อ Envelope แสดงรายการ Context: 1,000,000 โทเคน, เอาต์พุตสูงสุด: 524,288 โทเคน, อินพุต: ข้อความ, รูปภาพ, วิดีโอ การ์ดด้านขวาหัวข้อ Rate card มีแถวขนาดใหญ่ '$0 ขาเข้า / $0 ขาออก ต่อ 1M' พร้อมบรรทัด 'ผู้ให้บริการ: ไม่เปิดเผย เมตาดาต้าของรายการ ยังไม่ได้ตรวจสอบ' แถบล่างสุดอ่านว่า 'โมเดลเดียวกัน — ชื่อเปล่า ๆ คือรูปแบบย่อ' โลโก้ OrcaRouter อยู่มุมขวาล่าง
Guides & Insights

Space Bunny: หน้าอ้างอิงสำหรับ Stealth Model ซึ่งถูกระบุอีกชื่อว่า Space Bunny Alpha

ผู้เขียน

Elias Hawthorne

วันที่เผยแพร่

โมเดลล่าสุด · 20ดูโมเดลทั้งหมด →
เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
กลับไปยังโพสต์ทั้งหมด

Space Bunny กับ Space Bunny Alpha เป็นโมเดลเดียวกัน เคลียร์เรื่องนี้ก่อน เพราะชื่อทั้งสองดึงไปคนละทาง ชื่อเปล่า ๆ คือสิ่งที่คนส่วนใหญ่พิมพ์ค้นหา และชื่อที่มีเวอร์ชันกำกับคือสิ่งที่ทุกรายการและทุกบทความใช้ ไม่มี Space Bunny ตัวที่สอง — ไม่มีรุ่นน้องที่เล็กกว่า ไม่มีรุ่นก่อนหน้าที่ Alpha เข้ามาแทนที่ ชื่อเปล่า ๆ คือรูปย่อAlphaคือเครื่องหมายระยะพรีวิวที่กลุ่มรายการนิรนามกลุ่มนี้ใช้อยู่ ตราบใดที่ผู้ดำเนินการยังไม่ถูกเปิดเผยชื่อ Space Bunny เป็นพรีวิวแบบล่องหนที่ให้บริการบนแพลตฟอร์มของบุคคลที่สาม: คอนเท็กซ์หนึ่งล้านโทเคน เพดานเอาต์พุต 524,288 โทเคน รับข้อมูลเข้าเป็นข้อความ รูปภาพ และวิดีโอ และราคาที่ระบุไว้คือศูนย์ดอลลาร์ต่อล้านโทเคน โดยไม่เปิดเผยตัวตนของผู้ให้บริการ หน้านี้คือเอกสารอ้างอิงสำหรับมัน — ปลายทางสำหรับคนที่ค้นหาชื่อของโมเดลนี้เอง ไม่ใช่ประกาศครั้งที่สองว่ามันมีอยู่

สองสิ่งเกี่ยวกับวิธีอ่านสิ่งที่ตามมา ทุกอย่างภายใต้หัวข้อ Envelope คือข้อมูลเมทาดาทาของประกาศที่ผู้ให้บริการป้อนเข้ามา: ตัวเลขของผู้ให้บริการนิรนามเอง ซึ่งเผยแพร่บนแพลตฟอร์มที่โฮสต์ตัวอย่างนี้ และถูกอ่านซ้ำอีกครั้งในวันนี้ วันที่ 28 กันยายน 2026 ไม่มีส่วนใดได้รับการตรวจสอบอย่างอิสระ และขอย้ำอีกครั้งตรงจุดที่ตัวเลขปรากฏ ส่วน benchmark แยกออกมาต่างหาก และมีแหล่งที่มาจากบุคคลที่สามตลอดทั้งส่วน ข้อสังเกตอีกประการคือเหตุผลที่หน้านี้มีอยู่ตั้งแต่แรก ประกาศนี้ลงวันที่ 23 กันยายน 2026 ห้าวันก่อน จึงไม่มีปัญหาความเก่าให้ต้องถกกันอ้อม — แต่ข้อรับรองตรงนี้ไม่ใช่วันที่นั้น หากเป็นอุปสงค์การค้นหาจากฝ่ายเราเองที่เราวัดเอง: 1,668 ครั้งที่แสดงผล และ 238 คลิก สำหรับคำค้น "space bunny" ในช่วง 28 วันจนถึงวันที่ 25 กันยายน อยู่ในตำแหน่งที่ 4.8 นั่นเป็นข้อเท็จจริงเกี่ยวกับสิ่งที่ผู้คนพิมพ์ ไม่ใช่เกี่ยวกับโมเดล ผู้อ่านคลิกผ่านเข้ามายังหน้าใดก็ตามที่เราได้อันดับอยู่แล้ว; เพียงแต่ไม่มีหน้าเกี่ยวกับตัวโมเดลเองให้พวกเขาคลิกเข้ามาเจอ การเติมเต็มช่องว่างนั้นคือข้อกำหนดที่บทความนี้ยืนอยู่ — อุปสงค์ที่มีอยู่ต่อเนื่องซึ่งวัดเมื่อวันที่ 28 กันยายน 2026 โดยวันที่ประกาศถูกใช้เพื่อระบุอายุของโมเดล มากกว่าจะเป็นเหตุการณ์ที่จะรายงาน

ชื่อที่กำหนดไว้อย่างเหมาะสม

หลักฐานสำหรับ “โมเดลเดียวกัน” คือการไม่มีอยู่ จึงควรระบุให้ชัดเจนว่าได้ตรวจสอบอะไรไปบ้าง แพลตฟอร์มที่โฮสต์ตัวอย่างนี้แสดงรายการสำหรับตระกูลนี้เพียงรายการเดียว ภายใต้ตัวระบุ stealth/space-bunny-alpha/ และชื่อที่แสดงคือ “Space Bunny Alpha”; ไม่มีแบบเปล่า ๆ ของ space-bunny/ เป็นรายการอยู่ข้าง ๆ คู่มือของโมเดลนี้เอง — เว็บไซต์ของบุคคลที่สามซึ่งระบุอย่างชัดเจนว่าไม่มีส่วนเกี่ยวข้องกับแพลตฟอร์มหรือผู้พัฒนา — แนะนำโมเดลนี้ว่า “Space Bunny Alpha หรือเขียนอีกแบบว่า space-bunny-alpha” และระบุวันที่ลงรายการเป็น 23 กันยายน 2026 องค์กร Hugging Face ซึ่งโฮสต์ที่เก็บโค้ดประกอบสำหรับซีรีส์นี้ มีที่เก็บโค้ดของ bunny หนึ่งแห่ง ซึ่งตั้งชื่อตาม alpha การค้นหา “Space Bunny” แบบเปล่า ๆ ในฐานะโมเดลแยกต่างหากให้ผลลัพธ์เพียงโมเดลเดิมภายใต้ชื่อที่สั้นกว่าเท่านั้น

ในทางปฏิบัติ: ให้ถือว่าทั้งสองสตริงเป็นนามแฝงของกันและกัน "Space Bunny" เป็นคำหลักและเป็นคำที่มีพฤติกรรมการคลิกที่ดีกว่า; space-bunny-alpha/ คือตัวระบุที่คุณใส่ในคำขอ สิ่งเดียวที่ชื่อล้วน ๆ ไม่ได้บอกเป็นนัยก็คือเวอร์ชัน — ไม่มี 1.0 ที่มีเอกสารกำกับ ไม่มีรุ่นย่อยที่เล็กกว่า ไม่มีรุ่นที่ไม่ใช่พรีวิว รายการหรือโพสต์ที่บอกเป็นนัยเป็นอย่างอื่นกำลังกุตระกูลที่บันทึกไม่ได้แสดงไว้

คำต่อท้ายนี้ให้ข้อมูลจริง ๆ: โมเดลอยู่ในช่วงพรีวิว ดำเนินการโดยผู้ให้บริการที่เลือกจะไม่เปิดเผยชื่อระหว่างช่วงนั้น และประกาศแจ้งเตือนแบบสเตลธ์ของแพลตฟอร์มระบุว่า พรอมต์และผลลัพธ์อาจถูกเก็บรักษาไว้โดยผู้ให้บริการรายนั้น แต่จะไม่ถูกนำไปใช้ในการฝึก โปรดอ่านข้อความนั้นอย่างละเอียด เพราะมันเป็นคำแถลงเรื่องการเก็บรักษาข้อมูล ไม่ใช่คำแถลงว่าไม่เก็บข้อมูลเลย หากคุณได้อ่านบทความรายงานก่อนเปิดตัวของเราเกี่ยวกับรายการนี้ — หน้าเปิดเผยข้อมูล Space Bunny Alpha — ภารกิจของหน้านั้นได้บรรลุแล้ว: สิ่งที่มันคาดการณ์ไว้ตอนนี้ก็เป็นเพียงสถานะของโมเดล และคำถามที่ยังต้องติดตามได้ย้ายจากตัวตนไปสู่ขอบเขต ต้นทุน และปริมาณงาน

ซองจดหมาย ตามที่ประกาศระบุไว้

อ่านซ้ำอีกครั้งวันนี้บนประกาศที่เผยแพร่อยู่ ผู้ปฏิบัติงานเป็นผู้ให้ข้อมูล ยังไม่ได้ทำซ้ำ

• หน้าต่างบริบท — 1,000,000 โทเค็น ระดับ 1M เดียวกันกับพรีวิวแบบไม่ระบุชื่อก่อนหน้านี้ในซีรีส์นี้

• เอาต์พุตสูงสุด — 524,288 โทเคน ครึ่งหนึ่งของหน้าต่างบริบท ซึ่งเป็นเพดานที่สูงมากไม่ว่าจะจ่ายในราคาใด และเป็นเพดานที่ไม่มีบุคคลที่สามรายใดเคยทดสอบภายใต้สภาวะกดดันเพื่อดูความสอดคล้องที่ปลายสุด

• อินพุตและเอาต์พุต — รับข้อความ รูปภาพ และวิดีโอเป็นอินพุต; ส่งออกเป็นข้อความ วิดีโออินพุตคือรายละเอียดที่ทำให้รายการแบบไม่ระบุชื่อรุ่นนี้แตกต่างจากการเปิดตัวแบบมัลติโมดัลทั่วไปมากที่สุด

• การให้เหตุผล — เป็นข้อบังคับและไม่สามารถปิดได้ โดยมีระดับความพยายาม 5 ระดับ ได้แก่ ต่ำ ปานกลาง สูง สูงมาก และสูงสุด รายการที่แสดงอยู่จริงในวันนี้ระบุว่าค่าเริ่มต้นของผู้ให้บริการคือสูงสุด และคู่มือภาคสนามของบุคคลที่สามก็บันทึกค่าเริ่มต้นเดียวกันนี้ไว้โดยอิสระเช่นกัน การซ่อนข้อความการให้เหตุผลผ่าน API ไม่ได้ปิดการประมวลผล แต่ยังคงใช้งบประมาณเอาต์พุตอยู่

• การใช้เครื่องมือและการส่งออกแบบมีโครงสร้าง — tools/ และ tool_choice/ ได้รับการยอมรับ ดังนั้นจึงสามารถเรียกใช้ฟังก์ชันได้ response_format/ ให้เอาต์พุต JSON โดยไม่มีการบังคับใช้ JSON-schema ซึ่งเป็นข้อจำกัดเดียวกันที่กลุ่มตัวอย่างพรีวิวนี้มีมาตลอด หากไปป์ไลน์ของคุณต้องการออบเจ็กต์ที่ผ่านการตรวจสอบกลับมา คุณต้องตรวจสอบด้วยตนเอง

• ไม่เปิดเผย — ชื่อผู้ให้บริการ จำนวนพารามิเตอร์ พารามิเตอร์ที่ใช้งาน สถาปัตยกรรม ตระกูลโทเคไนเซอร์ (ระบุไว้เพียงว่า “Other”) จุดตัดขององค์ความรู้ การควอนไทซ์ สัญญาอนุญาต และว่าน้ำหนักที่เผยแพร่ได้นั้นมีอยู่จริงหรือไม่ คลังเก็บที่มาคู่กันระบุว่าไฟล์ GGUF จะปรากฏขึ้น “เมื่อน้ำหนักโมเดลพร้อมใช้งาน” — เป็นคำสัญญาเกี่ยวกับไฟล์ในอนาคต ไม่ใช่หลักฐานว่าน้ำหนักมีอยู่จริงในตอนนี้

• ใช้งานได้ และมีข้อมูลน้อยอย่างเห็นได้ชัด — รายการนี้ไม่เปิดเผยตัวเลข throughput และไม่เปิดเผยตัวเลข latency ทั้งสองฟิลด์ว่างเปล่า โดยรายงานผู้ให้บริการ serving เพียงรายเดียว ติดแท็กว่า stealth และไม่ทราบการควอนไทเซชัน

หัวข้อย่อยสุดท้ายนั้นคือคำตอบที่ตรงไปตรงมาต่อคำถามว่า “มันเร็วแค่ไหน”: ไม่มีใครที่เผยแพร่ตัวเลขเป็นเจ้าของ endpoint และผู้ดำเนินการ endpoint นั้นไม่ได้เผยแพร่อะไรเลย นั่นไม่ใช่เหตุผลที่จะหลีกเลี่ยงโมเดลนี้ มันเป็นเหตุผลที่จะวัดมันในการเรียกใช้ครั้งแรกของคุณ แทนที่จะเชื่อคำคุณศัพท์ในคำอธิบาย

A generated single-column scoreboard titled 'Space Bunny — the scoreboard' with six rows: Context window 1,000,000 tokens, Max output 524,288 tokens, Modalities text + image + video in text out, Reasoning mandatory low to max default max, Listed price $0 in / $0 out per 1M, and Independent score: no leaderboard entry. A footer reads 'Envelope and price are operator-supplied listing metadata, unaudited; there is no independent evaluation on a public leaderboard.' The OrcaRouter logo sits bottom-right.

เรตการ์ด: ศูนย์ และความหมายของศูนย์ในที่นี้

รายการนี้กำหนดราคาโมเดลที่ $0 ต่อหนึ่งล้านโทเคนขาเข้า และ $0 ต่อหนึ่งล้านโทเคนขาออก — เป็นการทดลองใช้ฟรี บนรายการของผู้ให้บริการเอง ซึ่งอ่านเมื่อวันนี้ ไม่มีขีดจำกัดต่อคำขอ และไม่มีนโยบายจำกัดอัตราที่เผยแพร่บนรายการนี้

ข้อแม้สองข้อ ข้อแรก นั่นคือราคาที่ผู้ให้บริการประกาศไว้ ณ วันนี้ ไม่ใช่คำมั่นสัญญา: ราคาพรีวิวแบบไม่เปิดเผยเป็นคุณลักษณะของลิสติ้ง และลิสติ้งเปลี่ยนแปลงได้โดยไม่ต้องแจ้งให้ทราบ ข้อที่สอง ในซีรีส์นี้ พรีวิวราคา $0 ตามประวัติที่ผ่านมาเป็นเครื่องมือสำหรับการประเมิน มากกว่าจะเป็นระดับชั้นถาวร — หน้าต่างฟรีจะปิดลงเมื่อพรีวิวสิ้นสุด ใครก็ตามที่สร้างบนอัตรา 0 ดอลลาร์ ควรถือว่าตัวเลขนี้เป็นค่าปัจจุบัน ไม่ใช่ค่าถาวร และควรรู้ว่าค่าใช้จ่ายสำรองต่อล้านของตนเป็นเท่าใดก่อนที่ตนจะต้องใช้มัน

พื้นผิวของ endpoint

สิ่งที่ผู้เรียกใช้งานได้รับจริง ซึ่งดึงมาจากชุดพารามิเตอร์ที่รองรับของรายการนั้น แทนที่จะมาจากเอกสารเชิงบรรยาย

• Chat completions — messages/ พร้อม stream/ แบบไม่บังคับ จึงเป็นการสร้างแบบสตรีมมิงทั่วไป

• การสุ่มตัวอย่างและขีดจำกัด — max_tokens/, temperature/, top_p/. โทเค็นการให้เหตุผลจะถูกนำมาจาก max_tokens/ งบประมาณ ดังนั้นการจำกัดเพดานให้แน่นเกินไปจะตัดทอนการคิดก่อนที่จะตัดทอนเอาต์พุต

• ตัวควบคุมการให้เหตุผล — reasoning/ และ reasoning_effort/ ตลอดบันไดห้าขั้น พร้อมทั้ง include_reasoning/ เพื่อแสดงหรือซ่อนข้อความการให้เหตุผล

• โครงสร้างและเครื่องมือ — tools/, tool_choice/ (รองรับ auto; ไม่รองรับการบังคับให้ใช้ฟังก์ชันที่ระบุ) และ response_format/ สำหรับ JSON โดยไม่มีการตรวจสอบสคีมา

นั่นคือพื้นผิวทั้งหมดที่มีให้ใช้ ไม่มีเอนด์พอยต์สำหรับวิชันแยกต่างหาก ไม่มี API แบบแบตช์ ไม่มีเส้นทางสำหรับ fine-tuning ไม่มี embeddings อินพุตแบบมัลติโมดัลเข้ามาผ่านการเรียกแชตเดียวกัน ซึ่งสะดวก และยังหมายความว่าไฟล์แนบวิดีโอขนาดใหญ่ต้องแย่งชิงงบ context เดียวกันกับทุกสิ่งทุกอย่างในบทสนทนา

บุคคลที่สามได้วัดอะไรจริง ๆ บ้าง

นี่คือจุดที่ผลการค้นหาส่วนใหญ่หมดความรอบคอบ ดังนั้นเรามาเริ่มจากแหล่งที่มากันก่อน Artificial Analysis ซึ่งเป็นกระดานจัดอันดับอิสระที่เรามักอ้างอิงสำหรับการเปรียบเทียบข้ามโมเดล ไม่มีรายการสำหรับ Space Bunny ไม่ว่าจะใช้ชื่อใดในสองชื่อนั้น — ตรวจสอบแล้ววันนี้ผ่านการร้องขอโดยตรง การวัดจากบุคคลที่สามสองรายการที่มีอยู่นั้นแตกต่างกันโดยประเภท และทั้งคู่ไม่ใช่ฮาร์เนสที่จับคู่กับโมเดลซึ่งมันถูกพล็อตเทียบเคียงข้าง ๆ

อันแรกคือ AI BENCHY ซึ่งเป็นเว็บไซต์ทดสอบมาตรฐานจากบุคคลที่สามที่เผยแพร่ผลการรันแยกตามโมเดล รายการของ Space Bunny Alpha ในเว็บไซต์นั้นบันทึกไว้ที่ 7.0 จาก 10 ในการให้เหตุผลระดับสูง อัตราการผ่านต่อจำนวนครั้งที่ลอง 62.1% ความน่าเชื่อถือ 10.0 เวลาตอบสนองเฉลี่ย 27.38 วินาที และต้นทุนที่บันทึกไว้ $0.000 และจัดให้อยู่ในอันดับที่ 161 ในตารางของเว็บไซต์นั้นเอง เมื่อแยกตามหมวดหมู่ ผลลัพธ์ที่แข็งแกร่งที่สุดของมันคือการสกัดข้อมูลและการเรียกใช้เครื่องมือ ซึ่งได้ 10.0 จาก 10 ทั้งคู่ ส่วนที่อ่อนที่สุดคือเรื่องไม่สำคัญที่ 3.0 และสติปัญญาทั่วไปที่ 4.2 เหล่านี้คือตัวเลขของเว็บไซต์นั้นจากชุดทดสอบของมันเอง ตัวเลขที่ควรอ่านคืออัตราการผ่านและความกระจายตัวตามหมวดหมู่ ไม่ใช่อันดับโดยรวม ซึ่งเป็นตำแหน่งในลำดับของคนอื่น

อย่างที่สองคือคู่มือภาคสนามของโมเดลเอง ซึ่งเผยแพร่ผลการประเมินของตัวเอง: 82.0% บนชุดย่อย GPQA Diamond จำนวน 60 ข้อ, 75% บน MMLU-Pro และ 46.1% บนชุดย่อยของ Humanity's Last Exam จำนวน 300 ข้อ โดยมีช่วงความเชื่อมั่นประมาณ 95% อยู่ที่ 40.4–51.8% เว็บไซต์ระบุชัดเจนว่าสิ่งเหล่านี้เป็นการรันบนชุดย่อยของตัวเอง และโมเดลที่แสดงไว้ข้าง ๆ นั้นเป็นผลลัพธ์อ้างอิงที่เผยแพร่จากผู้จำหน่ายของแต่ละราย — จำนวนคำถามต่างกัน ฮาร์เนสต่างกัน การตั้งค่าต่างกัน ข้อแม้นั้นเป็นส่วนสำคัญ และไม่ควรถูกละทิ้งไปเงียบ ๆ: คอลัมน์เหล่านั้นไม่ใช่การเทียบแบบตัวต่อตัว และยังไม่มีใครรันการเปรียบเทียบที่ใช้ความพยายามเท่ากันและฮาร์เนสเดียวกันระหว่าง Space Bunny กับโมเดลใด ๆ ที่มันถูกวางกราฟไว้ข้าง ๆ หน้าที่นำตัวเลขเหล่านั้นมาเสนอเป็นอันดับกำลังทำสิ่งที่แหล่งข้อมูลเองปฏิเสธที่จะทำ

ผลการทดสอบจากบุคคลที่สามอีกสองรายการน่าสนใจเพราะมันทดสอบสิ่งที่เบนช์มาร์กมักมองข้าม หนังสือคู่มือภาคสนามรายงานการตรวจสอบบริบทขนาดยาว โดยรหัสที่แตกต่างกันสามรหัสที่ซ่อนอยู่ภายในอินพุตเดียวขนาดประมาณ 200,000 โทเคน ถูกส่งคืนกลับมาทั้งหมดในลำดับที่ถูกต้องในการทดลองครั้งเดียว นี่เป็นการทดสอบความจุมากกว่าที่จะเป็นคะแนนความสามารถ และเป็นรูปแบบการตรวจสอบที่หน้าต่างบริบทขนาด 1M ชวนให้ทำแต่แทบไม่เคยได้รับการทดสอบเลย คู่มือดังกล่าวยังรายงานการเปรียบเทียบประสิทธิภาพการใช้โทเคน โดย Space Bunny ใช้โทเคนเอาต์พุต 305,989 โทเคน เทียบกับ 913,989 โทเคนของ Qwen3.8 Flash บนเบนช์มาร์กชุดเดียวกัน ซึ่งน้อยลงประมาณสองในสาม และเรื่องนี้สำคัญกว่าที่ฟังดู เมื่อหน้าต่างใช้งานฟรีปิดลง

ข้อเท็จจริงเดี่ยวที่ชัดเจนที่สุดในภาพรวมทั้งหมดก็คือช่องว่าง ไม่มีรายการใน Artificial Analysis ไม่มีคะแนนจาก arena และไม่มีการทดสอบ benchmark ใดที่บุคคลที่สองนำมาทำซ้ำ คะแนน 7.0/10 จากชุดทดสอบชุดเดียว และ 46.1% จากชุดย่อยที่เผยแพร่เอง โดยไม่มีการทำซ้ำที่ใดเลย เป็นเพียงจุดเริ่มต้นมากกว่าจะเป็นคำตัดสิน

A generated single-column card titled 'Space Bunny — measured by third parties' with five rows: AI BENCHY (its own suite) 7.0 / 10 at high reasoning, AI BENCHY attempt pass rate 62.1%, Field guide GPQA Diamond subset 82.0% on 60 questions, Field guide MMLU-Pro 75%, Field guide HLE subset 46.1% on 300 questions. Below the rows a bordered strip reads 'No Artificial Analysis entry. No matched-harness comparison against any model shown.' A footer reads 'Third-party figures from AI BENCHY and the model's own field guide; different suites, no replication.' The OrcaRouter logo sits bottom-right.

ใครอยู่เบื้องหลัง

ไม่เปิดเผย และตัวประกาศเองก็ระบุไว้เช่นนั้น: โมเดลนี้พัฒนาและดำเนินการโดยบุคคลที่สามซึ่งเลือกที่จะไม่เปิดเผยตัวตนระหว่างช่วงพรีวิว และแพลตฟอร์มที่โฮสต์ประกาศนี้ระบุว่าตนไม่ใช่ผู้พัฒนา เจ้าของ หรือผู้ให้บริการ รีโพซิทอรีที่แนบมาด้วยไม่มีชื่อแล็บ ไม่มีสัญญาอนุญาต และไม่มีเวต

มีวาทกรรมการคาดเดาสาธารณะที่ยังดำเนินอยู่ — การประกอบรูปแบบพรอมป์ตขึ้นใหม่ การตรวจสอบตระกูลโทเคไนเซอร์ การเปรียบเทียบตัวอย่าง — และไม่มีข้อใดนำไปสู่ตัวตนที่ยืนยันได้ เราไม่ทบทวนสมมติฐานเหล่านั้น ด้วยเหตุผลเดียวกับที่เราไม่ได้ทำเมื่อรายการก่อน ๆ ในตระกูลนี้ยังเป็นนิรนาม: คะแนนเบนช์มาร์กที่ใช้ร่วมกันหรือจำนวนโทเคนที่ตรงกันเป็นเพียงความคล้ายคลึง ไม่ใช่การระบุตัวตน และการคาดเดาของชุมชนที่แต่งให้ดูเป็นข้อค้นพบนั้นย่อมแย่สำหรับผู้อ่านยิ่งกว่าช่องว่างที่ซื่อตรง สิ่งที่บันทึกแสดงให้เห็นคือ ตัวอย่างก่อนเปิดตัวแบบนิรนามทุกชิ้นในซีรีส์นี้จนถึงตอนนี้ สุดท้ายถูกประกาศความเป็นเจ้าของโดยแล็บที่มีชื่อ มักภายในไม่กี่วันถึงไม่กี่สัปดาห์ และบ่อยครั้งมาพร้อมการเปลี่ยนแปลงราคา นั่นคืออัตราฐานเกี่ยวกับว่าตัวอย่างก่อนเปิดตัวเหล่านี้มักจบลงอย่างไร ไม่ใช่การพยากรณ์เกี่ยวกับชิ้นนี้ — และเป็นเหตุผลที่ควรถือซองข้อมูลของวันนี้เป็นภาพ ณ ขณะหนึ่ง มากกว่าข้อกำหนดทางเทคนิค

การประเมินโมเดลที่ไม่รู้จักโดยไม่เดิมพันเส้นทางใดเส้นทางหนึ่งกับมัน

ผู้ดำเนินการที่ไม่เปิดเผยตัวตนไม่ได้หยุดคุณจากการทดสอบโมเดล มันเปลี่ยนว่าคุณตอบคำถามใดได้บ้าง มีสามสิ่งที่ตามมาจากตัวรายการเอง

• ข้อกำหนดการเก็บรักษาข้อมูลคือข้อที่ต้องปฏิบัติตาม พรอมต์และคำตอบอาจถูกเก็บรักษาไว้โดยผู้ให้บริการที่ไม่ระบุชื่อ ชุดทดสอบมาตรฐานสาธารณะ โค้ดโอเพนซอร์ส และต้นแบบที่ใช้แล้วทิ้งได้นั้นไม่เป็นปัญหา ส่วนข้อมูลลูกค้า ซอร์สโค้ดที่เป็นกรรมสิทธิ์ และสิ่งใดก็ตามที่อยู่ภายใต้ระบบการปฏิบัติตามข้อกำหนดนั้นใช้ไม่ได้ และการที่ราคาฟรีไม่ได้เปลี่ยนการคำนวณนั้น

• ให้ถือว่าทุกข้อกล่าวอ้างเกี่ยวกับความสามารถเป็นเพียงสมมติฐานจนกว่าคุณจะมีตัวเลขของตัวเอง อัตราการประมวลผล ความหน่วงของโทเคนแรก และความสอดคล้องของเอาต์พุตยาว คือสามตัวเลขที่ยังไม่มีใครเผยแพร่สำหรับโมเดลนี้ และยังเป็นสามตัวเลขที่ตัดสินว่าโมเดลนี้เหมาะกับภาระงานหรือไม่ การวัดค่าทั้งสามนี้ใช้เวลาแค่บ่ายเดียว

• อย่าทำให้มันเป็นโมเดลเดียวในเส้นทาง ผู้ให้บริการที่ไม่มีชื่อ ไม่มีหน้าสถานะ และไม่มีช่องทางส่งต่อเรื่อง คือผู้ให้บริการที่คุณตามร่องรอยความล้มเหลวไม่ได้

กฎข้อสุดท้ายคือจุดที่เราเตอร์พิสูจน์คุณค่าของตัวเอง และเป็นส่วนที่เราสามารถพูดได้โดยตรง OrcaRouter ให้บริการโมเดลมากกว่า 200 รายการผ่าน API เดียวโดยไม่บวกเพิ่มจากราคาที่ผู้ให้บริการประกาศไว้ — คุณจ่ายในอัตราที่ผู้ให้บริการเผยแพร่เอง ดังนั้นเมื่อผู้ให้บริการลดราคา ฝั่งเราก็อัปเดตทันทีในวันเดียวกัน — พร้อมทั้งการสลับไปใช้ผู้ให้บริการรายอื่นแบบอัตโนมัติเมื่อเกิดข้อขัดข้องและ routing DSL ที่ให้คุณประกาศโมเดลที่รู้แน่ว่าใช้งานได้ดีเป็นตัวสำรองไว้ข้างหลังโมเดลทดลอง เพื่อให้ชัดเจนแทนที่จะพูดให้ดูใจดีในประเด็นเรื่องความพร้อมใช้งาน: ตอนนี้ Space Bunny ไม่ได้อยู่ในแคตตาล็อกของเรา API โมเดลของเราไม่คืนเส้นทางดังกล่าวภายใต้ชื่อใดชื่อหนึ่งเหล่านี้ ดังนั้นเราจึงไม่ใช่ช่องทางสำหรับเรียกโมเดลนี้ และหน้านี้ก็ไม่ใช่เส้นทางไปสู่โมเดลนี้ สิ่งที่เราเป็นคือช่องทางสำหรับวางโมเดลที่ผ่านการวัดผลไว้ข้างหลังโมเดลที่ยังไม่ได้วัดผล ระหว่างที่คุณตัดสินใจ — ซึ่งเป็นท่าทีเดียวที่สมเหตุสมผลต่อพรีวิวฟรีจากผู้ให้บริการที่ไม่มีใครระบุชื่อได้

อะไรจะเปลี่ยนหน้านี้

สี่สิ่ง ตามลำดับที่พวกมันมีแนวโน้มจะมาถึง เจ้าของที่ระบุชื่อ ซึ่งในซีรีส์นี้มาพร้อมกับสัญญาอนุญาต จำนวนพารามิเตอร์ และราคา การทำเบนช์มาร์กซ้ำโดยฝ่ายที่สอง ซึ่งจะเป็นหลักฐานเชิงคุณภาพชิ้นแรกที่ไม่ผูกติดกับชุดทดสอบเพียงชุดเดียว อัตราการประมวลผลและความหน่วงที่เผยแพร่ สองช่องที่ว่างอยู่ซึ่งผู้ซื้ออยากให้เติมมากที่สุด และการเปลี่ยนแปลงของตารางราคา ซึ่งปัจจุบันเป็นคุณสมบัติที่ชี้ขาดมากที่สุดเพียงอย่างเดียวของโมเดล

จนกว่าจะถึงตอนนั้น สรุปที่ตรงไปตรงมาก็สั้น ๆ Space Bunny เป็นพรีวิวการให้เหตุผลที่รองรับวิดีโอ ฟรี ขนาดหนึ่งล้านโทเคน โดยมีผู้ดำเนินการที่ไม่เปิดเผย: ผลการทดสอบจากบุคคลที่สามหนึ่งครั้งที่ 7.0/10, ชุดการประเมินชุดย่อยที่เผยแพร่เองหนึ่งชุด, ไม่มีรายการบนลีดเดอร์บอร์ดอิสระ และไม่มีตัวเลขปริมาณงานเลยแม้แต่ตัวเดียว ชื่อล้วน ๆ ของมันกับชื่ออัลฟาของมันเป็นโมเดลเดียวกัน ทุกอย่างอื่นเกี่ยวกับมันเป็นสแนปช็อตของรายการที่ประทับวันที่ และหน้านี้คือจุดที่ใช้ตรวจสอบว่าสแนปช็อตใดเป็นปัจจุบัน

A generated two-column infographic titled 'Space Bunny — documented vs not documented'. The left card, headed 'Documented on the listing', lists Context 1,000,000 tokens, Max output 524,288 tokens, Inputs text image video, Reasoning mandatory five effort levels, Tools and JSON output accepted, Price $0 per 1M in and out. The right card, headed 'Not documented', lists Provider undisclosed, Parameter count none, Tokenizer filed as Other, Throughput no figure published, Latency no figure published, Weights not available. A footer reads 'Left column is operator-supplied listing metadata, unaudited, read 2026-09-28.' The OrcaRouter logo sits bottom-right.
© 2026 OrcaRouter

สำหรับผู้ให้บริการ

ให้บริการแพลตฟอร์มการอนุมานอยู่หรือไม่ นำโมเดลของคุณขึ้น OrcaRouter

providers@orcarouter.ai

เข้าร่วมคอมมูนิตี้ของเรา

Discordsupport@orcarouter.aiXGitHubYouTube