
Space Bunny: หน้าอ้างอิงสำหรับ Stealth Model ซึ่งถูกระบุอีกชื่อว่า Space Bunny Alpha
- typesafeใหม่TypeSafe: Jev 1.132026-09-24$0.04 / $0.00 ต่อ 1 ล้านโทเค็น · 316 tok/s
- openaiใหม่OpenAI: GPT-6 Luna2026-09-2237ความฉลาด
- openaiใหม่OpenAI: GPT-6 Sol2026-09-2248ความฉลาด
- anthropicใหม่Anthropic: Claude Opus 5.52026-09-2258ความฉลาด
- grokใหม่Grok 4.72026-09-2146ความฉลาด
- Orcaใหม่Orca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 ต่อ 1 ล้านโทเค็น · 196 tok/s
- orcaใหม่Orca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 ต่อ 1 ล้านโทเค็น · 1327 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040ความฉลาด
- openaiOpenAI: GPT-6 Astra2026-09-0453ความฉลาด77การเขียนโค้ด
- googleGoogle: Gemini 3.8 Flash2026-09-0241ความฉลาด76การเขียนโค้ด
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245ความฉลาด76การเขียนโค้ด
- anthropicAnthropic: Claude Fable 5.12026-09-0153ความฉลาด82การเขียนโค้ด
- tencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 ต่อ 1 ล้านโทเค็น
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 ต่อ 1 ล้านโทเค็น · 111 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642ความฉลาด72การเขียนโค้ด
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 ต่อ 1 ล้านโทเค็น · 221 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845ความฉลาด75การเขียนโค้ด
- obsidianQwen3.8 27B2026-08-1534ความฉลาด68การเขียนโค้ด
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236ความฉลาด69การเขียนโค้ด
- grokSpaceXAI: Grok 4.62026-08-1244ความฉลาด77การเขียนโค้ด
Space Bunny กับ Space Bunny Alpha เป็นโมเดลเดียวกัน เคลียร์เรื่องนี้ก่อน เพราะชื่อทั้งสองดึงไปคนละทาง ชื่อเปล่า ๆ คือสิ่งที่คนส่วนใหญ่พิมพ์ค้นหา และชื่อที่มีเวอร์ชันกำกับคือสิ่งที่ทุกรายการและทุกบทความใช้ ไม่มี Space Bunny ตัวที่สอง — ไม่มีรุ่นน้องที่เล็กกว่า ไม่มีรุ่นก่อนหน้าที่ Alpha เข้ามาแทนที่ ชื่อเปล่า ๆ คือรูปย่อAlphaคือเครื่องหมายระยะพรีวิวที่กลุ่มรายการนิรนามกลุ่มนี้ใช้อยู่ ตราบใดที่ผู้ดำเนินการยังไม่ถูกเปิดเผยชื่อ Space Bunny เป็นพรีวิวแบบล่องหนที่ให้บริการบนแพลตฟอร์มของบุคคลที่สาม: คอนเท็กซ์หนึ่งล้านโทเคน เพดานเอาต์พุต 524,288 โทเคน รับข้อมูลเข้าเป็นข้อความ รูปภาพ และวิดีโอ และราคาที่ระบุไว้คือศูนย์ดอลลาร์ต่อล้านโทเคน โดยไม่เปิดเผยตัวตนของผู้ให้บริการ หน้านี้คือเอกสารอ้างอิงสำหรับมัน — ปลายทางสำหรับคนที่ค้นหาชื่อของโมเดลนี้เอง ไม่ใช่ประกาศครั้งที่สองว่ามันมีอยู่
สองสิ่งเกี่ยวกับวิธีอ่านสิ่งที่ตามมา ทุกอย่างภายใต้หัวข้อ Envelope คือข้อมูลเมทาดาทาของประกาศที่ผู้ให้บริการป้อนเข้ามา: ตัวเลขของผู้ให้บริการนิรนามเอง ซึ่งเผยแพร่บนแพลตฟอร์มที่โฮสต์ตัวอย่างนี้ และถูกอ่านซ้ำอีกครั้งในวันนี้ วันที่ 28 กันยายน 2026 ไม่มีส่วนใดได้รับการตรวจสอบอย่างอิสระ และขอย้ำอีกครั้งตรงจุดที่ตัวเลขปรากฏ ส่วน benchmark แยกออกมาต่างหาก และมีแหล่งที่มาจากบุคคลที่สามตลอดทั้งส่วน ข้อสังเกตอีกประการคือเหตุผลที่หน้านี้มีอยู่ตั้งแต่แรก ประกาศนี้ลงวันที่ 23 กันยายน 2026 ห้าวันก่อน จึงไม่มีปัญหาความเก่าให้ต้องถกกันอ้อม — แต่ข้อรับรองตรงนี้ไม่ใช่วันที่นั้น หากเป็นอุปสงค์การค้นหาจากฝ่ายเราเองที่เราวัดเอง: 1,668 ครั้งที่แสดงผล และ 238 คลิก สำหรับคำค้น "space bunny" ในช่วง 28 วันจนถึงวันที่ 25 กันยายน อยู่ในตำแหน่งที่ 4.8 นั่นเป็นข้อเท็จจริงเกี่ยวกับสิ่งที่ผู้คนพิมพ์ ไม่ใช่เกี่ยวกับโมเดล ผู้อ่านคลิกผ่านเข้ามายังหน้าใดก็ตามที่เราได้อันดับอยู่แล้ว; เพียงแต่ไม่มีหน้าเกี่ยวกับตัวโมเดลเองให้พวกเขาคลิกเข้ามาเจอ การเติมเต็มช่องว่างนั้นคือข้อกำหนดที่บทความนี้ยืนอยู่ — อุปสงค์ที่มีอยู่ต่อเนื่องซึ่งวัดเมื่อวันที่ 28 กันยายน 2026 โดยวันที่ประกาศถูกใช้เพื่อระบุอายุของโมเดล มากกว่าจะเป็นเหตุการณ์ที่จะรายงาน
ชื่อที่กำหนดไว้อย่างเหมาะสม
หลักฐานสำหรับ “โมเดลเดียวกัน” คือการไม่มีอยู่ จึงควรระบุให้ชัดเจนว่าได้ตรวจสอบอะไรไปบ้าง แพลตฟอร์มที่โฮสต์ตัวอย่างนี้แสดงรายการสำหรับตระกูลนี้เพียงรายการเดียว ภายใต้ตัวระบุ stealth/space-bunny-alpha/ และชื่อที่แสดงคือ “Space Bunny Alpha”; ไม่มีแบบเปล่า ๆ ของ space-bunny/ เป็นรายการอยู่ข้าง ๆ คู่มือของโมเดลนี้เอง — เว็บไซต์ของบุคคลที่สามซึ่งระบุอย่างชัดเจนว่าไม่มีส่วนเกี่ยวข้องกับแพลตฟอร์มหรือผู้พัฒนา — แนะนำโมเดลนี้ว่า “Space Bunny Alpha หรือเขียนอีกแบบว่า space-bunny-alpha” และระบุวันที่ลงรายการเป็น 23 กันยายน 2026 องค์กร Hugging Face ซึ่งโฮสต์ที่เก็บโค้ดประกอบสำหรับซีรีส์นี้ มีที่เก็บโค้ดของ bunny หนึ่งแห่ง ซึ่งตั้งชื่อตาม alpha การค้นหา “Space Bunny” แบบเปล่า ๆ ในฐานะโมเดลแยกต่างหากให้ผลลัพธ์เพียงโมเดลเดิมภายใต้ชื่อที่สั้นกว่าเท่านั้น
ในทางปฏิบัติ: ให้ถือว่าทั้งสองสตริงเป็นนามแฝงของกันและกัน "Space Bunny" เป็นคำหลักและเป็นคำที่มีพฤติกรรมการคลิกที่ดีกว่า; space-bunny-alpha/ คือตัวระบุที่คุณใส่ในคำขอ สิ่งเดียวที่ชื่อล้วน ๆ ไม่ได้บอกเป็นนัยก็คือเวอร์ชัน — ไม่มี 1.0 ที่มีเอกสารกำกับ ไม่มีรุ่นย่อยที่เล็กกว่า ไม่มีรุ่นที่ไม่ใช่พรีวิว รายการหรือโพสต์ที่บอกเป็นนัยเป็นอย่างอื่นกำลังกุตระกูลที่บันทึกไม่ได้แสดงไว้
คำต่อท้ายนี้ให้ข้อมูลจริง ๆ: โมเดลอยู่ในช่วงพรีวิว ดำเนินการโดยผู้ให้บริการที่เลือกจะไม่เปิดเผยชื่อระหว่างช่วงนั้น และประกาศแจ้งเตือนแบบสเตลธ์ของแพลตฟอร์มระบุว่า พรอมต์และผลลัพธ์อาจถูกเก็บรักษาไว้โดยผู้ให้บริการรายนั้น แต่จะไม่ถูกนำไปใช้ในการฝึก โปรดอ่านข้อความนั้นอย่างละเอียด เพราะมันเป็นคำแถลงเรื่องการเก็บรักษาข้อมูล ไม่ใช่คำแถลงว่าไม่เก็บข้อมูลเลย หากคุณได้อ่านบทความรายงานก่อนเปิดตัวของเราเกี่ยวกับรายการนี้ — หน้าเปิดเผยข้อมูล Space Bunny Alpha — ภารกิจของหน้านั้นได้บรรลุแล้ว: สิ่งที่มันคาดการณ์ไว้ตอนนี้ก็เป็นเพียงสถานะของโมเดล และคำถามที่ยังต้องติดตามได้ย้ายจากตัวตนไปสู่ขอบเขต ต้นทุน และปริมาณงาน
ซองจดหมาย ตามที่ประกาศระบุไว้
อ่านซ้ำอีกครั้งวันนี้บนประกาศที่เผยแพร่อยู่ ผู้ปฏิบัติงานเป็นผู้ให้ข้อมูล ยังไม่ได้ทำซ้ำ
• หน้าต่างบริบท — 1,000,000 โทเค็น ระดับ 1M เดียวกันกับพรีวิวแบบไม่ระบุชื่อก่อนหน้านี้ในซีรีส์นี้
• เอาต์พุตสูงสุด — 524,288 โทเคน ครึ่งหนึ่งของหน้าต่างบริบท ซึ่งเป็นเพดานที่สูงมากไม่ว่าจะจ่ายในราคาใด และเป็นเพดานที่ไม่มีบุคคลที่สามรายใดเคยทดสอบภายใต้สภาวะกดดันเพื่อดูความสอดคล้องที่ปลายสุด
• อินพุตและเอาต์พุต — รับข้อความ รูปภาพ และวิดีโอเป็นอินพุต; ส่งออกเป็นข้อความ วิดีโออินพุตคือรายละเอียดที่ทำให้รายการแบบไม่ระบุชื่อรุ่นนี้แตกต่างจากการเปิดตัวแบบมัลติโมดัลทั่วไปมากที่สุด
• การให้เหตุผล — เป็นข้อบังคับและไม่สามารถปิดได้ โดยมีระดับความพยายาม 5 ระดับ ได้แก่ ต่ำ ปานกลาง สูง สูงมาก และสูงสุด รายการที่แสดงอยู่จริงในวันนี้ระบุว่าค่าเริ่มต้นของผู้ให้บริการคือสูงสุด และคู่มือภาคสนามของบุคคลที่สามก็บันทึกค่าเริ่มต้นเดียวกันนี้ไว้โดยอิสระเช่นกัน การซ่อนข้อความการให้เหตุผลผ่าน API ไม่ได้ปิดการประมวลผล แต่ยังคงใช้งบประมาณเอาต์พุตอยู่
• การใช้เครื่องมือและการส่งออกแบบมีโครงสร้าง — tools/ และ tool_choice/ ได้รับการยอมรับ ดังนั้นจึงสามารถเรียกใช้ฟังก์ชันได้ response_format/ ให้เอาต์พุต JSON โดยไม่มีการบังคับใช้ JSON-schema ซึ่งเป็นข้อจำกัดเดียวกันที่กลุ่มตัวอย่างพรีวิวนี้มีมาตลอด หากไปป์ไลน์ของคุณต้องการออบเจ็กต์ที่ผ่านการตรวจสอบกลับมา คุณต้องตรวจสอบด้วยตนเอง
• ไม่เปิดเผย — ชื่อผู้ให้บริการ จำนวนพารามิเตอร์ พารามิเตอร์ที่ใช้งาน สถาปัตยกรรม ตระกูลโทเคไนเซอร์ (ระบุไว้เพียงว่า “Other”) จุดตัดขององค์ความรู้ การควอนไทซ์ สัญญาอนุญาต และว่าน้ำหนักที่เผยแพร่ได้นั้นมีอยู่จริงหรือไม่ คลังเก็บที่มาคู่กันระบุว่าไฟล์ GGUF จะปรากฏขึ้น “เมื่อน้ำหนักโมเดลพร้อมใช้งาน” — เป็นคำสัญญาเกี่ยวกับไฟล์ในอนาคต ไม่ใช่หลักฐานว่าน้ำหนักมีอยู่จริงในตอนนี้
• ใช้งานได้ และมีข้อมูลน้อยอย่างเห็นได้ชัด — รายการนี้ไม่เปิดเผยตัวเลข throughput และไม่เปิดเผยตัวเลข latency ทั้งสองฟิลด์ว่างเปล่า โดยรายงานผู้ให้บริการ serving เพียงรายเดียว ติดแท็กว่า stealth และไม่ทราบการควอนไทเซชัน
หัวข้อย่อยสุดท้ายนั้นคือคำตอบที่ตรงไปตรงมาต่อคำถามว่า “มันเร็วแค่ไหน”: ไม่มีใครที่เผยแพร่ตัวเลขเป็นเจ้าของ endpoint และผู้ดำเนินการ endpoint นั้นไม่ได้เผยแพร่อะไรเลย นั่นไม่ใช่เหตุผลที่จะหลีกเลี่ยงโมเดลนี้ มันเป็นเหตุผลที่จะวัดมันในการเรียกใช้ครั้งแรกของคุณ แทนที่จะเชื่อคำคุณศัพท์ในคำอธิบาย

เรตการ์ด: ศูนย์ และความหมายของศูนย์ในที่นี้
รายการนี้กำหนดราคาโมเดลที่ $0 ต่อหนึ่งล้านโทเคนขาเข้า และ $0 ต่อหนึ่งล้านโทเคนขาออก — เป็นการทดลองใช้ฟรี บนรายการของผู้ให้บริการเอง ซึ่งอ่านเมื่อวันนี้ ไม่มีขีดจำกัดต่อคำขอ และไม่มีนโยบายจำกัดอัตราที่เผยแพร่บนรายการนี้
ข้อแม้สองข้อ ข้อแรก นั่นคือราคาที่ผู้ให้บริการประกาศไว้ ณ วันนี้ ไม่ใช่คำมั่นสัญญา: ราคาพรีวิวแบบไม่เปิดเผยเป็นคุณลักษณะของลิสติ้ง และลิสติ้งเปลี่ยนแปลงได้โดยไม่ต้องแจ้งให้ทราบ ข้อที่สอง ในซีรีส์นี้ พรีวิวราคา $0 ตามประวัติที่ผ่านมาเป็นเครื่องมือสำหรับการประเมิน มากกว่าจะเป็นระดับชั้นถาวร — หน้าต่างฟรีจะปิดลงเมื่อพรีวิวสิ้นสุด ใครก็ตามที่สร้างบนอัตรา 0 ดอลลาร์ ควรถือว่าตัวเลขนี้เป็นค่าปัจจุบัน ไม่ใช่ค่าถาวร และควรรู้ว่าค่าใช้จ่ายสำรองต่อล้านของตนเป็นเท่าใดก่อนที่ตนจะต้องใช้มัน
พื้นผิวของ endpoint
สิ่งที่ผู้เรียกใช้งานได้รับจริง ซึ่งดึงมาจากชุดพารามิเตอร์ที่รองรับของรายการนั้น แทนที่จะมาจากเอกสารเชิงบรรยาย
• Chat completions — messages/ พร้อม stream/ แบบไม่บังคับ จึงเป็นการสร้างแบบสตรีมมิงทั่วไป
• การสุ่มตัวอย่างและขีดจำกัด — max_tokens/, temperature/, top_p/. โทเค็นการให้เหตุผลจะถูกนำมาจาก max_tokens/ งบประมาณ ดังนั้นการจำกัดเพดานให้แน่นเกินไปจะตัดทอนการคิดก่อนที่จะตัดทอนเอาต์พุต
• ตัวควบคุมการให้เหตุผล — reasoning/ และ reasoning_effort/ ตลอดบันไดห้าขั้น พร้อมทั้ง include_reasoning/ เพื่อแสดงหรือซ่อนข้อความการให้เหตุผล
• โครงสร้างและเครื่องมือ — tools/, tool_choice/ (รองรับ auto; ไม่รองรับการบังคับให้ใช้ฟังก์ชันที่ระบุ) และ response_format/ สำหรับ JSON โดยไม่มีการตรวจสอบสคีมา
นั่นคือพื้นผิวทั้งหมดที่มีให้ใช้ ไม่มีเอนด์พอยต์สำหรับวิชันแยกต่างหาก ไม่มี API แบบแบตช์ ไม่มีเส้นทางสำหรับ fine-tuning ไม่มี embeddings อินพุตแบบมัลติโมดัลเข้ามาผ่านการเรียกแชตเดียวกัน ซึ่งสะดวก และยังหมายความว่าไฟล์แนบวิดีโอขนาดใหญ่ต้องแย่งชิงงบ context เดียวกันกับทุกสิ่งทุกอย่างในบทสนทนา
บุคคลที่สามได้วัดอะไรจริง ๆ บ้าง
นี่คือจุดที่ผลการค้นหาส่วนใหญ่หมดความรอบคอบ ดังนั้นเรามาเริ่มจากแหล่งที่มากันก่อน Artificial Analysis ซึ่งเป็นกระดานจัดอันดับอิสระที่เรามักอ้างอิงสำหรับการเปรียบเทียบข้ามโมเดล ไม่มีรายการสำหรับ Space Bunny ไม่ว่าจะใช้ชื่อใดในสองชื่อนั้น — ตรวจสอบแล้ววันนี้ผ่านการร้องขอโดยตรง การวัดจากบุคคลที่สามสองรายการที่มีอยู่นั้นแตกต่างกันโดยประเภท และทั้งคู่ไม่ใช่ฮาร์เนสที่จับคู่กับโมเดลซึ่งมันถูกพล็อตเทียบเคียงข้าง ๆ
อันแรกคือ AI BENCHY ซึ่งเป็นเว็บไซต์ทดสอบมาตรฐานจากบุคคลที่สามที่เผยแพร่ผลการรันแยกตามโมเดล รายการของ Space Bunny Alpha ในเว็บไซต์นั้นบันทึกไว้ที่ 7.0 จาก 10 ในการให้เหตุผลระดับสูง อัตราการผ่านต่อจำนวนครั้งที่ลอง 62.1% ความน่าเชื่อถือ 10.0 เวลาตอบสนองเฉลี่ย 27.38 วินาที และต้นทุนที่บันทึกไว้ $0.000 และจัดให้อยู่ในอันดับที่ 161 ในตารางของเว็บไซต์นั้นเอง เมื่อแยกตามหมวดหมู่ ผลลัพธ์ที่แข็งแกร่งที่สุดของมันคือการสกัดข้อมูลและการเรียกใช้เครื่องมือ ซึ่งได้ 10.0 จาก 10 ทั้งคู่ ส่วนที่อ่อนที่สุดคือเรื่องไม่สำคัญที่ 3.0 และสติปัญญาทั่วไปที่ 4.2 เหล่านี้คือตัวเลขของเว็บไซต์นั้นจากชุดทดสอบของมันเอง ตัวเลขที่ควรอ่านคืออัตราการผ่านและความกระจายตัวตามหมวดหมู่ ไม่ใช่อันดับโดยรวม ซึ่งเป็นตำแหน่งในลำดับของคนอื่น
อย่างที่สองคือคู่มือภาคสนามของโมเดลเอง ซึ่งเผยแพร่ผลการประเมินของตัวเอง: 82.0% บนชุดย่อย GPQA Diamond จำนวน 60 ข้อ, 75% บน MMLU-Pro และ 46.1% บนชุดย่อยของ Humanity's Last Exam จำนวน 300 ข้อ โดยมีช่วงความเชื่อมั่นประมาณ 95% อยู่ที่ 40.4–51.8% เว็บไซต์ระบุชัดเจนว่าสิ่งเหล่านี้เป็นการรันบนชุดย่อยของตัวเอง และโมเดลที่แสดงไว้ข้าง ๆ นั้นเป็นผลลัพธ์อ้างอิงที่เผยแพร่จากผู้จำหน่ายของแต่ละราย — จำนวนคำถามต่างกัน ฮาร์เนสต่างกัน การตั้งค่าต่างกัน ข้อแม้นั้นเป็นส่วนสำคัญ และไม่ควรถูกละทิ้งไปเงียบ ๆ: คอลัมน์เหล่านั้นไม่ใช่การเทียบแบบตัวต่อตัว และยังไม่มีใครรันการเปรียบเทียบที่ใช้ความพยายามเท่ากันและฮาร์เนสเดียวกันระหว่าง Space Bunny กับโมเดลใด ๆ ที่มันถูกวางกราฟไว้ข้าง ๆ หน้าที่นำตัวเลขเหล่านั้นมาเสนอเป็นอันดับกำลังทำสิ่งที่แหล่งข้อมูลเองปฏิเสธที่จะทำ
ผลการทดสอบจากบุคคลที่สามอีกสองรายการน่าสนใจเพราะมันทดสอบสิ่งที่เบนช์มาร์กมักมองข้าม หนังสือคู่มือภาคสนามรายงานการตรวจสอบบริบทขนาดยาว โดยรหัสที่แตกต่างกันสามรหัสที่ซ่อนอยู่ภายในอินพุตเดียวขนาดประมาณ 200,000 โทเคน ถูกส่งคืนกลับมาทั้งหมดในลำดับที่ถูกต้องในการทดลองครั้งเดียว นี่เป็นการทดสอบความจุมากกว่าที่จะเป็นคะแนนความสามารถ และเป็นรูปแบบการตรวจสอบที่หน้าต่างบริบทขนาด 1M ชวนให้ทำแต่แทบไม่เคยได้รับการทดสอบเลย คู่มือดังกล่าวยังรายงานการเปรียบเทียบประสิทธิภาพการใช้โทเคน โดย Space Bunny ใช้โทเคนเอาต์พุต 305,989 โทเคน เทียบกับ 913,989 โทเคนของ Qwen3.8 Flash บนเบนช์มาร์กชุดเดียวกัน ซึ่งน้อยลงประมาณสองในสาม และเรื่องนี้สำคัญกว่าที่ฟังดู เมื่อหน้าต่างใช้งานฟรีปิดลง
ข้อเท็จจริงเดี่ยวที่ชัดเจนที่สุดในภาพรวมทั้งหมดก็คือช่องว่าง ไม่มีรายการใน Artificial Analysis ไม่มีคะแนนจาก arena และไม่มีการทดสอบ benchmark ใดที่บุคคลที่สองนำมาทำซ้ำ คะแนน 7.0/10 จากชุดทดสอบชุดเดียว และ 46.1% จากชุดย่อยที่เผยแพร่เอง โดยไม่มีการทำซ้ำที่ใดเลย เป็นเพียงจุดเริ่มต้นมากกว่าจะเป็นคำตัดสิน

ใครอยู่เบื้องหลัง
ไม่เปิดเผย และตัวประกาศเองก็ระบุไว้เช่นนั้น: โมเดลนี้พัฒนาและดำเนินการโดยบุคคลที่สามซึ่งเลือกที่จะไม่เปิดเผยตัวตนระหว่างช่วงพรีวิว และแพลตฟอร์มที่โฮสต์ประกาศนี้ระบุว่าตนไม่ใช่ผู้พัฒนา เจ้าของ หรือผู้ให้บริการ รีโพซิทอรีที่แนบมาด้วยไม่มีชื่อแล็บ ไม่มีสัญญาอนุญาต และไม่มีเวต
มีวาทกรรมการคาดเดาสาธารณะที่ยังดำเนินอยู่ — การประกอบรูปแบบพรอมป์ตขึ้นใหม่ การตรวจสอบตระกูลโทเคไนเซอร์ การเปรียบเทียบตัวอย่าง — และไม่มีข้อใดนำไปสู่ตัวตนที่ยืนยันได้ เราไม่ทบทวนสมมติฐานเหล่านั้น ด้วยเหตุผลเดียวกับที่เราไม่ได้ทำเมื่อรายการก่อน ๆ ในตระกูลนี้ยังเป็นนิรนาม: คะแนนเบนช์มาร์กที่ใช้ร่วมกันหรือจำนวนโทเคนที่ตรงกันเป็นเพียงความคล้ายคลึง ไม่ใช่การระบุตัวตน และการคาดเดาของชุมชนที่แต่งให้ดูเป็นข้อค้นพบนั้นย่อมแย่สำหรับผู้อ่านยิ่งกว่าช่องว่างที่ซื่อตรง สิ่งที่บันทึกแสดงให้เห็นคือ ตัวอย่างก่อนเปิดตัวแบบนิรนามทุกชิ้นในซีรีส์นี้จนถึงตอนนี้ สุดท้ายถูกประกาศความเป็นเจ้าของโดยแล็บที่มีชื่อ มักภายในไม่กี่วันถึงไม่กี่สัปดาห์ และบ่อยครั้งมาพร้อมการเปลี่ยนแปลงราคา นั่นคืออัตราฐานเกี่ยวกับว่าตัวอย่างก่อนเปิดตัวเหล่านี้มักจบลงอย่างไร ไม่ใช่การพยากรณ์เกี่ยวกับชิ้นนี้ — และเป็นเหตุผลที่ควรถือซองข้อมูลของวันนี้เป็นภาพ ณ ขณะหนึ่ง มากกว่าข้อกำหนดทางเทคนิค
การประเมินโมเดลที่ไม่รู้จักโดยไม่เดิมพันเส้นทางใดเส้นทางหนึ่งกับมัน
ผู้ดำเนินการที่ไม่เปิดเผยตัวตนไม่ได้หยุดคุณจากการทดสอบโมเดล มันเปลี่ยนว่าคุณตอบคำถามใดได้บ้าง มีสามสิ่งที่ตามมาจากตัวรายการเอง
• ข้อกำหนดการเก็บรักษาข้อมูลคือข้อที่ต้องปฏิบัติตาม พรอมต์และคำตอบอาจถูกเก็บรักษาไว้โดยผู้ให้บริการที่ไม่ระบุชื่อ ชุดทดสอบมาตรฐานสาธารณะ โค้ดโอเพนซอร์ส และต้นแบบที่ใช้แล้วทิ้งได้นั้นไม่เป็นปัญหา ส่วนข้อมูลลูกค้า ซอร์สโค้ดที่เป็นกรรมสิทธิ์ และสิ่งใดก็ตามที่อยู่ภายใต้ระบบการปฏิบัติตามข้อกำหนดนั้นใช้ไม่ได้ และการที่ราคาฟรีไม่ได้เปลี่ยนการคำนวณนั้น
• ให้ถือว่าทุกข้อกล่าวอ้างเกี่ยวกับความสามารถเป็นเพียงสมมติฐานจนกว่าคุณจะมีตัวเลขของตัวเอง อัตราการประมวลผล ความหน่วงของโทเคนแรก และความสอดคล้องของเอาต์พุตยาว คือสามตัวเลขที่ยังไม่มีใครเผยแพร่สำหรับโมเดลนี้ และยังเป็นสามตัวเลขที่ตัดสินว่าโมเดลนี้เหมาะกับภาระงานหรือไม่ การวัดค่าทั้งสามนี้ใช้เวลาแค่บ่ายเดียว
• อย่าทำให้มันเป็นโมเดลเดียวในเส้นทาง ผู้ให้บริการที่ไม่มีชื่อ ไม่มีหน้าสถานะ และไม่มีช่องทางส่งต่อเรื่อง คือผู้ให้บริการที่คุณตามร่องรอยความล้มเหลวไม่ได้
กฎข้อสุดท้ายคือจุดที่เราเตอร์พิสูจน์คุณค่าของตัวเอง และเป็นส่วนที่เราสามารถพูดได้โดยตรง OrcaRouter ให้บริการโมเดลมากกว่า 200 รายการผ่าน API เดียวโดยไม่บวกเพิ่มจากราคาที่ผู้ให้บริการประกาศไว้ — คุณจ่ายในอัตราที่ผู้ให้บริการเผยแพร่เอง ดังนั้นเมื่อผู้ให้บริการลดราคา ฝั่งเราก็อัปเดตทันทีในวันเดียวกัน — พร้อมทั้งการสลับไปใช้ผู้ให้บริการรายอื่นแบบอัตโนมัติเมื่อเกิดข้อขัดข้องและ routing DSL ที่ให้คุณประกาศโมเดลที่รู้แน่ว่าใช้งานได้ดีเป็นตัวสำรองไว้ข้างหลังโมเดลทดลอง เพื่อให้ชัดเจนแทนที่จะพูดให้ดูใจดีในประเด็นเรื่องความพร้อมใช้งาน: ตอนนี้ Space Bunny ไม่ได้อยู่ในแคตตาล็อกของเรา API โมเดลของเราไม่คืนเส้นทางดังกล่าวภายใต้ชื่อใดชื่อหนึ่งเหล่านี้ ดังนั้นเราจึงไม่ใช่ช่องทางสำหรับเรียกโมเดลนี้ และหน้านี้ก็ไม่ใช่เส้นทางไปสู่โมเดลนี้ สิ่งที่เราเป็นคือช่องทางสำหรับวางโมเดลที่ผ่านการวัดผลไว้ข้างหลังโมเดลที่ยังไม่ได้วัดผล ระหว่างที่คุณตัดสินใจ — ซึ่งเป็นท่าทีเดียวที่สมเหตุสมผลต่อพรีวิวฟรีจากผู้ให้บริการที่ไม่มีใครระบุชื่อได้
อะไรจะเปลี่ยนหน้านี้
สี่สิ่ง ตามลำดับที่พวกมันมีแนวโน้มจะมาถึง เจ้าของที่ระบุชื่อ ซึ่งในซีรีส์นี้มาพร้อมกับสัญญาอนุญาต จำนวนพารามิเตอร์ และราคา การทำเบนช์มาร์กซ้ำโดยฝ่ายที่สอง ซึ่งจะเป็นหลักฐานเชิงคุณภาพชิ้นแรกที่ไม่ผูกติดกับชุดทดสอบเพียงชุดเดียว อัตราการประมวลผลและความหน่วงที่เผยแพร่ สองช่องที่ว่างอยู่ซึ่งผู้ซื้ออยากให้เติมมากที่สุด และการเปลี่ยนแปลงของตารางราคา ซึ่งปัจจุบันเป็นคุณสมบัติที่ชี้ขาดมากที่สุดเพียงอย่างเดียวของโมเดล
จนกว่าจะถึงตอนนั้น สรุปที่ตรงไปตรงมาก็สั้น ๆ Space Bunny เป็นพรีวิวการให้เหตุผลที่รองรับวิดีโอ ฟรี ขนาดหนึ่งล้านโทเคน โดยมีผู้ดำเนินการที่ไม่เปิดเผย: ผลการทดสอบจากบุคคลที่สามหนึ่งครั้งที่ 7.0/10, ชุดการประเมินชุดย่อยที่เผยแพร่เองหนึ่งชุด, ไม่มีรายการบนลีดเดอร์บอร์ดอิสระ และไม่มีตัวเลขปริมาณงานเลยแม้แต่ตัวเดียว ชื่อล้วน ๆ ของมันกับชื่ออัลฟาของมันเป็นโมเดลเดียวกัน ทุกอย่างอื่นเกี่ยวกับมันเป็นสแนปช็อตของรายการที่ประทับวันที่ และหน้านี้คือจุดที่ใช้ตรวจสอบว่าสแนปช็อตใดเป็นปัจจุบัน

