การ์ดชื่อเรื่องแบบฮีโร่สำหรับ 'Mercury 2.5 Preview vs Grok 4.6' พร้อมคำบรรยายว่า 'พรีวิว 1,107 โทเคน/วินาที จะตัดราคาแชมป์ความคุ้มค่าได้หรือไม่?' โดยแสดงชิปสายฟ้าแลบที่ป้ายระบุ '1,107 tok/s' ชิปตราชั่งที่ป้ายระบุ 'ราคา vs ความเร็ว' ชิปถ้วยรางวัลที่ป้ายระบุ 'AA #3' และโลโก้ OrcaRouter ที่มุมขวาล่าง
Guides & Insights

Mercury 2.5 Preview ปะทะ Grok 4.6: พรีวิวความเร็ว 1,107 โทเคน/วินาที จะตัดราคาแชมป์ความคุ้มค่าได้หรือไม่?

ผู้เขียน

Alistair Wren

วันที่เผยแพร่

โมเดลล่าสุด · 20ดูโมเดลทั้งหมด
เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
กลับไปยังโพสต์ทั้งหมด

นี่คือคำตอบในหนึ่งประโยค: Mercury 2.5 Preview เป็นโมเดล reasoning ที่น่าเชื่อถือที่สุดที่ถูกที่สุดในการใช้งานจริงในตอนนี้ที่ $0.04 / $0.15 ต่อล้านโทเค็น และ Grok 4.6 เป็นโมเดลที่ถูกที่สุดที่ขอบเขตของ intelligence frontier ที่ $2.00 / $6.00 — ดังนั้นคำถามเชิงปฏิบัติระหว่างทั้งคู่ก็คือ โมเดล diffusion แบบ preview ที่ Inception อ้างว่า "เทียบเท่า" กับ GPT-5.6 Luna (Low) และ Claude Haiku 4.5 เท่านั้น จะทำงานที่คุณต้องจ่ายในระดับ frontier ได้หรือไม่ Mercury 2.5 Preview เปิดตัวเมื่อวันที่ 31 สิงหาคม 2026 สร้างโทเค็นแบบขนาน และอ้างว่า 1,107 โทเค็นต่อวินาทีบน GPU มาตรฐาน; Grok 4.6 เรือธงระดับ frontier เปิดตัวเมื่อวันที่ 12 สิงหาคม 2026 ได้คะแนน 61 ใน Artificial Analysis Intelligence Index เสมอกับอันดับ 3 ของโลก และทำได้ในราคาที่ frontier ไม่เคยเห็นมาก่อน การชนกันครั้งนี้ — การอ้างความเร็วสูงสุดที่ปลายล่างของเส้นราคา พบกับคุณค่าที่ดีที่สุดที่ปลายบน — คือสิ่งที่บทความนี้พูดถึง

ประเด็นสำคัญ

• Grok 4.6 ในราคา $2.00 / $6.00 พร้อมค่า AA Intelligence Index ที่ 61 คือแชมป์ความคุ้มค่าแห่งกลุ่มระดับแนวหน้า ส่วน Mercury 2.5 Preview ในราคา $0.04 / $0.15 คือการเดิมพันว่าคุณภาพแบบ "ดีพอใช้" ในราคาเพียง 1/50 จะเอาชนะคุณภาพระดับแนวหน้าที่คุณแทบไม่ต้องใช้

การอ้างสิทธิ์ด้านความเร็วและคุณภาพของ Mercury 2.5 Preview เป็นของ Inception ทั้งสิ้น ไม่มีคะแนนเกณฑ์มาตรฐานอิสระใดๆ ปรากฏอยู่ในวันแรก

• ส่วนลดเปิดตัว 80% สำหรับ Mercury 2.5 Preview จะสิ้นสุดในวันที่ 8 กันยายน 2026 หลังจากนั้นราคาป้ายจะอยู่ที่ $0.20 / $0.75 — ซึ่งยังถูกกว่า Grok 4.6 ถึง 10 เท่าในด้าน input แต่เป็นเรื่องที่เล็กกว่า

• Grok 4.6 ถูกกำหนดเส้นทางบน OrcaRouter ในวันนี้ที่ราคาตามรายการ; Mercury 2.5 Preview ยังไม่ได้ถูกกำหนดเส้นทาง และให้บริการผ่าน API ของ Inception เองและแพลตฟอร์มบุคคลที่สามหลายแห่ง

กระดานคะแนน

A two-column scoreboard titled 'Mercury 2.5 Preview vs Grok 4.6 — the scoreboard': left column Mercury 2.5 Preview — Intelligence claimed cheap-tier parity, Price $0.04/$0.15 (80% off), Speed 1,107 tok/s (claimed), Context 260K, Agentic no public scores, Weights closed; right column Grok 4.6 — Intelligence AA Index 61 (#3), Price $2.00/$6.00, Speed not a headline spec, Context 500K, Agentic APEX-Agents 57.5, Weights closed; footer 'Mercury figures vendor-reported, unreproduced; Grok per xAI and Artificial Analysis'.

ความฉลาด — Mercury 2.5 Preview: ยังไม่มีดัชนีอิสระ; Inception อ้างว่ามีความทัดเทียมกับระดับที่ปรับต้นทุนให้เหมาะสม Grok 4.6: AA Intelligence Index ได้ 61 เสมออันดับ #3 ของโลก (อ้างอิงจาก Artificial Analysis; ตัวเลขของห้องแล็บเองเป็นการรายงานโดยผู้ผลิต)

ราคา — Mercury 2.5 Preview: $0.04 / $0.15 ต่อ 1M (ลด 80% จาก $0.20 / $0.75 จนถึงวันที่ 8 กันยายน 2026). Grok 4.6: $2.00 / $6.00 ต่อ 1M เพิ่มขึ้นสองเท่าเป็น $4.00 / $12.00 สำหรับพรอมต์ที่มีโทเคนตั้งแต่ 200K ขึ้นไป

ความเร็ว — Mercury 2.5 Preview: อ้างอัตรา 1,107 tokens/วินาที ตามที่ผู้ให้บริการรายงาน Grok 4.6: ความเร็วไม่ใช่สเปกหลักที่ถูกกล่าวถึง โมเดลนี้สร้างมาสำหรับการรันแบบ agentic ระยะยาว ไม่ใช่การสตรีมที่รวดเร็ว

บริบท — Mercury 2.5 พรีวิว: 260K. Grok 4.6: 500K.

งานแบบเอเจนต์​ — Mercury 2.5 Preview: ไม่มีคะแนนสาธารณะ แม้ว่าจะรองรับการเรียกใช้เครื่องมือแบบขนานก็ตาม Grok 4.6: APEX-Agents 57.5, DeepSWE v1.1 65.9, CursorBench v3.2 69.9 (รายงานโดยผู้ผลิต ยังไม่มีการทำซ้ำผลลัพธ์เป็นส่วนใหญ่)

น้ำหนัก — Mercury 2.5 Preview: ปิดและเป็นกรรมสิทธิ์. Grok 4.6: ปิดและเป็นกรรมสิทธิ์.

แชมป์ความคุ้มค่าและการข้ามราคา

ตำแหน่งของ Grok 4.6 นั้นผิดปกติ มันตรงกับอันดับความฉลาด #3 ในดัชนี Artificial Analysis — เสมอกับ GPT-5.6 Sol Max — ในขณะที่ราคาถูกกว่าโมเดลทุกรุ่นที่อยู่ภายในสิบจุดของมัน และการรายงานข่าวการเปิดตัวเน้นย้ำถึงการทำงานแบบ agentic ที่ยาวนานซึ่งจบลงด้วยค่าเฉลี่ยประมาณ $0.84 ต่องานในการประเมินผลที่ดำเนินการโดยผู้ขายรายหนึ่ง นั่นคือนิยามของแชมป์ด้านคุณค่า: ความสามารถใกล้เคียงโมเดลแนวหน้าในราคาที่ทำให้ต้นทุนต่องานเห็นชัดเจนในสเปรดชีต Mercury 2.5 Preview ไม่ได้พยายามจะเป็นแบบนั้น Inception วางตำแหน่งให้มันแข่งกับโมเดลอย่าง GPT-5.6 Luna (Low), Gemini 3.5 Flash-Lite และ Claude Haiku 4.5 — ระดับที่ปรับต้นทุนให้เหมาะสม ไม่ใช่ระดับแนวหน้า หาก Inception พูดถูก Mercury 2.5 Preview ก็เป็นโมเดลที่ต่ำกว่า Grok 4.6 หนึ่งระดับในด้านความสามารถ และต่ำกว่าหลายระดับในด้านราคา ซึ่งเป็นผลิตภัณฑ์ที่สอดคล้องกันอย่างสมบูรณ์: การข้ามระดับราคาสำหรับงานที่ระดับแนวหน้าสิ้นเปลืองโดยเปล่าประโยชน์

การถอดรหัสแบบขนานเปลี่ยนแปลงอะไรจริงๆ

สถาปัตยกรรมคือส่วนที่ควรทำความเข้าใจ เพราะมันเปลี่ยนความหมายของคำว่า "เร็ว" โมเดลออโตรีเกรสซีฟจะปล่อยโทเคนทีละตัวต่อขั้นตอน ดังนั้นปริมาณงานจึงถูกจำกัดด้วยความหน่วงแบบลำดับ ขณะที่ diffusion LLM อย่าง Mercury 2.5 Preview จะสร้างบล็อกของโทเคนพร้อมกันและปรับปรุงมันผ่านขั้นตอนการลดสัญญาณรบกวน (denoising) ซึ่งทำให้ปริมาณงานไม่ผูกกับจำนวนโทเคนที่ผลิตได้ นั่นคือเหตุผลที่ Inception สามารถอ้างอัตรา 1,107 โทเคนต่อวินาทีบน GPU มาตรฐาน — ไม่ต้องใช้ตัวเร่งพิเศษ ไม่มีเทคนิคการจัดกลุ่ม (batching) — และเหตุผลที่ข้อเรียกร้องผลิตภัณฑ์จริงคือเวลาไปถึงโทเคนแรกต่ำกว่า 300 มิลลิวินาทีสำหรับภาระงานแบบโต้ตอบ สำหรับเอเจนต์เสียง ไพพ์ไลน์ค้นหา หรือซับเอเจนต์เขียนโค้ดที่เรียกใช้โมเดลทุกครั้งที่มีการโต้ตอบ ความแตกต่างของความหน่วงนี่แหละคือตัวผลิตภัณฑ์: มันคือความแตกต่างระหว่างลูปเสียงที่ให้ความรู้สึกสดจริงกับลูปที่หยุดชะงัก ข้อแม้คือ diffusion language models เป็นงานวิจัยที่เพิ่งเริ่มต้น ตัวเลข 1,107 เป็นข้อมูลของ Inception และไม่มีห้องปฏิบัติการอิสระใดที่ทำซ้ำความเร็วดังกล่าวหรือวัดการเบี่ยงเบนคุณภาพ ถ้ามี ที่การสร้างแบบขนานนำเข้ามาบนพรอมป์ต์ที่ยาวหรือเป็นปฏิปักษ์

ที่ Grok 4.6 ยังคงทำงานนี้ได้ดีที่สุด

ไม่มีอะไรเกี่ยวกับ Mercury 2.5 Preview ที่ไปแตะส่วนตลาดที่ Grok 4.6 กำลังชนะอยู่จริง การที่ Grok ทำคะแนนได้ดีขึ้นเมื่อเทียบกับ Grok 4.5 กระจุกตัวอยู่ที่เกณฑ์ชี้วัดด้านเอเจนต์และการเขียนโค้ด — DeepSWE เพิ่มขึ้น 11.9 จุด, APEX-Agents เพิ่มขึ้น 10.4 จุด, Terminal-Bench เพิ่มขึ้น 10.3 จุด — และหน้าต่างบริบท 500K ของมันมีไว้สำหรับเอเจนต์ที่ทำงานระยะยาวซึ่งจำเป็นต้องเก็บงานทั้งหมดไว้ในบริบท Mercury 2.5 Preview มีการเรียกใช้เครื่องมือแบบขนาน แต่โมเดลที่ไม่มีคะแนนด้านเอเจนต์ที่ประเมินอย่างอิสระ มีเพดานเอาต์พุต 65,536 โทเคน และบริบท 260K ก็ไม่ใช่เครื่องมือสำหรับงานวิศวกรรมซอฟต์แวร์ที่ยาวถึง 50 ขั้นตอน โมเดลทั้งสองแทบไม่ทับซ้อนกันในด้านการใช้งาน: Grok 4.6 คือเอนจินสำหรับงานที่ต้องทำให้เสร็จจริง ส่วน Mercury 2.5 Preview คือเอนจินสำหรับงานที่ต้องให้ความรู้สึกฉับไวและแทบไม่มีต้นทุนในแต่ละครั้งที่เรียกใช้

ช่วงเวลาที่มีส่วนลด 80%

ราคาตรงนี้มีวันหมดอายุ และมันเปลี่ยนการตัดสินใจ อัตรา $0.04 / $0.15 ของ Mercury 2.5 Preview คือส่วนลด 80% จากราคาปกติ $0.20 / $0.75 และ Inception ระบุว่าโปรโมชันนี้ใช้ได้ถึงวันที่ 8 กันยายน 2026 ราคา $2.00 / $6.00 ของ Grok 4.6 เป็นราคาปกติที่คงที่และมีโครงสร้างที่ชัดเจน — อินพุตแบบแคชที่ $0.50 ระดับความสำคัญที่ 2× และการเพิ่มขั้นเมื่อพรอมป์ยาวถึง 200K โทเคน ซึ่งจะคิดอัตราที่สูงกว่าสำหรับทั้งคำขอ หากคุณเปรียบเทียบตัวเลขในวันนี้ Mercury ดูจะถูกกว่า 50 เท่าในอินพุตและ 40 เท่าในเอาต์พุต แต่ถ้าส่วนลดหมดอายุตามกำหนด ช่องว่างที่แท้จริงในระยะยาวคือ 10 เท่าในอินพุตและ 5 เท่าในเอาต์พุต การนำเสนอทั้งสองแบบไม่ใช่การหลอกลวง — มันเป็นเพียงขอบเขตเวลาที่ต่างกัน และไปป์ไลน์ที่ตั้งราคาตามส่วนลดโดยไม่มีจุดทบทวนราคาคือไปป์ไลน์ที่จะต้องประหลาดใจในวันที่ 9 กันยายน ราคา $2.00 / $6.00 ของ Grok 4.6 คือสิ่งที่คุณจ่ายบน OrcaRouter พอดี โดยที่ราคาปกติของผู้ให้บริการส่งผ่านโดยมีมาร์กอัป 0% — เมื่อผู้ให้บริการเปลี่ยนตัวเลข ราคาจะอัปเดตสดบนคีย์เดียวกันในวันเดียวกัน พร้อมการเฟลโอเวอร์อัตโนมัติหากเส้นทางของผู้ให้บริการรายหนึ่งถูกจำกัดอัตรา

คำตัดสินหนึ่งบรรทัด

หากงานต้องทำให้เสร็จและคุณต้องการความสามารถระดับแนวหน้าในราคาที่ดีที่สุดในระดับเดียวกัน ให้ซื้อ Grok 4.6 — นี่คือแชมป์ความคุ้มค่าที่ได้รับการพิสูจน์แล้ว ใช้งานจริงบน OrcaRouter วันนี้ในราคา $2.00 / $6.00 หากงานคือการให้เหตุผลบนข้อความปริมาณมากที่ไวต่อความหน่วง ซึ่งคำตอบระดับพอใช้ได้นั้นตรวจสอบได้ไม่แพง Mercury 2.5 Preview ที่ราคา $0.04 / $0.15 คือการข้ามชั้นราคาที่น่าลองภายในช่วงส่วนลด — แค่อย่าลืมว่าทุกคำกล่าวอ้างในฝั่งนั้นเป็นของ Inception และหลักฐานยังคงค้างอยู่

A screenshot of the Inception documentation page 'Models, Endpoints, and Pricing' (captured September 1, 2026), showing the Mercury family pricing table — Mercury 2 and Mercury Edit 2 both at $0.25 input / $0.025 cached / $0.75 output per 1M tokens — and a cURL chat-completions API example.A screenshot of the OrcaRouter model page for Grok 4.6 (grok/grok-4.6), showing the model header, the '$2.00' price badge, and the model description noting the August 12, 2026 release.

OrcaRouter ส่งผ่านราคาตามรายการของผู้ให้บริการด้วยมาร์กอัป 0% พร้อม failover อัตโนมัติ การเปลี่ยนแปลงราคาของผู้ขายจึงมีผลกับคีย์เดียวกันในวันเดียวกัน

การเปรียบเทียบในบทความนี้1

ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน

© 2026 OrcaRouter

สำหรับผู้ให้บริการ

ให้บริการแพลตฟอร์มการอนุมานอยู่หรือไม่ นำโมเดลของคุณขึ้น OrcaRouter

providers@orcarouter.ai

เข้าร่วมคอมมูนิตี้ของเรา

Discordsupport@orcarouter.aiXGitHubYouTube