สร้างการ์ดฮีโร่ชื่อเรื่อง Claude Sonnet 5.5 vs Tencent HY4 Preview คำโปรย: ทั้งสองแล็บต่างขายบิลค่าโทเคน พร้อมการ์ดสถิติสามใบ: ราคาเอาต์พุตต่อ 1M $10.00 vs $2.50, น้ำหนักโมเดลแบบปิด vs Apache 2.0 และความเร็วเอาต์พุตที่วัดได้ 138.7 vs 22.3 โทเคนต่อวินาที โดยมีส่วนท้ายระบุว่า ราคาและความเร็วของ Tencent HY4 Preview อ้างอิงตามแค็ตตาล็อกของ OrcaRouter รายการผู้ขาย 6 / 18 หยวนต่อล้าน; Claude Sonnet 5.5 ตามข้อมูลของ Anthropic
Guides & Insights

Claude Sonnet 5.5 กับ Tencent HY4 Preview: ทั้งสองแล็บต่างก็ขายบิลค่าโทเคน

ผู้เขียน

Rowan Sterling

วันที่เผยแพร่

โมเดลล่าสุด · 20ดูโมเดลทั้งหมด →
เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
กลับไปยังโพสต์ทั้งหมด

การเปิดตัวสองครั้ง ห่างกันหกสัปดาห์ ให้สัญญาเดียวกันด้วยถ้อยคำที่ต่างออกไป คำกล่าวอ้างของผู้ขายคือ Claude Sonnet 5.5 ซึ่งวางจำหน่ายเมื่อวันที่ 28 กันยายน 2026 มีต้นทุน "ต่ำลงถึง 30% ต่องาน" เมื่อเทียบกับ Claude Sonnet 5 โดยอัตราต่อโทเคนไม่เปลี่ยนแปลง คำกล่าวอ้างที่สองคือ การปรับปรุงเมื่อวันที่ 7 กันยายน ที่ทำกับบิลด์โฮสต์ของ Tencent HY4 Preview ซึ่งเปิดตัวครั้งแรกและเปิดซอร์สเมื่อวันที่ 28 สิงหาคม 2026 ช่วยลดรอบการให้เหตุผลและปริมาณโทเคนต่องาน โดยที่คุณภาพงานยังเท่าเดิม ไม่มีผู้ขายรายใดขึ้นหรือลดราคาเพื่อกล่าวอ้างเช่นนั้น ทั้งสองรายกำลังบอกคุณว่าโทเคนคือตัวผลิตภัณฑ์ในตอนนี้ และส่วนที่น่าสนใจของการจับคู่นี้ก็คือ มีเพียงหนึ่งในสองข้อกล่าวอ้างเท่านั้นที่ตรวจสอบเทียบกับตัวเลขต่องานที่เผยแพร่ได้ เพราะมีเพียงหนึ่งในสองโมเดลนี้เท่านั้นที่มีการวัดผลอิสระให้ตรวจสอบเทียบ

ความไม่สมมาตรนั้นไม่ใช่การตำหนิ T​encent HY4 Preview ไม่มีหน้าของโมเดลใน Artificial Analysis ไม่มีคะแนน Intelligence Index ที่เป็นอิสระ และไม่มีตัวเลขค่าใช้จ่ายต่องานจากบุคคลที่สามรายใด สิ่งที่มันมีคือตารางเบนช์มาร์กจากผู้ขาย — Terminal-Bench 2.1 ที่ 85.4, DeepSWE 64.3, การประเมินแบบปิดตาภายในองค์กรครอบคลุมงานวิศวกรรม 203 งาน ซึ่งได้ค่าเฉลี่ย 2.99 เทียบกับ GLM-5.3 ที่ 2.92 และ Kimi K3 ที่ 2.94 — และการเปิดตัวบนกระดานผู้นำ WebDev Arena ที่มาจากการโหวตของฝูงชนสาธารณะ ซึ่ง T​encent รายงานว่าอยู่ในอันดับประมาณห้าโดยรวม และอันดับสามในกลุ่มโมเดลน้ำหนักเปิด ทั้งหมดนั้นเป็นสัญญาณจริงทั้งสิ้น ไม่มีสัญญาณใดที่เป็นค่าใช้จ่ายต่องาน ซึ่งหมายความว่าตัวเลขที่แน่นอนที่ผู้ขายทั้งสองรายกำลังแข่งขันกันนั้น สำหรับ HY4 Preview แล้ว ไม่มีให้ใช้

สิ่งที่แต่ละฝ่ายส่งมอบจริง

Tencent HY4 Preview เป็นโมเดล Mixture of Experts ขนาด 770 พันล้านพารามิเตอร์ ที่เปิดใช้งาน 49 พันล้านพารามิเตอร์ต่อโทเคน มี 78 เลเยอร์, routed expert 256 ตัว บวก shared expert 1 ตัว, เลเยอร์ MTP แบบเนทีฟสำหรับ speculative decoding และหน้าต่างบริบทที่ทะลุ 1 ล้านโทเคน โดยการออกแบบแล้วรองรับเฉพาะข้อความ — Tencent สร้างมันขึ้นมาสำหรับเอเจนต์เขียนโค้ด การใช้เครื่องมือที่ซับซ้อน และงานด้านประสิทธิภาพการทำงาน ไม่ใช่สำหรับรูปภาพ — และค่าเริ่มต้นจะใช้การให้เหตุผลแบบหนัก โดยมีสามระดับที่กำหนดค่าได้ (สูง, ต่ำ, ไม่ใช้) และการตั้งค่าการสุ่มตัวอย่างที่ผู้ขายแนะนำคือ temperature 0.9 และ top_p 1.0 เวตของโมเดลอยู่ภายใต้ Apache 2.0 และดาวน์โหลดได้จาก Hugging Face, GitHub, ModelScope และ GitCode เดิมที Tencent ระบุจุดที่ยังไม่เรียบร้อยสองจุดในพรีวิว ได้แก่ การใช้เวลาคิดนานเกินความจำเป็น และการตรวจสอบงานของตัวเองมากเกินไป และอัปเดตวันที่ 7 กันยายนได้มุ่งเป้าไปที่จุดเหล่านี้โดยตรง

Claude Sonnet 5.5 เป็นโมเดลรุ่นที่สองในเจเนอเรชัน 5.5 ของ Anthropic และเป็นรุ่นที่บริษัทวางตำแหน่งว่าเป็นการผสมผสานที่ดีที่สุดระหว่างความเร็วและความฉลาดในไลน์อัปนี้ มีบริบทหนึ่งล้านโทเคน เอาต์พุต 128,000 โทเคนแบบซิงโครนัส และ 300,000 โทเคนบน Message Batches API รองรับอินพุตข้อความ รูปภาพ และไฟล์ มี adaptive thinking ที่เลือกระดับความพยายามได้ มีจุดตัดองค์ความรู้เดือนมิถุนายน 2026 มี zero data retention ให้ใช้ตั้งแต่เปิดตัว และมีกำหนดการปลดระวางขั้นต่ำเป็นวันที่ 28 กันยายน 2027 อัตราค่าบริการไม่เปลี่ยนแปลงจาก Claude Sonnet 5: 2.00 ดอลลาร์ต่ออินพุตหนึ่งล้านโทเคน, 10.00 ดอลลาร์ต่อเอาต์พุตหนึ่งล้านโทเคน, 0.20 ดอลลาร์สำหรับการอ่านแคช และ 2.50 ดอลลาร์สำหรับการเขียนแคช โมเดลแบบปิดน้ำหนัก ใช้ได้ผ่าน Anthropic API พร้อมกับ Bedrock, Google Cloud และ Microsoft Foundry

จับสองสิ่งนี้มาเทียบกัน แล้วตำแหน่งก็เกือบสมมาตรกัน:

• ราคา — Claude Sonnet 5.5 $2.00 ขาเข้า / $10.00 ขาออก ต่อล้าน เทียบกับ Tencent HY4 Preview $0.83 ขาเข้า / $2.50 ขาออก ในแคตตาล็อกของเรา จากรายการราคาผู้ขายที่ ¥6 / ¥18

• การอ่านแคช — Claude Sonnet 5.5 $0.20 ต่อล้าน เทียบกับ Tencent HY4 Preview $0.042 ต่อล้าน ในแค็ตตาล็อกของเรา

• ค่าน้ำหนัก — Claude Sonnet 5.5 แบบปิด เทียบกับ Tencent HY4 Preview Apache 2.0 ที่ดาวน์โหลดได้

• บริบท — {{1}}Claude Sonnet 5.5{{/1}} 1,000,000 โทเค็น เทียบกับ Tencent HY4 Preview 1,048,576 โทเค็น แทบจะเหมือนกันทุกประการ

• เอาต์พุตสูงสุด — Claude Sonnet 5.5 128,000 แบบซิงโครนัส, 300,000 บน Batches เทียบกับ Tencent HY4 Preview 64,000 ในแคตตาล็อกของเรา

• รูปแบบอินพุต: {{1}}Claude Sonnet 5.5{{/1}} ข้อความและไฟล์ เทียบกับ {{2}}Tencent Preview{{/2}} ข้อความเท่านั้น

• คะแนนอิสระ — Claude Sonnet 5.5 ดัชนีความฉลาด 56 ที่ราคา 7.60 ดอลลาร์ต่องาน, รุ่นแก้ไข v4.3.2 เทียบกับ Tencent HY4 Preview ไม่มีการเผยแพร่

• ความเร็วเอาต์พุตที่วัดได้ — Claude Sonnet 5.5 138.7 โทเคน/วินาที เทียบกับ Tencent HY4 Preview 22.3 โทเคน/วินาที บนทราฟฟิกของเราเอง

Generated comparison scoreboard titled Claude Sonnet 5.5 vs Tencent HY4 Preview, the scoreboard, with six matched rows: output price $10.00 vs $2.50, cache read $0.20 vs $0.042, context window 1,000,000 vs 1,048,576 tokens, maximum output 128K and 300K on Batches vs 64K, input modality text, image and file vs text only, and weights closed vs Apache 2.0, with a footer reading Tencent HY4 Preview price per OrcaRouter's catalogue, vendor list 6 / 18 yuan per million; no independent scores published. Claude Sonnet 5.5 per Anthropic.

ข้อกล่าวอ้างที่ทั้งสองแล็บกำลังกล่าวอ้าง และเหตุใดหนึ่งในนั้นจึงตรวจสอบได้

นโยบาย "ลด 30% ต่องาน" ของ Anthropic กับ "จำนวนรอบการให้เหตุผลน้อยลง ใช้โทเค็นน้อยลง" ของ Tencent เป็นโครงการทางวิศวกรรมเดียวกันที่ถูกอธิบายจากสองทิศทาง: ทำให้โมเดลใช้โทเค็นน้อยลงเพื่อให้ได้คำตอบเดิม Anthropic ระบุชัดเจนว่าอัตราไม่ได้เปลี่ยน ซึ่งหมายความว่าการประหยัดต่องานใด ๆ ต้องมาจากจำนวนโทเค็น — และบอร์ดอิสระทำให้คุณเห็นรูปร่างของปัญหา มากกว่าขนาดของวิธีแก้ไข Claude Sonnet 5.5 สร้างโทเค็นเอาต์พุต 410 ล้านโทเค็นในการประเมิน Intelligence Index เทียบกับ 117 ล้านสำหรับ MiniMax M3 และ 77 ล้านสำหรับ Grok 4.5 มันเป็นโมเดลที่ใช้คำเยิ่นเย้อ เมื่อวัดบนบอร์ดที่เผยแพร่ตัวเลขนั้น ไม่ว่าการปรับปรุง 30% เมื่อเทียบกับ Claude Sonnet 5 จะคิดเป็นเท่าใด มันก็ถูกนำไปใช้กับฐานที่ใหญ่มาก

สำหรับ HY4 Preview ตัวเลขที่เทียบเท่าไม่ได้เปิดเผยต่อสาธารณะ บันทึกการปรับแต่งของ Tencent เองเป็นเพียงบันทึกเดียวที่กล่าวถึงเรื่องนี้ และระบุผลลัพธ์โดยไม่มีตัวเลข: จำนวนรอบน้อยลง, โทเค็นอินพุตและเอาต์พุตต่ำลง, คุณภาพเท่าเดิม, ได้รับการตรวจสอบความถูกต้องด้วยเมตริก benchmark และการประเมินโดยมนุษย์แบบสองรอบ นั่นคือคำกล่าวอ้างของผู้ขายในความหมายที่เคร่งครัด — ถูกกล่าวอ้าง, ดูน่าเชื่อถือ, ไม่ได้รับการทำซ้ำ — และได้รับการติดป้ายกำกับเช่นนั้นในที่นี้ การนำโมเดลพรีวิวมาใช้โดยอาศัยความน่าเชื่อถือของคำกล่าวอ้างเรื่องเศรษฐกิจโทเค็นของผู้ขาย ในเมื่อเศรษฐกิจโทเค็นคือสิ่งที่คุณไม่สามารถวัดจากภายนอกได้ นั่นคือการเดิมพันที่การเปิดตัวพรีวิวกำลังขอให้คุณทำอย่างแม่นยำ

ยังมีข้อน่ารู้เพิ่มเติมอีกประการหนึ่งที่ควรทราบก่อนที่ใครจะวางแผนการติดตั้งแบบโฮสต์เองโดยอิงจากการปรับให้เหมาะสมนั้น การเปลี่ยนแปลงของ Tencent เมื่อวันที่ 7 กันยายนใช้กับบิลด์ที่ Tencent ให้บริการบนเอนด์พอยต์ที่โฮสต์เองของตน สแนปช็อตแบบน้ำหนักเปิดยังไม่ได้รับการรีเฟรช — วันที่แก้ไขล่าสุดของที่เก็บ Hugging Face ยังคงเป็นวันที่ 28 สิงหาคม — ดังนั้นสำเนาน้ำหนักที่โฮสต์เองจะรันพฤติกรรมการให้เหตุผลที่ยาวนานแบบดั้งเดิมซึ่งบันทึกตัวอย่างก่อนหน้าได้ระบุไว้ เวอร์ชันที่ปรับให้เหมาะสมและเวอร์ชันที่ดาวน์โหลดได้ไม่ใช่ชิ้นงานเดียวกัน

จุดที่โมเดลน้ำหนักเปิดให้ผลตอบแทนคุ้มค่าก็คือที่เดียวกับที่มันเคยเป็นเสมอ: การติดตั้งใช้งานที่ไม่สามารถเรียก API ได้ โมเดลขนาด 770B พารามิเตอร์ที่มีพารามิเตอร์ใช้งานจริง 49B เป็นการตัดสินใจระดับดาต้าเซ็นเตอร์มากกว่าระดับเวิร์กสเตชัน ดังนั้นนี่จึงไม่ใช่เรื่องราวระดับแล็ปท็อปแบบที่โมเดล 30B เล่า แต่สำหรับผู้ซื้อที่ต้องการให้โมเดลอยู่ภายในขอบเขตของตนเอง Apache 2.0 ในขนาดนั้นถือเป็นทางเลือกที่ Claude Sonnet 5.5 ไม่มีให้ในราคาใด ๆ

ลองใช้พรีวิวโดยไม่ต้องเอาเส้นทางโปรดักชันมาเดิมพันกับมัน

โมเดลพรีวิวคือกรณีที่การจัดเส้นทางเลิกเป็นเพียงการปรับต้นทุนให้เหมาะสม และกลายเป็นการควบคุมความเสี่ยง เหตุผลที่ต้องวางบิลด์พรีวิวไว้หลังเราเตอร์แทนที่จะเรียกใช้งานโดยตรงก็คือ พรีวิวถูกนิยามด้วยความเป็นไปได้ที่จะเปลี่ยนแปลงไปในขณะที่คุณใช้งานมันอยู่ และสองสิ่งที่คุณต้องการจากเลเยอร์ที่อยู่ข้างหน้ามันคือการแบ่งสัดส่วนเป็นเปอร์เซ็นต์ กับกลไกบางอย่างสำหรับจับความล้มเหลว

นี่คือรูปแบบที่ OrcaRouter มอบให้: ปลายทางที่เข้ากันได้กับ OpenAI เพียงจุดเดียว ครอบคลุมโมเดลกว่า 200 รายการ ส่งต่อราคาตามที่ผู้ให้บริการระบุโดยไม่บวกเพิ่ม การสลับไปใช้ผู้ให้บริการต้นทางรายอื่นโดยอัตโนมัติเมื่อเกิดปัญหา และ DSL สำหรับกำหนดเส้นทางเพื่อประกอบการเรียกใช้งานจากหลายโมเดลเข้าด้วยกัน Tencent HY4 Preview สามารถกำหนดเส้นทางได้ที่นี่แล้ววันนี้ในชื่อ tencent/hy4-preview ในราคา $0.83 สำหรับอินพุต และ $2.50 สำหรับเอาต์พุตต่อล้านโทเค็น พร้อมการอ่านแคชที่ $0.042 ครอบคลุมหน้าต่าง 1,048,576 โทเค็น — เป็นบิลด์เดียวกัน ในอัตราของผู้ให้บริการ เข้าถึงได้ด้วยคีย์ที่คุณใช้อยู่แล้วสำหรับทุกอย่างอื่นในแคตตาล็อก Claude Sonnet 5 ก็กำหนดเส้นทางได้ที่นี่เช่นกัน ในราคา $2.00 และ $10.00 ของ Anthropic และเป็นเช่นนี้มาตั้งแต่วันที่ 30 มิถุนายน จึงเป็นคู่หูสำหรับ failover ที่ชัดเจนระหว่างที่โมเดลอายุหนึ่งวันกำลังสะสมหลักฐานจากการใช้งานจริง

OrcaRouter model page for tencent/hy4-preview, dated 2026-08-28, showing the Tools, JSON and Reasoning badges, a 1M-token context window, text-only input, $0.83 input and $2.50 output per million tokens, a p50 time to first token of 3.71 s, and 372.4K tokens of recent traffic.

Claude Sonnet 5.5 เองไม่ได้อยู่ในแค็ตตาล็อกของเรา มันเพิ่งเปิดตัวเมื่อวานนี้ เส้นทางไปสู่มันคือ API ของ Anthropic เอง และหน้านี้จะไม่เสนอเป็นอย่างอื่น — ประเด็นของคำแนะนำเรื่องการจัดเส้นทางคือ วิธีที่ปลอดภัยในการรันระดับใหม่เอี่ยมในโปรดักชันคือให้มันรับทราฟฟิกเพียงเสี้ยวหนึ่ง โดยมีบางสิ่งที่พิสูจน์แล้วหนุนอยู่ข้างหลัง และนั่นจะได้ผลก็ต่อเมื่อปลายทั้งสองข้างของข้อตกลงนั้นอยู่ที่ใดที่หนึ่งซึ่งคุณเข้าถึงได้จากจุดเดียว HY4 Preview กำลังรับทราฟฟิก 372,000 โทเคนต่อสัปดาห์ที่นี่ ซึ่งเป็นหน้าตาของพรีวิวอายุสองวันก่อนที่ใครจะผูกมัดกับมัน ส่วน Claude Sonnet 5 รับอยู่ 7.9 ล้านต่อสัปดาห์ตั้งแต่ 30 มิถุนายน และนั่นคือความแตกต่างระหว่างผู้ท้าชิงกับฐานราก

OrcaRouter model page for anthropic/claude-sonnet-5, dated 2026-06-30, showing a 1M-token context window, 128K maximum output, text, image and file input, $2.00 input and $10.00 output per million tokens, a p50 time to first token of 4.87 s, and 7.9M tokens of recent traffic.

เงินไปไหนจริง ๆ

หากพิจารณาเฉพาะอัตราราคา HY4 Preview ถูกกว่า Claude Sonnet 5.5 ถึงสี่เท่าในด้านเอาต์พุต และถูกกว่าเกือบห้าเท่าในด้านการอ่านแคช อีกทั้งยังมีขนาดหน้าต่างที่เท่ากัน ในด้านที่วัดได้จริง Claude Sonnet 5.5 สร้างเอาต์พุตได้เร็วกว่าถึงหกเท่าบนทราฟฟิกของเราเอง — 138.7 โทเค็นต่อวินาที เทียบกับ 22.3 — ซึ่งเป็นช่องว่างแบบที่เปลี่ยนข้อได้เปรียบด้านราคาสี่เท่าให้กลายเป็นข้อได้เปรียบด้านเวลาจริงที่เล็กลงมาก และบางครั้งก็กลายเป็นความเสียเปรียบ เมื่อนำการเข้าคิวมาพิจารณา

ระหว่างข้อเท็จจริงสองข้อนั้น การตัดสินใจขึ้นอยู่กับคำถามสี่ข้อที่ผู้อ่านเท่านั้นที่ตอบได้ งานนี้ต้องการรูปภาพหรือไฟล์ในพรอมป์ต์หรือไม่ HY4 Preview เป็นข้อความเท่านั้น และนั่นก็จบการถกเถียง งานนี้จำเป็นต้องทำงานซอฟต์แวร์หลายขั้นตอนให้สำเร็จหรือไม่ โดยที่คะแนน Terminal-Bench 2.1 ของ HY4 Preview ที่ 85.4 เป็นตัวเลขของ Tencent เองและยังไม่มีการทำซ้ำ ถ้าเช่นนั้น สถานะพรีวิวคือความเสี่ยงที่คุณกำลังยอมรับ และการปรับปรุงประสิทธิภาพเมื่อวันที่ 7 กันยายนนั้นควรค่าแก่การทดสอบซ้ำมากกว่าที่จะเชื่อถือ ภาระงานนี้ต้องรันภายในขอบเขตของคุณเองหรือไม่ ถ้าเช่นนั้น การเปิดเผยเวทภายใต้ Apache 2.0 เป็นข้อเท็จจริงที่ชี้ขาด และระดับความสามารถแบบผสมสำคัญกว่าอัตราหรือไม่ ถ้าเช่นนั้น ตัวเลข 56 ที่วัดอย่างอิสระของ Claude Sonnet 5.5 คือตัวเลขที่ต้องนำมาชั่งน้ำหนัก ที่ราคา $7.60 ต่อ Index task โดยมีข้อแม้ว่าไม่มีตัวเลขเทียบเคียงในฝั่ง Tencent ให้เปรียบเทียบด้วย

สิ่งที่การเปิดตัวทั้งสองครั้งแสดงให้เห็นจริง ๆ ก็คือ แนวหน้าความล้ำสมัยได้ก้าวข้ามเรตการ์ดไปแล้ว สองแล็บ ห่างกันหกสัปดาห์ เปิดตัวโมเดลและนำเสนอด้วยการใช้โทเค็นต่องาน มากกว่าราคาต่อล้าน และผลในทางปฏิบัติสำหรับผู้ซื้อก็คือ ตัวเลขที่มีประโยชน์ไม่ได้อยู่บนหน้าหน้าราคาของผู้ขายรายใดอีกต่อไป มันคือจำนวนโทเค็นที่เวิร์กโหลดของคุณเองสร้างขึ้น เมื่อวัดกับทั้งสองโมเดล และเป็นตัวเลขเดียวในบทความนี้ที่ผู้ขายทั้งสองรายให้คุณไม่ได้

การเปรียบเทียบในบทความนี้1

ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน

© 2026 OrcaRouter

สำหรับผู้ให้บริการ

ให้บริการแพลตฟอร์มการอนุมานอยู่หรือไม่ นำโมเดลของคุณขึ้น OrcaRouter

providers@orcarouter.ai

เข้าร่วมคอมมูนิตี้ของเรา

Discordsupport@orcarouter.aiXGitHubYouTube