การ์ดฮีโร่ที่สร้างขึ้นสำหรับ 'หนึ่งในสิบของอัตราไม่เท่ากับหนึ่งในสิบของบิล' พร้อมป้าย 'ช่องว่างระหว่างเจเนอเรชัน' และคำโปรย 'สองโมเดล Haiku ห่างกันสิบเอ็ดเดือน' กับคำบรรยายย่อย 'Claude Haiku 5.5 เทียบกับ Claude Haiku 4.5 ในด้านราคา โทเคน และขั้น 100,000 โทเคนแบบใหม่' ชิปสี่อันอ่านว่า '$0.10 / $0.50', '$1.00 / $5.00', 'บริบท 1M' และ 'โทเคนมากขึ้น 30%' การ์ดสองใบด้านล่างมีป้ายกำกับว่า 'สิ่งที่อัตราบอก' ('อินพุตและเอาต์พุตต่ำลง 90% เมื่อต่ำกว่า 100,000 โทเคน') และ 'สิ่งที่ใบแจ้งหนี้บอก' ('ค่าใช้จ่ายในการรันลดลงราว 75% บนโทเคนที่มากขึ้นราว 30%') ส่วนท้ายระบุว่า 'เอกสารราคาของผู้ขาย ข้อมูล ณ วันที่ 8 ตุลาคม 2026' โลโก้ OrcaRouter ถูกคอมโพสิตไว้ที่มุมขวาล่าง
Guides & Insights

Claude Haiku 5.5 เทียบกับ Claude Haiku 4.5: การลดราคา 90% ไม่ใช่การประหยัด 90%

ผู้เขียน

Gideon Frost

วันที่เผยแพร่

โมเดลล่าสุด · 20ดูโมเดลทั้งหมด →
เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
กลับไปยังโพสต์ทั้งหมด

Claude Haiku 5.5 มีราคาอยู่ที่ $0.10 ต่อ 1 ล้านโทเค็นอินพุต และ $0.50 ต่อ 1 ล้านโทเค็นเอาต์พุต สำหรับพรอมต์ไม่เกิน 100,000 โทเค็น Claude Haiku 4.5 มีค่าใช้จ่าย $1 และ $5 แบบคงที่ สำหรับหน้าต่าง 200,000 โทเค็นทั้งหมดที่มันมีมาตลอด Anthropic ระบุความแตกต่างไว้ว่า "ต่ำลง 90%" ในเชิงอรรถแห่งหนึ่ง และ "รันถูกลงประมาณ 75%" ในประโยคด้านบนนั้น — และช่วงห่างสิบเอ็ดเดือนระหว่างสองโมเดลนี้ก็คือระยะห่างระหว่างตัวเลขสองตัวนั้นพอดี

นั่นไม่ใช่กลลวงทางการตลาด มันคือรูปร่างที่ซื่อตรงของเจเนอเรชันโมเดลที่เปลี่ยนโทเคไนเซอร์ ค่าเริ่มต้นการคิด และหน้าต่างบริบทไปพร้อมกับราคา และมันหมายความว่าใครก็ตามที่สลับ model id แล้วคาดว่าบิลจะลดลงสิบเท่า จะผิดหวังเพราะการคำนวณ มากกว่าจะผิดหวังเพราะตัวผลิตภัณฑ์

ทั้งสองรุ่นตามที่จัดส่ง

ทุกอย่างด้านล่างนี้คิดเป็นต่อ {{1}}หนึ่งล้านโทเคน{{/1}} ในหน่วย{{2}}ดอลลาร์สหรัฐ{{/2}} และอ่านจากเอกสารราคาและเอกสารโมเดลของ Ant​hropic เองเมื่อวันที่ {{3}}2026-10-08{{/3}} เว้นแต่จะระบุไว้เป็นอย่างอื่น

A generated scoreboard titled 'Claude Haiku 5.5 vs Claude Haiku 4.5 - as shipped'. Claude Haiku 5.5 reads input $0.10 under 100K and $0.50 above, output $0.50 and $2.50, cache read $0.01 and $0.05, context 1M tokens, maximum output 128,000 tokens, thinking adaptive with an effort dial. Claude Haiku 4.5 reads input $1.00 flat, output $5.00 flat, cache read $0.10, context 200,000 tokens, maximum output 64,000 tokens, thinking manual with no effort dial. A footer reads 'Vendors' published list rates and model documentation.'

• อินพุต — Claude Haiku 5.5 $0.10 สำหรับไม่เกิน 100,000 โทเคน, $0.50 สำหรับเกินกว่านั้น; Claude Haiku 4.5 $1.00 โดยไม่คำนึงถึงความยาว

• เอาต์พุต — Claude Haiku 5.5 $0.50 สำหรับไม่เกิน 100,000 โทเค็น, $2.50 หากเกินกว่านั้น; Claude Haiku 4.5 $5.00 ไม่จำกัดความยาว

• การอ่านแคช — Claude Haiku 5.5 $0.01 สูงสุด 100,000 โทเค็น และ $0.05 สำหรับส่วนที่เกิน; Claude Haiku 4.5 $0.10. การเขียนแคช — $0.125 และ $0.625 เมื่อเทียบกับ $1.25.

• บริบท — 1 ล้านโทเคน เทียบกับ 200,000 เอาต์พุตสูงสุด — 128,000 โทเคน เทียบกับ 64,000

• การคิด — Claude Haiku 5.5 เป็นแบบปรับตัวและเปิดใช้งานเป็นค่าเริ่มต้น โดยมีตัวปรับระดับความพยายามที่ค่าเริ่มต้นอยู่ที่ปานกลาง; Claude Haiku 4.5 ใช้รูปแบบที่ต้องกำหนดเองแบบเก่าและไม่มีพารามิเตอร์ความพยายามเลย

• คะแนนอิสระ — Artificial Analysis Intelligence Index v4.3.2 จัดอันดับให้ Claude Haiku 5.5 (Max) อยู่ที่ 43.40 เป็นอันดับสองจาก 182 โมเดล และ Claude 4.5 Haiku อยู่ที่ 16.88 เป็นอันดับที่สามสิบจาก 61 — โดยผู้ประเมินระบุว่าคะแนนของ 4.5 นั้นเป็นค่าประมาณ

• ความเร็ว — แหล่งข้อมูลเดียวกันวัดได้ 242 โทเค็นเอาต์พุตต่อวินาทีสำหรับ Claude Haiku 5.5 เทียบกับ 89.7 สำหรับรุ่น 4.5 ซึ่งเป็นจุดเดียวที่โมเดลเก่ายังดูดีอยู่

จุดที่เรื่องราคาเพียงหนึ่งในสิบพังทลายลง

มีสามสิ่งที่กัดกินส่วนที่ถูกตัดออกไป และมีเพียงสิ่งแรกเท่านั้นที่เป็นคำเตือนของ Anth​ropic เอง

ตัวตัดคำ (tokenizer) คือเรื่องใหญ่ Claude Haiku 5.5 ใช้ตัวตัดคำรุ่นใหม่ที่เปิดตัวพร้อมกับ Claude 4.7 และเอกสารของ Anthropic ระบุว่าข้อความเดียวกัน "นับเป็นโทเคนมากกว่าประมาณ 30% เมื่อเทียบกับ Claude Haiku 4.5" คุณไม่ได้จ่ายในอัตราหนึ่งในสิบสำหรับจำนวนโทเคนเท่าเดิม แต่คุณจ่ายในอัตราหนึ่งในสิบสำหรับโทเคนที่มากขึ้นราว 1.3 เท่า คู่มือการย้ายระบบของผู้ให้บริการเองก็จัดเรื่องนี้ไว้เป็นรายการที่สองในเช็กลิสต์ ก่อนการแก้โค้ดใด ๆ ทั้งสิ้น นั่นคือ ให้นับโทเคนของพรอมป์ตของคุณใหม่ แล้วจึงกลับมาพิจารณา max_tokensและประมาณการค่าใช้จ่ายของคุณ

โทเค็นการคิดถูกคิดค่าใช้จ่ายเป็นโทเค็นเอาต์พุต และ Claude Haiku 5.5 คิดโดยค่าเริ่มต้น หน้าข้อมูลการเปิดตัวของ Ant​hropic ระบุชัดเจนว่าโมเดลนี้ "ช่างพูดมาก" ในแบบของตัวเองบนแผนภูมิ และการวัดที่เป็นอิสระสนับสนุนเรื่องนี้อย่างชัดเจนกว่าที่ผู้ขายทำ: ในการประเมิน Intelligence Index นั้น Artificial Analysis บันทึกโทเค็นเอาต์พุต 440 ล้านโทเค็นจาก Claude Haiku 5.5 เทียบกับค่ามัธยฐาน 100 ล้านโทเค็นโดยรวม และระบุว่าโมเดลนี้ช่างพูดมาก อัตราค่าอินพุตที่ถูกไม่ได้ช่วยงานที่มีค่าใช้จ่ายส่วนใหญ่เป็นเอาต์พุต

ขั้น 100,000 โทเคนเป็นขั้นที่สาม เหนือขึ้นไปอัตราคือ $0.50 และ $2.50 — ครึ่งหนึ่งของที่ Claude Haiku 4.5 เรียกเก็บสำหรับคำขอเดียวกัน ซึ่งเป็นข้อเสนอที่ดี และไม่ใช่ข้อเสนอที่ผู้อ่านส่วนใหญ่จะได้อ่านถึง Anthropic กล่าวว่าพรอมป์ที่อยู่ต่ำกว่าเกณฑ์คิดเป็นประมาณ 90% ของคำขอที่ส่งไปยังโมเดล Haiku รุ่นก่อน ซึ่งเป็นตัวเลขที่ทำให้การตัดเกณฑ์นี้พออยู่รอดในฐานะพาดหัวข่าวได้ และยังเป็นสัดส่วนทราฟฟิกของผู้ขายเอง ไม่ใช่ของคุณ

A screenshot of Anthropic's model documentation showing the Claude Haiku 5.5 row in the models table and the published rate card beneath it, with the input, output, cache read and cache write rates and the prompt-length thresholds set out per million tokens.

งานเดียวกันมีค่าใช้จ่ายเท่าใดสำหรับสองโมเดล

ต้นทุนต่องานที่เสร็จสมบูรณ์คือตัวชี้วัดที่ครอบคลุมผลกระทบทั้งสามข้อข้างต้น เพราะมันคิดค่าใช้จ่ายกับโมเดลสำหรับทุกสิ่งที่โมเดลส่งออกมา ไม่ใช่แค่สิ่งที่คุณส่งไป

Artificial Analysis ระบุว่า Claude Haiku 5.5 (5.5) อยู่ที่ $0.21 ต่อจุด Intelligence Index — ตัวเลขที่เผยแพร่ที่อัตราอินพุต $0.10 และอัตราเอาต์พุต $0.50 มันไม่ได้เผยแพร่ต้นทุนต่องานสำหรับรุ่น 4.5 เลย; ไทล์ไม่ทราบค่า เนื่องจากโมเดลไม่เคยถูกทดสอบบน Index ในโหมดการตั้งค่าแบบใช้เหตุผล สิ่งที่หน้าเว็บเผยแพร่คือราคาป้ายดิบที่ $1.00 และ $5.00 และคะแนนที่วัดได้ที่แตกต่างและต่ำกว่า

ดังนั้น การเปรียบเทียบที่ตรงไปตรงมาสำหรับผู้ซื้อจึงไม่ใช่ 10 เท่าในแง่โทเค็น แต่เป็นอะไรที่ใกล้เคียงกับสิ่งนี้มากกว่า: อัตราอินพุตหนึ่งในสิบเมื่อใช้โทเค็นมากขึ้น 30% อัตราเอาต์พุตครึ่งหนึ่งเมื่อคุณข้าม 100K และโมเดลที่ใช้โทเค็นเอาต์พุตต่อคำตอบมากกว่ารุ่นก่อน — เมื่อเทียบกับการกระโดดของความสามารถจาก 16.88 เป็น 43.40 บนบอร์ดอิสระเดียวกัน ตัวเลข 75% ที่ Ant​hropic อ้างสำหรับปริมาณงานทั่วไปคือตัวเลขที่สมเหตุสมผลสำหรับการวางแผน มันยังเป็นค่าประมาณแบบผสมจากผู้ขายบนส่วนผสมทราฟฟิกที่คุณไม่ได้ควบคุม

การโยกย้ายนี้ไม่ใช่แค่การสลับ model-id

คู่มือการย้ายระบบของ Anthropic มีทั้งหมดสิบข้อสำหรับทุกคนที่ย้ายออกจาก Claude Haiku 4.5 และหลายข้อเป็นความล้มเหลวร้ายแรงมากกว่าคำแนะนำ

• Manual thinking ใช้ไม่ได้ — thinking: {"type": "enabled", "budget_tokens": N}จะส่งคืนข้อผิดพลาด Adaptive thinking เข้ามาแทนที่ และ thinking.displayต้องถูกตั้งค่าเป็น "summarized" หากคุณต้องการเห็นกระบวนการให้เหตุผลเลย

• พารามิเตอร์การสุ่มใช้งานไม่ได้ — temperature, top_p และ top_k ทั้งหมดต้องถูกนำออกจากคำขอ

• Assistant prefill — บทสนทนาที่สิ้นสุดด้วยข้อผิดพลาด ให้สิ้นสุดด้วยข้อความของผู้ใช้

• การเปลี่ยนแปลงลำดับบล็อก — คำตอบอาจเริ่มต้นด้วยบล็อกการคิด ดังนั้นโค้ดที่อ่านบล็อกเนื้อหาแรกเป็นคำตอบจึงต้องเลือกตามประเภทแทน

• การปฏิเสธเป็นเรื่องใหม่ — โมเดลจะรันตัวจำแนกความปลอดภัย สามารถคืนค่า stop_reason: "refusal" และไม่มีการสำรองข้อมูลฝั่งเซิร์ฟเวอร์

• การเล่นซ้ำมีข้อจำกัด — บล็อกความคิดทำงานได้เฉพาะในบัญชีที่สร้างบล็อกเหล่านั้นขึ้นมา หรือบัญชีที่เชื่อมโยงกับบัญชีนั้นเท่านั้น

• Priority Tier ไม่สามารถยกไปใช้ต่อได้ — องค์กรที่มีข้อผูกพัน Priority Tier บน Claude Haiku 4.5 ต้องวางแผนความจุแยกต่างหาก เนื่องจากระดับดังกล่าวไม่รองรับบน Claude Haiku 5.5

สองในนั้นสมควรได้รับความสนใจมากกว่าข้ออื่น ๆ เหตุผลการหยุดแบบปฏิเสธ (refusal) คือการเปลี่ยนแปลงโฟลว์การควบคุมในทุก ๆ ลูปที่สมมติว่าทุกการตอบกลับมีเนื้อหา และบล็อกความคิด (thinking blocks) ที่ผูกกับบัญชีจะทำให้คิวใด ๆ ที่เก็บบทสนทนาไว้แล้วเล่นซ้ำผ่านพูลของข้อมูลรับรองใช้การไม่ได้ ทั้งสองอย่างจะไม่ปรากฏให้เห็นจนกว่าจะขึ้นโปรดักชัน

การรันทั้งสองระดับภายใต้คีย์เดียว

คำถามในทางปฏิบัติสำหรับทีมส่วนใหญ่ไม่ใช่ว่าโมเดลสองตัวนี้ตัวไหนดีกว่า เพราะคำตอบนั้นขึ้นอยู่กับว่าคุณกำลังเรียกใช้แบบใดอยู่ทั้งหมด มันคือว่าขาที่มีต้นทุนต่ำของแคสเคดสามารถอัปเกรดได้อย่างอิสระจากทุกสิ่งรอบตัวหรือไม่

Claude Haiku 4.5 อยู่ในแค็ตตาล็อกของ OrcaRouter แล้ววันนี้ ในราคาตามที่ Anthropic ประกาศไว้ โดยบวกเพิ่ม 0% ดังนั้นอัตราค่าบริการของผู้ให้บริการจึงถูกส่งต่อมาโดยตรง และการเปลี่ยนแปลงใด ๆ ที่ Anthropic ทำกับอัตรานั้นจะปรากฏทางฝั่งเราในวันเดียวกัน Claude Sonnet 5.5 และ Claude Opus 5.5 ก็มีให้ใช้เช่นกัน ซึ่งหมายความว่าตอนนี้สามารถสร้างไปป์ไลน์แบบสองระดับได้แล้ว — โมเดลเล็กสำหรับงานประจำส่วนใหญ่ โมเดลใหญ่สำหรับงานที่ต้องยกระดับ — ด้วยคีย์เดียว SDK เดียว และ ระบบสำรองอัตโนมัติที่ทำงานอยู่เบื้องหลัง และภายหลังสามารถสลับขาเล็กไปเป็น Claude Haiku 5.5 ได้ด้วยการเปลี่ยน model-id แทนการเขียนใหม่

Claude Haiku 5.5 ยังไม่อยู่ในแค็ตตาล็อก และก็คุ้มค่าที่จะพูดตรง ๆ อย่างนั้น มากกว่าปล่อยให้เป็นเพียงนัย ช่องว่างในวันเปิดตัวระหว่างการที่โมเดลหนึ่งเปิดให้ใช้งาน กับการที่โมเดลหนึ่งจะถูกกำหนดเส้นทางได้นั้นเป็นเรื่องปกติ และมันไม่ใช่คำสัญญาว่าช่องว่างนี้จะปิดลงเมื่อใด โมเดลที่เรียกใช้ได้จากเราในเช้านี้คือรุ่นที่ระบุไว้ข้างต้น

A screenshot of the OrcaRouter catalogue page for Claude Haiku 4.5, showing the model identifier, the provider Anthropic, the model description and a stat strip carrying the $1.00 per million input and $5.00 per million output rates alongside the context window and maximum output.

ใครควรสลับ และควรสลับสายใดก่อน

ถ้าทราฟฟิก Haiku 4.5 ของคุณเป็นการจัดประเภท การสกัดข้อมูล การจัดเส้นทาง การบีบอัด หรือการสรุป ด้วยพรอมป์ต์ที่ต่ำกว่า 100,000 โทเคน ให้ย้ายเลย — อัตราคิดเป็นหนึ่งในสิบ หน้าต่างกว้างขึ้นห้าเท่า และปุ่มปรับ effort มอบคันโยกด้านต้นทุนที่โมเดลเดิมไม่เคยมี ตั้งงบประมาณต่ำลงราว 75% และกระทบยอดกับจำนวนโทเคนของคุณเองหลังจากผ่านไปหนึ่งสัปดาห์

หากพรอมป์ของคุณเกิน 100,000 โทเคนเป็นประจำ คุณกำลังได้ส่วนลด 50% ไม่ใช่ 90% และระดับที่สองจะเปลี่ยนการเปรียบเทียบในแบบที่ทำให้การเปรียบเทียบราคาคุ้มค่า: อัตราค่าเอาต์พุตที่เกิน 100K อยู่ที่ $2.50 ซึ่งสูงกว่าที่โมเดลขนาดเล็กหลายตัวที่แข่งขันกันคิดสำหรับทั้งหน้าต่าง

และถ้าคุณใช้ Haiku 4.5 เพราะมันเป็นตัวเลือกที่ถูกเพียงตัวเดียวที่รองรับเอกสารขนาด 200,000 โทเคนได้ ให้สังเกตว่ามีอะไรเปลี่ยนไป ตอนนี้หน้าต่างเป็นหนึ่งล้านโทเคน ซึ่งเป็นผลิตภัณฑ์ที่แตกต่างออกไป และเหตุผลที่จะเก็บโมเดลเก่าไว้ก็หายไปอย่างเงียบ ๆ พร้อมกับเหตุผลที่มันเคยราคาถูก

© 2026 OrcaRouter

สำหรับผู้ให้บริการ

ให้บริการแพลตฟอร์มการอนุมานอยู่หรือไม่ นำโมเดลของคุณขึ้น OrcaRouter

providers@orcarouter.ai

เข้าร่วมคอมมูนิตี้ของเรา

Discordsupport@orcarouter.aiXGitHubYouTube