
Claude Haiku 5.5 เทียบกับ Claude Haiku 4.5: การลดราคา 90% ไม่ใช่การประหยัด 90%
- openaiใหม่OpenAI: GPT-6.1 Sol2026-09-2952ความฉลาด
- anthropicใหม่Anthropic: Claude Sonnet 5.52026-09-2856ความฉลาด
- typesafeใหม่TypeSafe: Jev 1.132026-09-24$0.04 / $0.00 ต่อ 1 ล้านโทเค็น · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238ความฉลาด
- OpenAIOpenAI: GPT-6 Sol2026-09-2248ความฉลาด
- AnthropicAnthropic: Claude Opus 5.52026-09-2258ความฉลาด
- xAIGrok 4.72026-09-2146ความฉลาด
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 ต่อ 1 ล้านโทเค็น · 67 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 ต่อ 1 ล้านโทเค็น · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040ความฉลาด
- OpenAIOpenAI: GPT-6 Astra2026-09-0453ความฉลาด77การเขียนโค้ด
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241ความฉลาด76การเขียนโค้ด
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245ความฉลาด76การเขียนโค้ด
- AnthropicAnthropic: Claude Fable 5.12026-09-0153ความฉลาด82การเขียนโค้ด
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 ต่อ 1 ล้านโทเค็น · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 ต่อ 1 ล้านโทเค็น · 360 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642ความฉลาด72การเขียนโค้ด
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 ต่อ 1 ล้านโทเค็น · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845ความฉลาด75การเขียนโค้ด
- obsidianQwen3.8 27B2026-08-1534ความฉลาด68การเขียนโค้ด
Claude Haiku 5.5 มีราคาอยู่ที่ $0.10 ต่อ 1 ล้านโทเค็นอินพุต และ $0.50 ต่อ 1 ล้านโทเค็นเอาต์พุต สำหรับพรอมต์ไม่เกิน 100,000 โทเค็น Claude Haiku 4.5 มีค่าใช้จ่าย $1 และ $5 แบบคงที่ สำหรับหน้าต่าง 200,000 โทเค็นทั้งหมดที่มันมีมาตลอด Anthropic ระบุความแตกต่างไว้ว่า "ต่ำลง 90%" ในเชิงอรรถแห่งหนึ่ง และ "รันถูกลงประมาณ 75%" ในประโยคด้านบนนั้น — และช่วงห่างสิบเอ็ดเดือนระหว่างสองโมเดลนี้ก็คือระยะห่างระหว่างตัวเลขสองตัวนั้นพอดี
นั่นไม่ใช่กลลวงทางการตลาด มันคือรูปร่างที่ซื่อตรงของเจเนอเรชันโมเดลที่เปลี่ยนโทเคไนเซอร์ ค่าเริ่มต้นการคิด และหน้าต่างบริบทไปพร้อมกับราคา และมันหมายความว่าใครก็ตามที่สลับ model id แล้วคาดว่าบิลจะลดลงสิบเท่า จะผิดหวังเพราะการคำนวณ มากกว่าจะผิดหวังเพราะตัวผลิตภัณฑ์
ทั้งสองรุ่นตามที่จัดส่ง
ทุกอย่างด้านล่างนี้คิดเป็นต่อ {{1}}หนึ่งล้านโทเคน{{/1}} ในหน่วย{{2}}ดอลลาร์สหรัฐ{{/2}} และอ่านจากเอกสารราคาและเอกสารโมเดลของ Anthropic เองเมื่อวันที่ {{3}}2026-10-08{{/3}} เว้นแต่จะระบุไว้เป็นอย่างอื่น

• อินพุต — Claude Haiku 5.5 $0.10 สำหรับไม่เกิน 100,000 โทเคน, $0.50 สำหรับเกินกว่านั้น; Claude Haiku 4.5 $1.00 โดยไม่คำนึงถึงความยาว
• เอาต์พุต — Claude Haiku 5.5 $0.50 สำหรับไม่เกิน 100,000 โทเค็น, $2.50 หากเกินกว่านั้น; Claude Haiku 4.5 $5.00 ไม่จำกัดความยาว
• การอ่านแคช — Claude Haiku 5.5 $0.01 สูงสุด 100,000 โทเค็น และ $0.05 สำหรับส่วนที่เกิน; Claude Haiku 4.5 $0.10. การเขียนแคช — $0.125 และ $0.625 เมื่อเทียบกับ $1.25.
• บริบท — 1 ล้านโทเคน เทียบกับ 200,000 เอาต์พุตสูงสุด — 128,000 โทเคน เทียบกับ 64,000
• การคิด — Claude Haiku 5.5 เป็นแบบปรับตัวและเปิดใช้งานเป็นค่าเริ่มต้น โดยมีตัวปรับระดับความพยายามที่ค่าเริ่มต้นอยู่ที่ปานกลาง; Claude Haiku 4.5 ใช้รูปแบบที่ต้องกำหนดเองแบบเก่าและไม่มีพารามิเตอร์ความพยายามเลย
• คะแนนอิสระ — Artificial Analysis Intelligence Index v4.3.2 จัดอันดับให้ Claude Haiku 5.5 (Max) อยู่ที่ 43.40 เป็นอันดับสองจาก 182 โมเดล และ Claude 4.5 Haiku อยู่ที่ 16.88 เป็นอันดับที่สามสิบจาก 61 — โดยผู้ประเมินระบุว่าคะแนนของ 4.5 นั้นเป็นค่าประมาณ
• ความเร็ว — แหล่งข้อมูลเดียวกันวัดได้ 242 โทเค็นเอาต์พุตต่อวินาทีสำหรับ Claude Haiku 5.5 เทียบกับ 89.7 สำหรับรุ่น 4.5 ซึ่งเป็นจุดเดียวที่โมเดลเก่ายังดูดีอยู่
จุดที่เรื่องราคาเพียงหนึ่งในสิบพังทลายลง
มีสามสิ่งที่กัดกินส่วนที่ถูกตัดออกไป และมีเพียงสิ่งแรกเท่านั้นที่เป็นคำเตือนของ Anthropic เอง
ตัวตัดคำ (tokenizer) คือเรื่องใหญ่ Claude Haiku 5.5 ใช้ตัวตัดคำรุ่นใหม่ที่เปิดตัวพร้อมกับ Claude 4.7 และเอกสารของ Anthropic ระบุว่าข้อความเดียวกัน "นับเป็นโทเคนมากกว่าประมาณ 30% เมื่อเทียบกับ Claude Haiku 4.5" คุณไม่ได้จ่ายในอัตราหนึ่งในสิบสำหรับจำนวนโทเคนเท่าเดิม แต่คุณจ่ายในอัตราหนึ่งในสิบสำหรับโทเคนที่มากขึ้นราว 1.3 เท่า คู่มือการย้ายระบบของผู้ให้บริการเองก็จัดเรื่องนี้ไว้เป็นรายการที่สองในเช็กลิสต์ ก่อนการแก้โค้ดใด ๆ ทั้งสิ้น นั่นคือ ให้นับโทเคนของพรอมป์ตของคุณใหม่ แล้วจึงกลับมาพิจารณา max_tokensและประมาณการค่าใช้จ่ายของคุณ
โทเค็นการคิดถูกคิดค่าใช้จ่ายเป็นโทเค็นเอาต์พุต และ Claude Haiku 5.5 คิดโดยค่าเริ่มต้น หน้าข้อมูลการเปิดตัวของ Anthropic ระบุชัดเจนว่าโมเดลนี้ "ช่างพูดมาก" ในแบบของตัวเองบนแผนภูมิ และการวัดที่เป็นอิสระสนับสนุนเรื่องนี้อย่างชัดเจนกว่าที่ผู้ขายทำ: ในการประเมิน Intelligence Index นั้น Artificial Analysis บันทึกโทเค็นเอาต์พุต 440 ล้านโทเค็นจาก Claude Haiku 5.5 เทียบกับค่ามัธยฐาน 100 ล้านโทเค็นโดยรวม และระบุว่าโมเดลนี้ช่างพูดมาก อัตราค่าอินพุตที่ถูกไม่ได้ช่วยงานที่มีค่าใช้จ่ายส่วนใหญ่เป็นเอาต์พุต
ขั้น 100,000 โทเคนเป็นขั้นที่สาม เหนือขึ้นไปอัตราคือ $0.50 และ $2.50 — ครึ่งหนึ่งของที่ Claude Haiku 4.5 เรียกเก็บสำหรับคำขอเดียวกัน ซึ่งเป็นข้อเสนอที่ดี และไม่ใช่ข้อเสนอที่ผู้อ่านส่วนใหญ่จะได้อ่านถึง Anthropic กล่าวว่าพรอมป์ที่อยู่ต่ำกว่าเกณฑ์คิดเป็นประมาณ 90% ของคำขอที่ส่งไปยังโมเดล Haiku รุ่นก่อน ซึ่งเป็นตัวเลขที่ทำให้การตัดเกณฑ์นี้พออยู่รอดในฐานะพาดหัวข่าวได้ และยังเป็นสัดส่วนทราฟฟิกของผู้ขายเอง ไม่ใช่ของคุณ

งานเดียวกันมีค่าใช้จ่ายเท่าใดสำหรับสองโมเดล
ต้นทุนต่องานที่เสร็จสมบูรณ์คือตัวชี้วัดที่ครอบคลุมผลกระทบทั้งสามข้อข้างต้น เพราะมันคิดค่าใช้จ่ายกับโมเดลสำหรับทุกสิ่งที่โมเดลส่งออกมา ไม่ใช่แค่สิ่งที่คุณส่งไป
Artificial Analysis ระบุว่า Claude Haiku 5.5 (5.5) อยู่ที่ $0.21 ต่อจุด Intelligence Index — ตัวเลขที่เผยแพร่ที่อัตราอินพุต $0.10 และอัตราเอาต์พุต $0.50 มันไม่ได้เผยแพร่ต้นทุนต่องานสำหรับรุ่น 4.5 เลย; ไทล์ไม่ทราบค่า เนื่องจากโมเดลไม่เคยถูกทดสอบบน Index ในโหมดการตั้งค่าแบบใช้เหตุผล สิ่งที่หน้าเว็บเผยแพร่คือราคาป้ายดิบที่ $1.00 และ $5.00 และคะแนนที่วัดได้ที่แตกต่างและต่ำกว่า
ดังนั้น การเปรียบเทียบที่ตรงไปตรงมาสำหรับผู้ซื้อจึงไม่ใช่ 10 เท่าในแง่โทเค็น แต่เป็นอะไรที่ใกล้เคียงกับสิ่งนี้มากกว่า: อัตราอินพุตหนึ่งในสิบเมื่อใช้โทเค็นมากขึ้น 30% อัตราเอาต์พุตครึ่งหนึ่งเมื่อคุณข้าม 100K และโมเดลที่ใช้โทเค็นเอาต์พุตต่อคำตอบมากกว่ารุ่นก่อน — เมื่อเทียบกับการกระโดดของความสามารถจาก 16.88 เป็น 43.40 บนบอร์ดอิสระเดียวกัน ตัวเลข 75% ที่ Anthropic อ้างสำหรับปริมาณงานทั่วไปคือตัวเลขที่สมเหตุสมผลสำหรับการวางแผน มันยังเป็นค่าประมาณแบบผสมจากผู้ขายบนส่วนผสมทราฟฟิกที่คุณไม่ได้ควบคุม
การโยกย้ายนี้ไม่ใช่แค่การสลับ model-id
คู่มือการย้ายระบบของ Anthropic มีทั้งหมดสิบข้อสำหรับทุกคนที่ย้ายออกจาก Claude Haiku 4.5 และหลายข้อเป็นความล้มเหลวร้ายแรงมากกว่าคำแนะนำ
• Manual thinking ใช้ไม่ได้ — thinking: {"type": "enabled", "budget_tokens": N}จะส่งคืนข้อผิดพลาด Adaptive thinking เข้ามาแทนที่ และ thinking.displayต้องถูกตั้งค่าเป็น "summarized" หากคุณต้องการเห็นกระบวนการให้เหตุผลเลย
• พารามิเตอร์การสุ่มใช้งานไม่ได้ — temperature, top_p และ top_k ทั้งหมดต้องถูกนำออกจากคำขอ
• Assistant prefill — บทสนทนาที่สิ้นสุดด้วยข้อผิดพลาด ให้สิ้นสุดด้วยข้อความของผู้ใช้
• การเปลี่ยนแปลงลำดับบล็อก — คำตอบอาจเริ่มต้นด้วยบล็อกการคิด ดังนั้นโค้ดที่อ่านบล็อกเนื้อหาแรกเป็นคำตอบจึงต้องเลือกตามประเภทแทน
• การปฏิเสธเป็นเรื่องใหม่ — โมเดลจะรันตัวจำแนกความปลอดภัย สามารถคืนค่า stop_reason: "refusal" และไม่มีการสำรองข้อมูลฝั่งเซิร์ฟเวอร์
• การเล่นซ้ำมีข้อจำกัด — บล็อกความคิดทำงานได้เฉพาะในบัญชีที่สร้างบล็อกเหล่านั้นขึ้นมา หรือบัญชีที่เชื่อมโยงกับบัญชีนั้นเท่านั้น
• Priority Tier ไม่สามารถยกไปใช้ต่อได้ — องค์กรที่มีข้อผูกพัน Priority Tier บน Claude Haiku 4.5 ต้องวางแผนความจุแยกต่างหาก เนื่องจากระดับดังกล่าวไม่รองรับบน Claude Haiku 5.5
สองในนั้นสมควรได้รับความสนใจมากกว่าข้ออื่น ๆ เหตุผลการหยุดแบบปฏิเสธ (refusal) คือการเปลี่ยนแปลงโฟลว์การควบคุมในทุก ๆ ลูปที่สมมติว่าทุกการตอบกลับมีเนื้อหา และบล็อกความคิด (thinking blocks) ที่ผูกกับบัญชีจะทำให้คิวใด ๆ ที่เก็บบทสนทนาไว้แล้วเล่นซ้ำผ่านพูลของข้อมูลรับรองใช้การไม่ได้ ทั้งสองอย่างจะไม่ปรากฏให้เห็นจนกว่าจะขึ้นโปรดักชัน
การรันทั้งสองระดับภายใต้คีย์เดียว
คำถามในทางปฏิบัติสำหรับทีมส่วนใหญ่ไม่ใช่ว่าโมเดลสองตัวนี้ตัวไหนดีกว่า เพราะคำตอบนั้นขึ้นอยู่กับว่าคุณกำลังเรียกใช้แบบใดอยู่ทั้งหมด มันคือว่าขาที่มีต้นทุนต่ำของแคสเคดสามารถอัปเกรดได้อย่างอิสระจากทุกสิ่งรอบตัวหรือไม่
Claude Haiku 4.5 อยู่ในแค็ตตาล็อกของ OrcaRouter แล้ววันนี้ ในราคาตามที่ Anthropic ประกาศไว้ โดยบวกเพิ่ม 0% ดังนั้นอัตราค่าบริการของผู้ให้บริการจึงถูกส่งต่อมาโดยตรง และการเปลี่ยนแปลงใด ๆ ที่ Anthropic ทำกับอัตรานั้นจะปรากฏทางฝั่งเราในวันเดียวกัน Claude Sonnet 5.5 และ Claude Opus 5.5 ก็มีให้ใช้เช่นกัน ซึ่งหมายความว่าตอนนี้สามารถสร้างไปป์ไลน์แบบสองระดับได้แล้ว — โมเดลเล็กสำหรับงานประจำส่วนใหญ่ โมเดลใหญ่สำหรับงานที่ต้องยกระดับ — ด้วยคีย์เดียว SDK เดียว และ ระบบสำรองอัตโนมัติที่ทำงานอยู่เบื้องหลัง และภายหลังสามารถสลับขาเล็กไปเป็น Claude Haiku 5.5 ได้ด้วยการเปลี่ยน model-id แทนการเขียนใหม่
Claude Haiku 5.5 ยังไม่อยู่ในแค็ตตาล็อก และก็คุ้มค่าที่จะพูดตรง ๆ อย่างนั้น มากกว่าปล่อยให้เป็นเพียงนัย ช่องว่างในวันเปิดตัวระหว่างการที่โมเดลหนึ่งเปิดให้ใช้งาน กับการที่โมเดลหนึ่งจะถูกกำหนดเส้นทางได้นั้นเป็นเรื่องปกติ และมันไม่ใช่คำสัญญาว่าช่องว่างนี้จะปิดลงเมื่อใด โมเดลที่เรียกใช้ได้จากเราในเช้านี้คือรุ่นที่ระบุไว้ข้างต้น

ใครควรสลับ และควรสลับสายใดก่อน
ถ้าทราฟฟิก Haiku 4.5 ของคุณเป็นการจัดประเภท การสกัดข้อมูล การจัดเส้นทาง การบีบอัด หรือการสรุป ด้วยพรอมป์ต์ที่ต่ำกว่า 100,000 โทเคน ให้ย้ายเลย — อัตราคิดเป็นหนึ่งในสิบ หน้าต่างกว้างขึ้นห้าเท่า และปุ่มปรับ effort มอบคันโยกด้านต้นทุนที่โมเดลเดิมไม่เคยมี ตั้งงบประมาณต่ำลงราว 75% และกระทบยอดกับจำนวนโทเคนของคุณเองหลังจากผ่านไปหนึ่งสัปดาห์
หากพรอมป์ของคุณเกิน 100,000 โทเคนเป็นประจำ คุณกำลังได้ส่วนลด 50% ไม่ใช่ 90% และระดับที่สองจะเปลี่ยนการเปรียบเทียบในแบบที่ทำให้การเปรียบเทียบราคาคุ้มค่า: อัตราค่าเอาต์พุตที่เกิน 100K อยู่ที่ $2.50 ซึ่งสูงกว่าที่โมเดลขนาดเล็กหลายตัวที่แข่งขันกันคิดสำหรับทั้งหน้าต่าง
และถ้าคุณใช้ Haiku 4.5 เพราะมันเป็นตัวเลือกที่ถูกเพียงตัวเดียวที่รองรับเอกสารขนาด 200,000 โทเคนได้ ให้สังเกตว่ามีอะไรเปลี่ยนไป ตอนนี้หน้าต่างเป็นหนึ่งล้านโทเคน ซึ่งเป็นผลิตภัณฑ์ที่แตกต่างออกไป และเหตุผลที่จะเก็บโมเดลเก่าไว้ก็หายไปอย่างเงียบ ๆ พร้อมกับเหตุผลที่มันเคยราคาถูก
