
Claude Haiku 5.5: การลดราคา 90% โทเคไนเซอร์ใหม่ และวิดีโอที่ Anthropic ไม่ได้โพสต์
- openaiใหม่OpenAI: GPT-6.1 Sol2026-09-2952ความฉลาด
- anthropicใหม่Anthropic: Claude Sonnet 5.52026-09-2856ความฉลาด
- typesafeใหม่TypeSafe: Jev 1.132026-09-24$0.04 / $0.00 ต่อ 1 ล้านโทเค็น · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238ความฉลาด
- OpenAIOpenAI: GPT-6 Sol2026-09-2248ความฉลาด
- AnthropicAnthropic: Claude Opus 5.52026-09-2258ความฉลาด
- xAIGrok 4.72026-09-2146ความฉลาด
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 ต่อ 1 ล้านโทเค็น · 65 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 ต่อ 1 ล้านโทเค็น · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040ความฉลาด
- OpenAIOpenAI: GPT-6 Astra2026-09-0453ความฉลาด77การเขียนโค้ด
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241ความฉลาด76การเขียนโค้ด
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245ความฉลาด76การเขียนโค้ด
- AnthropicAnthropic: Claude Fable 5.12026-09-0153ความฉลาด82การเขียนโค้ด
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 ต่อ 1 ล้านโทเค็น · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 ต่อ 1 ล้านโทเค็น · 360 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642ความฉลาด72การเขียนโค้ด
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 ต่อ 1 ล้านโทเค็น · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845ความฉลาด75การเขียนโค้ด
- obsidianQwen3.8 27B2026-08-1534ความฉลาด68การเขียนโค้ด
มีคนพิมพ์ประโยคเดียวลงใน Claude Haiku 5.5 แล้วได้หนังเปิดตัวที่เสร็จสมบูรณ์กลับมา พร้อมต์ที่โพสต์ลง X เมื่อเย็นวันที่ 7 ตุลาคม 2026 มีข้อความเต็มว่า “ทำวิดีโอเปิดตัวที่เด็ดกว่าเดิมสิบเท่า ซึ่งแสดงให้เห็นว่าคุณเป็นนักออกแบบโมชันเก่งแค่ไหน” แคปชันของโพสต์มีสามคำ — “ทำวิดีโอนี้ในครั้งเดียว” — และมีคลิปแนบมาด้วย ไม่มีการลองซ้ำ ไม่มีสตอรีบอร์ด ไม่มีคนตัดต่อ ถ้านั่นคือสิ่งที่โมเดลที่ถูกที่สุดในสาย Claude ทำได้แล้ว ระดับนี้ก็ไม่ถือเป็นการประนีประนอมอีกต่อไป
นั่นคือครึ่งที่น่าสนใจของการเปิดตัว ครึ่งหลังคือคณิตศาสตร์ และนั่นแหละคือจุดที่มีข่าวจริง ๆ อยู่: Claude Haiku 5.5มีค่าใช้จ่าย $0.10 ต่อโทเค็นอินพุตหนึ่งล้านโทเค็น และ $0.50 ต่อโทเค็นเอาต์พุตหนึ่งล้านโทเค็น สำหรับพรอมป์ต์ไม่เกิน 100,000 โทเค็น เทียบกับClaude Haiku 4.5ที่ราคาคงที่ $1 และ $5 ฟุตโน๊ตของ Anthropic เองเรียกสิ่งนั้นว่าต่ำลง 90% ในกรณีทั่วไป — แล้วก็บอกในทันทีว่า ตัวเลขที่ผู้ซื้อควรใช้ในการวางแผนนั้นใกล้เคียง 75% มากกว่า ทั้งสองตัวเลขถูกต้อง และช่องว่างระหว่างทั้งสองคือสิ่งสำคัญที่สุดในการเปิดตัวครั้งนี้
สิ่งที่ Anthropic เปิดเผยอย่างเป็นทางการเมื่อวันที่ 7 ตุลาคม
โพสต์เปิดตัวของผู้ขายและเอกสารด้านราคาของผู้ขายเห็นตรงกันถึงลักษณะของสิ่งนี้ และมันเป็นก้าวที่ใหญ่กว่าที่การลดราคามักจะพ่วงมาด้วย

• ราคา — $0.10 ต่อล้านโทเค็นอินพุต และ $0.50 ต่อล้านโทเค็นเอาต์พุต สำหรับพรอมต์ที่มีขนาดไม่เกิน 100,000 โทเค็น เมื่อเกินเกณฑ์นั้น คำขอเดียวกันจะถูกเรียกเก็บที่ $0.50 และ $2.50 การอ่านแคชมีค่าใช้จ่าย $0.01 ต่อล้านสำหรับไม่เกิน 100K และ $0.05 เมื่อเกินกว่านั้น; การเขียนแคชมีค่าใช้จ่าย $0.125 และ $0.625
• บริบท — 1M โทเคน พร้อมเอาต์พุตสูงสุด 128,000 โทเคน นั่นคือหน้าต่างบริบทเดียวกันและเพดานเอาต์พุตเดียวกันกับที่ Claude Fable 5.1, Claude Opus 5.5 และ Claude Sonnet 5.5 มี โดยถูกนำมาทำซ้ำบนระดับราคาที่ถูกที่สุด
• Thinking — การคิดแบบปรับตัวได้ด้วยพารามิเตอร์ effort โดยค่าเริ่มต้นเป็น medium Anthropic ระบุว่านี่เป็นโมเดลระดับ Haiku ตัวแรกที่มีการตั้งค่า effort แบบปรับได้ ซึ่งหมายความว่า model id เดียวกันสามารถรันแบบประหยัดหรือรันแบบละเอียดรอบคอบได้โดยไม่ต้องเปลี่ยนสิ่งอื่นใด
• โทเคไนเซอร์ — โทเคไนเซอร์รุ่นใหม่ที่ใช้ร่วมกับ Claude 4.7 และรุ่นต่อ ๆ ไป ซึ่ง "สร้างโทเค็นเพิ่มขึ้นประมาณ 30% สำหรับข้อความเดียวกัน" เอกสารของ Anthropic ระบุว่าจำนวนที่เพิ่มขึ้นที่แน่นอนนั้นขึ้นอยู่กับเนื้อหาและลักษณะของภาระงาน
• วงจรชีวิต — ขีดจำกัดข้อมูลความรู้เดือนมิถุนายน 2026 และคำมั่นเรื่องการปลดระวางว่า "ไม่เร็วกว่า 7 ตุลาคม 2027"
• ความพร้อมใช้งาน — Claude API, Amazon Web Services, Google Cloud, Microsoft Azure และ Claude Platform บน AWS ทั้งหมดพร้อมกันตั้งแต่วันแรก
สติกเกอร์ 10 เท่า กับความจริง 75%
สิบเท่าที่ถูกกว่าเป็นตัวเลขที่จะเดินทางไปไกลที่สุด และเป็นตัวเลขที่มีแนวโน้มที่สุดที่จะไปจบลงในแบบจำลองงบประมาณของใครบางคนในตำแหน่งที่ผิด มันใช้กับพรอมป์ต์ที่มีความยาวสูงถึง 100,000 โทเค็น Haiku 5.5 ไม่คงอัตรานั้นไว้ตลอดทั้งหน้าต่างบริบท
• สูงสุด 100,000 โทเคน — ขาเข้า $0.10 และขาออก $0.50 เทียบกับ $1 และ $5 ของ Haiku 4.5 นั่นคือการลดลง 90% และ Anthropic กล่าวว่า 90% ของคำขอที่ส่งไปยังโมเดล Haiku ก่อนหน้านี้อยู่ในช่วงนี้
• มากกว่า 100,000 โทเค็น — ขาเข้า $0.50 และขาออก $2.50 ยังคงเป็นครึ่งหนึ่งของราคาที่ Haiku 4.5 เรียกเก็บพอดี สำหรับคำขอเดียวกัน โดยไม่มีเพดานให้ชน
• ตัวตัดคำ (tokenizer) — ข้อความเดียวกันจะกลายเป็นโทเคนเพิ่มขึ้นประมาณ 30% เมื่อเทียบกับ Haiku 4.5 ดังนั้นการลดราคาต่อโทเคนจึงไม่ได้แปลงเป็นบิลที่ถูกลงแบบหนึ่งต่อหนึ่ง
• ค่าเฉลี่ยของผู้ขายเอง — Anthropic ระบุว่าการรวมกันนี้ "รันน้อยลงประมาณ 75%" นั่นคือตัวเลขของบริษัทเอง ไม่ใช่การวัดที่เป็นอิสระ และเป็นตัวเลขที่ควรใส่ในประมาณการ
• เศรษฐศาสตร์ของแคช — การอ่านแคชลดลงจาก $0.10 เหลือ $0.01 ต่อล้านในช่วงการใช้งานทั่วไป ซึ่งสำคัญกว่าอัตราอินพุตสำหรับไปป์ไลน์ใด ๆ ที่ส่งคำนำหน้าที่ยาวและใช้ร่วมกันซ้ำ
ตัวเลข 75% ยังอธิบายบางสิ่งที่ผู้อ่านอาจตีความเป็นข้อขัดแย้งได้ ตัวเลขพาดหัวสองตัวนั้นไม่ได้ขัดแย้งกัน ตัวหนึ่งเป็นอัตราบนรูปแบบคำขอ อีกตัวเป็นค่าประมาณแบบผสมบนส่วนผสมทราฟฟิกจริงซึ่งรวมถึงส่วนน้อยที่เกิน 100K และโทเคนเพิ่มเติมของโทเคไนเซอร์ หากคุณกำลังจำลองค่าใช้จ่าย ให้ใช้ 75% และตรวจสอบการกระจายความยาวพรอมป์ต์ของคุณเองก่อนที่คุณจะเชื่อว่าดีกว่า
สิ่งที่วิดีโออ้างคืออะไร และสิ่งที่มันไม่ใช่
คลิปนี้เป็นของจริง พรอมต์ถูกยกมาอ้างอิงแบบคำต่อคำไว้ข้างต้น และการประทับเวลา — 19:49 UTC ของวันที่ 7 ตุลาคม ซึ่งราว ๆ วันเดียวกับที่โมเดลเปิดตัว — สามารถตรวจสอบได้ การระบุที่มาเป็นการอ้างถึงผู้ใช้รายบุคคล ไม่ใช่ Anthropic
ความแตกต่างนี้สำคัญตรงนี้ เพราะหน้าผลิตภัณฑ์ของ Anthropic เองสำหรับ Claude Haiku 5.5 ไม่มีวิดีโอฝังอยู่เลย: ไม่มีเครื่องเล่น ไม่มีไฟล์สื่อ มีเพียงลิงก์ไปยังช่อง YouTube ของบริษัท หากมีวิดีโอเปิดตัวที่สร้างด้วยโมเดลนี้ ผู้ขายก็ไม่ได้ระบุไว้ ดังนั้นข้อความที่ถูกต้องจึงจำกัดขอบเขตแคบ ๆ ว่า ผู้ใช้รายหนึ่งรายงานว่าได้สร้างวิดีโอเปิดตัวในครั้งเดียวด้วย Claude Haiku 5.5 และเผยแพร่พรอมป์ต์นั้น ไม่ว่ามันจะเป็นการสร้างในครั้งเดียวหรือไม่ ค่าใช้จ่ายเท่าไร และมีสัดส่วนเท่าใดที่รอดจากการตัดต่อ ล้วนเป็นข้อกล่าวอ้างจากแหล่งเดียว ให้ถือคลิปนี้เป็นตัวอย่างสาธิต ไม่ใช่เกณฑ์มาตรฐาน
เหตุผลที่ยังคุ้มค่าจะกล่าวถึงอยู่ดีก็คือ การสร้างวิดีโอไม่ได้อยู่ในสเปกของโมเดลนี้ Haiku 5.5 รับข้อความและรูปภาพเข้า แล้วส่งข้อความออก ผลลัพธ์งานโมชันดีไซน์ที่มีคุณภาพระดับนั้นบ่งชี้ว่าโมเดลกำลังขับเคลื่อนสิ่งอื่นอยู่ — เส้นทางการสร้างโค้ด, ไปป์ไลน์การเรนเดอร์, ลูปเครื่องมือ — มากกว่าที่จะผลิตเฟรมด้วยตัวเอง นั่นคือคำกล่าวเกี่ยวกับการประสานงานแบบเอเจนต์ที่อินพุตราคา $0.10 ซึ่งเป็นส่วนที่ทำให้ประหลาดใจจริง ๆ
ตัวเลขที่ Anthropic เผยแพร่
ตารางการเปิดตัวของผู้ขายเป็นการเปรียบเทียบก่อนและหลังกับ Haiku 4.5 โดยมี GPT-6 Luna และ Claude Sonnet 5.5 อยู่ในคอลัมน์เดียวกันเพื่อการเปรียบเทียบ ตัวเลขทุกตัวด้านล่างเป็นผลการประเมินที่ Anthropic รายงานเอง ซึ่งรันบนฮาร์เนสของ Anthropic และถูกนำมาแสดงซ้ำแต่ไม่ได้ตรวจสอบอย่างอิสระ

• งานด้านความรู้ — GDPval-AA v2.1 อยู่ที่ 1620 เมื่อเทียบกับ 735 ของ Haiku 4.5, 1437 ของ GPT-6 Luna และ 1840 ของ Sonnet 5.5 ส่วน AA-Briefcase v1.1 อยู่ที่ 1578 เมื่อเทียบกับ 614, 1336 และ 1824
• การใช้งานคอมพิวเตอร์ — OSWorld 2.1 อยู่ที่ 72.4% บนชุดย่อยแบบออฟไลน์ เทียบกับ 15.7% สำหรับ Haiku 4.5, 48.9% สำหรับ GPT-6 Luna และ 83.9% สำหรับ Sonnet 5.5
• การให้เหตุผลแบบสหสาขาวิชา — Humanity's Last Exam ที่ 45.9% เมื่อไม่มีเครื่องมือ และ 57.4% เมื่อมีเครื่องมือ เทียบกับ 10.2% และ 18.7% สำหรับ Haiku 4.5
• การเขียนโค้ดแบบเอเจนติก — Terminal-Bench 4.0 อยู่ที่ 39.2% เทียบกับ 0.0%, 16.4% และ 70.6% FrontierCode 1.1 (Main) อยู่ที่ 46.4% เทียบกับ 42.4% สำหรับ GPT-6 Luna และ 52.1% สำหรับ Sonnet 5.5
• การให้เหตุผลเชิงภาพ — Chartography ที่ 46.4% โดยไม่ใช้เครื่องมือ เทียบกับ 6.4%, 29.1% และ 61.6%
Anthropic ยังตรงไปตรงมาอย่างผิดปกติเกี่ยวกับจุดที่รุ่นเล็กไม่ได้เปรียบ คำวิจารณ์ของบริษัทเองบนแผนภูมิ Terminal-Bench ระบุว่า Sonnet 5.5 และ Opus 5.5 “ยังคงเป็นตัวเลือกที่ดีกว่าสำหรับงานเขียนโค้ดแบบเอเจนต์ที่ซับซ้อน” และวางตำแหน่ง Haiku 5.5 ให้เหมาะกับงานบีบอัดบริบท การสรุปความ และงานเอเจนต์ย่อยแทน คำรับรองจากลูกค้าในโพสต์ชี้ไปในทิศทางเดียวกันและมีข้อแม้เดียวกัน — สิ่งเหล่านี้คือพาร์ตเนอร์ early-access ที่กำลังอธิบายผลการประเมินของตนเอง ไม่ใช่การตรวจสอบอย่างเป็นทางการ: Asana รายงานว่าความหน่วงในการทำงานให้เสร็จสิ้นต่ำลงกว่า 30% และอินเฟอเรนซ์เร็วขึ้นสูงสุด 2.5 เท่าต่อเทิร์นของเอเจนต์; HubSpot รายงานค่าเฉลี่ย 92.8% จากการรันสามครั้งบนชุดพอร์ทัล CRM; AlphaSense รายงาน 0.84 เทียบกับ 0.76 จาก 400 คำค้น บนเวิร์กโหลดที่มีการเรียกประมาณ 8 ล้านครั้งต่อสัปดาห์; Box รายงานว่าสูงกว่า Haiku 4.5 อยู่ 11 จุด โดยมีความหน่วงประมาณครึ่งหนึ่ง; Rogo อธิบายถึงเอเจนต์ย่อย Haiku 5.5 ที่ดึงบรรทัดรายได้ตามส่วนงานออกมาจากเอกสาร 10-K; และ Cognition รายงานว่า Devin Fusion มีคะแนน FrontierCode อยู่ที่ 66.2 โดยมี Haiku 5.5 เป็นคู่หู
สิ่งที่คณะกรรมการอิสระกล่าว
ตารางของผู้ขายก็เป็นของผู้ขาย การจัดอันดับจากภายนอกเป็นครั้งแรกต่างหากคือตัวเลขที่มีประโยชน์กว่าสำหรับใครก็ตามที่กำลังตัดสินใจว่าระดับนั้นขยับไปไกลพอที่จะเปลี่ยนไปป์ไลน์การผลิตหรือไม่

Artificial Analysis ให้คะแนน Claude Haiku 5.5 อยู่ที่ 43 บน Intelligence Index v4.3.2 ของตนในการตั้งค่า Max ของโมเดลนี้ โดยจัดอยู่ในอันดับสองจากทั้งหมด 182 โมเดลบนบอร์ดนั้น และสูงกว่าค่ามัธยฐานของบอร์ดที่ 13 อย่างมาก หน้าเดียวกันยังวัดได้ 242 โทเค็นเอาต์พุตต่อวินาที — อันดับที่เก้าจาก 182 — และมีค่าใช้จ่าย $0.21 ต่องาน Intelligence Index
สองสิ่งบนหน้านั้นมีค่ามากกว่าพาดหัวข่าว สิ่งแรกคือความยาวเกินจำเป็น: ในการประเมิน Index นั้น Artificial Analysis บันทึกโทเคนเอาต์พุตได้ 440 ล้านโทเคน เทียบกับค่ามัธยฐาน 100 ล้าน และอธิบายว่าโมเดลนี้ "verbose มาก" ราคาที่ติดป้ายคิดต่อโทเคน ดังนั้นโมเดลที่คิดยาวจึงต้องจ่ายตามนั้น — ซึ่งเป็นเหตุผลว่าทำไมตัวเลขต้นทุนต่องานจึงอยู่ที่ $0.21 แทนที่จะใกล้ศูนย์ และทำไมการลดอินพุตลง 90% จึงไม่ใช่เรื่องทั้งหมด สิ่งที่สองคือบันไดของความพยายาม: หน้าเดียวกันนี้เปิดเผยการตั้งค่าตั้งแต่ Max ลงมา และค่าเริ่มต้นของ Anthropic คือ medium ไม่ใช่ max คะแนน 43 บนบอร์ดคือจุดสูงสุดของบันไดนั้น ไม่ใช่การตั้งค่าที่คุณจะได้หากไม่ทำอะไรเลย
การรันระดับที่ต่ำกว่าระดับที่คุณสามารถเรียกใช้ได้อยู่แล้ว
Claude Haiku 5.5 ไม่ได้อยู่ในแคตตาล็อกของ OrcaRouter และน่าจะพูดกันตรง ๆ แบบนั้นไปเลย ดีกว่าจะทำให้เข้าใจเป็นอย่างอื่น: ช่องว่างในวันเปิดตัวระหว่างการที่โมเดลหนึ่งมีอยู่จริง กับการที่โมเดลนั้นถูกนำมาให้เราเตอร์เรียกใช้ได้ มักใช้เวลาหลายวัน และบางครั้งก็นานกว่านั้น
สิ่งที่อยู่ในแค็ตตาล็อกของ Anthropic วันนี้คือ Claude Haiku 4.5, Claude Sonnet 5.5 และ Claude Opus 5.5 แต่ละตัวในราคาตามรายการของผู้ให้บริการที่ส่งผ่านมาพร้อมมาร์กอัป 0% ดังนั้นการลดราคาใด ๆ ที่ Anthropic ทำ จะมาถึงฝั่งเราวันเดียวกับที่มาถึงฝั่งพวกเขา นี่คือสะพานเชื่อมที่ใช้ได้จริงสำหรับใครก็ตามที่อยากทดสอบรูปแบบ subagent ตอนนี้: แคสเคดที่ส่งเทิร์นงานroutine ไปที่ Haiku 4.5 และยกระดับงานยากขึ้นไปยังรุ่นบน ใช้ได้แล้ววันนี้ ภายใต้คีย์เดียวและ SDK เดียว และการสลับขาเล็กไปเป็น Haiku 5.5 ในภายหลังเป็นการเปลี่ยน model-id ไม่ใช่การโยกย้ายระบบ การ failover อัตโนมัติอยู่ข้างใต้ไม่ว่าคุณจะเลือกขาใด ดังนั้นบ่ายที่แย่ของผู้ให้บริการรายเดียวจะไม่ลากไปป์ไลน์ทั้งเส้นลงไปด้วย
หากคุณไม่อยากรอเลย ช่วงราคาอินพุต $0.10 เดียวกันนี้ก็มี GPT-6 Luna ครองอยู่แล้ว ซึ่งเรามีให้บริการเส้นทางนี้อยู่ และรักษาอัตรานี้ไว้จนถึง 272,000 โทเค็นก่อนจะปรับเพิ่มขึ้น
ใครควรย้าย และใครไม่ควรย้าย
ถ้าเวิร์กโหลดของคุณคือการจำแนกประเภท การสกัดข้อมูล การจัดเส้นทาง การบีบอัดข้อมูล หรือการสรุปข้อมูลในปริมาณมาก และพรอมป์ของคุณมีไม่ถึง 100,000 โทเคน กรณีนี้ก็ง่ายมาก: อัตราค่าบริการเหลือหนึ่งในสิบของเดิม หน้าต่างบริบทกว้างขึ้นห้าเท่า และปุ่มปรับระดับความพยายามช่วยให้คุณแลกไปอีกทางได้เมื่อคำขอจำเป็นต้องใช้ ตั้งงบโดยเผื่อว่าต่ำลงราว 75% แล้วคุณจะไม่แปลกใจ
หากพรอมต์ของคุณใช้งานเกิน 100,000 โทเค็นเป็นประจำ คุณกำลังได้ส่วนลด 50% ไม่ใช่ 90% และการเปรียบเทียบราคาสำหรับงานที่ต้องใช้บริบทเชิงลึกก็ยังคุ้มค่าที่จะเสียเวลาช่วงบ่ายไปกับการเลือก — ในวงการนี้มีหลายโมเดลที่ราคาเท่ากับหรือต่ำกว่าอัตราสำหรับการใช้งานเกิน 100K ของระดับนี้
และถ้า eval ของคุณยังล้มเหลวกับงานในลักษณะ Terminal-Bench นี่ไม่ใช่โมเดลที่จะแก้ปัญหานั้น Anthropic เองก็บอกแบบนั้น และตัวเลข 39.2% เมื่อเทียบกับ 70.6% ของ Sonnet 5.5 ก็เป็นหลักฐานที่ชัดเจนที่สุดในโพสต์ สรุปอย่างตรงไปตรงมาของวันที่ 7 ตุลาคม คือ พื้นของสติปัญญาที่มีประโยชน์ลดลงไปไกลมาก และเพดานไม่ขยับเลย
การเปรียบเทียบในบทความนี้1
ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
