
Claude Haiku 5.5 เปิดให้ใช้งานแล้วในราคา $0.10 ต่อล้านโทเค็น: ข้ออ้าง 75% และเชิงอรรถสองข้อของมัน
- openaiใหม่OpenAI: GPT-6.1 Sol2026-09-2952ความฉลาด
- anthropicใหม่Anthropic: Claude Sonnet 5.52026-09-2856ความฉลาด
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 ต่อ 1 ล้านโทเค็น · 111 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238ความฉลาด
- OpenAIOpenAI: GPT-6 Sol2026-09-2248ความฉลาด
- AnthropicAnthropic: Claude Opus 5.52026-09-2258ความฉลาด
- xAIGrok 4.72026-09-2146ความฉลาด
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 ต่อ 1 ล้านโทเค็น · 55 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 ต่อ 1 ล้านโทเค็น · 347 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040ความฉลาด
- OpenAIOpenAI: GPT-6 Astra2026-09-0453ความฉลาด77การเขียนโค้ด
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241ความฉลาด76การเขียนโค้ด
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245ความฉลาด76การเขียนโค้ด
- AnthropicAnthropic: Claude Fable 5.12026-09-0153ความฉลาด82การเขียนโค้ด
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 ต่อ 1 ล้านโทเค็น · 60 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 ต่อ 1 ล้านโทเค็น · 377 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642ความฉลาด72การเขียนโค้ด
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 ต่อ 1 ล้านโทเค็น · 231 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845ความฉลาด75การเขียนโค้ด
- obsidianQwen3.8 27B2026-08-1534ความฉลาด68การเขียนโค้ด
Anthropic เปิดให้ Claude Haiku 5.5พร้อมใช้งานทั่วไปเมื่อวันที่ 7 ตุลาคม 2026 ในราคา 0.10 ดอลลาร์ต่ออินพุตหนึ่งล้านโทเคน และ 0.50 ดอลลาร์ต่อเอาต์พุตหนึ่งล้านโทเคน — เป็นตัวเลขสองตัวเดียวกับที่ OpenAI เรียกเก็บสำหรับ GPT-6 Luna และคิดเป็นหนึ่งในห้าของราคาที่ Claude Haiku 4.5 เก็บมาตั้งแต่ปี 2025 ซึ่งตอนเปิดตัวอยู่ที่ 1.00 และ 5.00 ดอลลาร์ พาดหัวในโพสต์เปิดตัวของ Anthropic คือโมเดลใหม่มีต้นทุนการใช้งาน "ต่ำลงราว 75%" เมื่อเทียบกับรุ่นก่อนโดยเฉลี่ย และนั่นคือตัวเลขที่บทสรุปทุกชิ้นตั้งแต่นั้นพูดซ้ำ ตัวเลขนี้มาพร้อมเชิงอรรถสองข้อที่บทสรุปส่วนใหญ่ตัดทิ้งไป: ต่ำกว่า 100,000 โทเคน ลดลง 90% เหนือกว่านั้นลดลง 50% และ Claude Haiku 5.5 ใช้ตัวตัดคำ (tokenizer) รุ่นใหม่ที่ใช้ร่วมกับ Claude 4.7 เป็นต้นไป ข้อความชุดเดียวกันจึงถูกนับเป็นโทเคน มากกว่าเดิมราว 30% เมื่อเทียบกับ Claude Haiku 4.5 ดังนั้น 75% จึงเป็นข้อความเกี่ยวกับบิล ไม่ใช่เกี่ยวกับอัตราค่าบริการ และสำหรับใครก็ตามที่มีพรอมป์ยาว ๆ สองสิ่งนั้นไม่เหมือนกัน ตารางเปรียบเทียบของผู้ขายเองก็ยังมี GPT-6 Luna และ Claude Sonnet 5.5 เป็นคอลัมน์อยู่ข้าง ๆ ด้วย ซึ่งทำให้เอกสารเปิดตัวฉบับนี้เถียงได้ง่ายเป็นพิเศษ
คณิตศาสตร์เบื้องหลัง "ลด 75%"
เริ่มที่ราคาก่อน เพราะมันไม่ใช่ อินพุตอยู่ที่ $0.10 ต่อล้านโทเคนสำหรับไม่เกิน 100,000 โทเคน และ $0.50 ต่อล้านเมื่อเกินกว่านั้น — คิดเป็นห้าเท่า เอาต์พุตอยู่ที่ $0.50 และ $2.50 ตามลำดับ การแคชเป็นดังนี้: การเขียนแคชแบบห้านาทีอยู่ที่ $0.125 ต่อล้านเมื่อต่ำกว่าเส้นแบ่ง และ $0.625 เมื่อเกินเส้นนั้น การเขียนแบบหนึ่งชั่วโมงอยู่ที่ $0.20 และ $1.00 และการอ่านแคชอยู่ที่ $0.01 และ $0.05 Message Batches API ลด 50% จากทั้งสองมิเตอร์ และบนเส้นทางแบบแบตช์ โมเดลรองรับเอาต์พุตได้ถึง 300,000 โทเคนด้วย output-300k-2026-03-24 เฮดเดอร์ beta
ทีนี้ ลองวางตัวตัดโทเคนทับลงไปบนนั้น เพราะนั่นคือจุดที่ข้ออ้างในพาดหัวข่าวเริ่มน่าสนใจ พรอมป์ต์หนึ่งที่วัดได้ 90,000 โทเคนบนตัวตัดโทเคนของ Claude Haiku 4.5 จะวัดได้ราว 117,000 โทเคนบนตัวใหม่ มันไม่ได้เปลี่ยนขนาด แต่ข้ามเส้น 100,000 โทเคนไปแล้ว ดังนั้นจึงถูกคิดราคาที่ $0.50 ต่ออินพุตหนึ่งล้านโทเคน แทนที่จะเป็น $0.10 บน Claude Haiku 4.5 เนื้อหาเดียวกันนั้นมีค่าอินพุต $0.09 ($1.00 ต่อล้าน × 0.09 ล้าน) บน Claude Haiku 5.5 คิดเป็น $0.0585 นั่นคือการลดลง 35% — จริง และไม่ใกล้เคียง 90% เลย ตัวเลข 90% ใช้กับคำขอที่ยังอยู่ใต้เส้นหลังจากตัวตัดโทเคนขยายจำนวนโทเคนของคำขอเหล่านั้น ซึ่งเป็นจุดที่มีทราฟฟิกการเรียกแบบสั้นอยู่เป็นจำนวนมาก: การเรียกจำแนกประเภท 20,000 โทเคนกลายเป็น 26,000 โทเคน ยังอยู่ในเทียร์แรก และตรงนั้นราคาอินพุตเป็นหนึ่งในสิบของราคาเดิมจริง ๆ
มีสามสิ่งที่ตามมาจากเรื่องนั้น และมันคุ้มค่าที่จะแยกออกจากกันมากกว่า:
• การเรียกใช้งานแบบสั้นจะได้รับส่วนลดเต็มจำนวน การดึงข้อมูล การจัดเส้นทาง การจำแนกประเภท และการสรุปเอกสารที่พอดีอยู่ภายในขีดจำกัดนี้ สิ่งเหล่านี้จะเห็นตัวเลข 90% ทั้งในส่วนอินพุตและเอาต์พุต หักด้วยการขยายของโทเคไนเซอร์
• การเรียกที่ยาวนานจะได้ส่วนลดประมาณหนึ่งในสาม ไม่ใช่สามในสี่ คำขอที่ตกอยู่เหนือ 100,000 โทเคนหลังการแปลงโทเคนใหม่จะจ่าย $0.50 และ $2.50 ต่อล้าน — ยังคงเป็นครึ่งหนึ่งของอัตราของ Claude Haiku 4.5 แต่ระดับชั้นที่มันอยู่กลับสูงเป็นห้าเท่าของระดับชั้นที่ป้ายราคาโฆษณาไว้
• "ลดลง 75% โดยเฉลี่ย" เป็นตัวเลขที่ถ่วงน้ำหนักตามปริมาณทราฟฟิก และเป็นตัวเลขของ Anthropic เอง มันเป็นคำอธิบายของผู้ขายเองเกี่ยวกับส่วนผสมที่คาดหวังของตัวเอง และ Anthropic ระบุชัดเจนว่าพรอมป์ที่ต่ำกว่าเกณฑ์นั้นคิดเป็นสัดส่วนประมาณ 90% ของคำขอที่ส่งไปยัง Haiku รุ่นก่อน หากส่วนผสมของคุณไม่ได้เป็นแบบนั้น ค่าเฉลี่ยของคุณก็จะไม่เป็นแบบนั้น — และวิธีเดียวที่จะรู้ได้คือการนับโทเค็นบนทราฟฟิกของคุณเอง ด้วยโทเค็นไนเซอร์ตัวใหม่ ก่อนที่คุณจะกำหนดงบประมาณ

มีอะไรอื่นที่มาพร้อมกับมันอีก
โมเดลนี้ไม่ใช่แค่เรื่องราคาเท่านั้น รายละเอียดการเปิดตัวหลายอย่างเปลี่ยนวิธีที่คุณเขียนโค้ดให้ทำงานกับมัน และหนึ่งในนั้นจะทำให้ไคลเอนต์ที่มีอยู่เดิมใช้การไม่ได้
• เปิดใช้ Adaptive thinking เป็นค่าเริ่มต้น พร้อมแป้นปรับระดับความพยายามตั้งแต่ Low ถึง Max โดยค่าเริ่มต้นคือ medium นี่คือโมเดลระดับ Haiku รุ่นแรกที่มีการตั้งค่าระดับความพยายามแบบปรับได้ และเป็นกลไกสำคัญที่สุดที่ส่งผลต่อทั้งคุณภาพและค่าใช้จ่ายต่อหนึ่งคำตอบ
• พารามิเตอร์การสุ่มตัวอย่างถูกปฏิเสธ การส่งค่าที่ไม่ใช่ค่าเริ่มต้น temperature, top_p หรือ top_k จะคืนค่า 400 การย้ายระบบใดก็ตามที่ส่งอาร์กิวเมนต์เหล่านี้ต่อไปจะล้มเหลวอย่างชัดเจนในคำขอแรก แทนที่จะเสื่อมลงอย่างเงียบ ๆ ซึ่งอย่างน้อยก็เป็นโหมดความล้มเหลวที่ซื่อสัตย์
• บริบท 1M โทเคน และเอาต์พุตสูงสุด 128,000 โทเคน ใน Messages API แบบซิงโครนัส โดยมีความรู้ถึงเดือนมิถุนายน 2026 และคำมั่นว่าจะเลิกให้บริการไม่เร็วกว่า 7 ตุลาคม 2027
• ห้าแพลตฟอร์มในวันแรก: Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry และ Claude Platform on AWS นั่นคือการเปิดตัวพร้อมกันในวันเดียวกัน แทนที่จะเป็นการทยอยเปิดให้ใช้งานแบบเป็นระยะอย่างที่การเปิดตัวเหล่านี้มักทำกัน
• เครื่องมือก็ขยับไปด้วยเช่นกัน SDK สำหรับ Python และ TypeScript ของ Anthropic ตอนนี้รองรับ computer use และ browser use ในเวอร์ชันเบต้า และบริษัทได้เพิ่มเครดิต API รายเดือนสำหรับผู้สมัครสมาชิก Max 5x ($100), Max 20x ($200) และ Team (ใช้ร่วมกันได้สูงสุด $500)
• ท่าทีด้านความปลอดภัยนั้นจำกัดกว่าที่ราคาบ่งชี้ไว้Anthropic กล่าวว่ามาตรการป้องกันทางไซเบอร์บน Claude Haiku 5.5 นั้นเข้มงวดกว่า Claude Haiku 4.5 แต่เข้มงวดน้อยกว่าโมเดลแนวหน้ารุ่นล่าสุด — เปิดให้ใช้เชิงป้องกันได้กว้างกว่าที่ Claude Sonnet 5.5 อนุญาต โดยการทดสอบเจาะระบบยังถูกบล็อกอยู่ — และมาตรการป้องกันด้านชีววิทยาเทียบเท่ากับ Claude Sonnet 5, Claude Sonnet 5.5 และ Claude Opus 5 การประเมินด้าน Alignment ดีขึ้นอย่างกว้างขวางเมื่อเทียบกับรุ่นก่อนหน้าบนชุดทดสอบของ Anthropic เอง
สิ่งที่ตารางของผู้ขายระบุ และสิ่งที่คณะกรรมการอิสระระบุ
Anthropic เผยแพร่ตาราง benchmark ที่มีสามคอลัมน์เปรียบเทียบ และมันคุ้มค่าที่จะอ่านในฐานะเอกสารเกี่ยวกับวิธีที่บรรดาผู้ขายโต้แย้งกัน ตัวเลขทุกตัวด้านล่างเป็นข้อมูลที่ผู้ขายรายงานเอง ผลิตขึ้นบนฮาร์เนสของ Anthropic และไม่มีข้อมูลใดเลยที่ได้รับการทำซ้ำอย่างอิสระ ส่วนตรงที่ GPT-6 Luna ปรากฏขึ้น นั่นคือ Anthropic กำลังรันการประเมินของตัวเองกับโมเดลของคู่แข่ง
• งานองค์ความรู้ — GDPval-AA v2.1 อยู่ที่ 1620 สำหรับ Claude Haiku 5.5 เทียบกับ 735 สำหรับ Claude Haiku 4.5, 1437 สำหรับ GPT-6 Luna และ 1840 สำหรับ Claude Sonnet 5.5 ส่วน AA-Briefcase v1.1 อยู่ที่ 1578, 614, 1336 และ 1824
• การใช้งานคอมพิวเตอร์ — OSWorld 2.1 แบบออฟไลน์อยู่ที่ 72.4% เทียบกับ 15.7%, 48.9% และ 83.9%
• การให้เหตุผล — Humanity's Last Exam ทำได้ 45.9% เมื่อไม่ใช้เครื่องมือ และ 57.4% เมื่อใช้เครื่องมือ เทียบกับ 10.2% และ 18.7% สำหรับ Claude Haiku 4.5 และ 56.9% และ 64.5% สำหรับ Claude Sonnet 5.5
• การเขียนโค้ดแบบเอเจนต์ — Terminal-Bench 4.0 อยู่ที่ 39.2% เทียบกับ 0.0%, 16.4% และ 70.6% FrontierCode 1.1 (Main) อยู่ที่ 46.4% เทียบกับ 42.4% สำหรับ GPT-6 Luna และ 52.1% สำหรับ Claude Sonnet 5.5
• การอ่านแผนภูมิ — Chartography อยู่ที่ 46.4% โดยไม่ใช้เครื่องมือ เทียบกับ 6.4%, 29.1% และ 61.6%
ในตารางนั้น Claude Haiku 5.5 ชนะทุกแถวเมื่อเทียบกับทั้ง Haiku รุ่นก่อนและ GPT-6 Luna และแพ้ให้กับ Claude Sonnet 5.5 ในแถวส่วนใหญ่ — ซึ่งเป็นรูปร่างที่ตรงไปตรงมาของระดับเล็ก: เป็นการก้าวกระโดดข้ามรุ่นครั้งใหญ่ และยังคงเป็นระดับที่ต่ำกว่าโมเดลระดับกลางในงานที่ยากที่สุด Anthropic พูดเช่นนั้นในโพสต์ โดยแนะนำ Claude Sonnet 5.5 และ Claude Opus 5.5 สำหรับการเขียนโค้ดแบบเอเจนต์ที่ซับซ้อน ในขณะที่วางตำแหน่ง Haiku สำหรับการบีบอัด การสรุป การจำแนกประเภท และบทบาทของเอเจนต์ย่อย
ภาพจากการประเมินอิสระมีความซับซ้อนกว่าและต้องใช้ความใส่ใจมากกว่า Artificial Analysis วัด Claude Haiku 5.5 ที่ Max effort ได้ 43 คะแนนบน Intelligence Index v4.3.2 ของตน เป็นอันดับสองจาก 182 โมเดล และได้ 241.9 output tokens ต่อวินาที — เร็วอย่างที่โฆษณาไว้ โดยยังวัดต้นทุนได้ที่ $0.21 ต่อ Index task ที่ทำสำเร็จหนึ่งงาน เพราะโมเดลสร้าง output tokens ถึง 440 ล้านโทเคนในการรันชุดทดสอบ เทียบกับค่ามัธยฐานที่ 100 ล้าน ผู้ประเมินจึงอธิบายว่ามันช่างพูดมากอย่างยิ่ง GPT-6 Luna ได้ 38 บนดัชนีเดียวกัน มีต้นทุน $0.07 ต่อ task ราคาติดป้ายเท่ากัน แต่บิลเป็นสามเท่า นั่นไม่ใช่การขัดแย้งกับคำกล่าวอ้างตอนเปิดตัว — มันคือปรากฏการณ์เดียวกันกับที่คำกล่าวอ้างตอนเปิดตัวพูดถึง เพียงแต่มองจากอีกด้านหนึ่ง: rate card คือสิ่งที่คุณจ่ายต่อโทเคน และตัวเลขที่คุณจ่ายจริงคือ rate คูณกับจำนวนโทเคน และ Claude Haiku 5.5 ใช้โทเคนต่อคำตอบมากกว่าคู่แข่ง Effort คือคันโยก และค่าเริ่มต้นของโมเดลคือ medium ไม่ใช่ Max และทีมที่ตั้งค่าให้ต่ำลงจะเห็นทั้งบิลที่เล็กลงและคะแนนที่ต่ำลงด้วย
เรียกมันจากที่เดียว
คำถามเรื่องการย้ายระบบที่การเปิดตัวครั้งนี้ก่อขึ้นมาไม่ใช่ "ดีกว่าหรือเปล่า" แต่เป็น "ทราฟฟิกของฉันมีค่าใช้จ่ายเท่าไรบนนั้น" และคำตอบนั้นขึ้นอยู่กับความยาวพรอมป์ต์ของคุณ อัตราการแฮิตแคช และการตั้งค่าระดับความพยายามที่คุณเลือก การไปให้ถึงจุดนั้นหมายถึงการรันชุดพรอมป์ต์ของคุณเองผ่านทั้งสองเจเนอเรชัน — ซึ่งทำได้ถูกเมื่ออยู่หลังเอนด์พอยต์เดียว และน่าเบื่อหน่ายเมื่อต้องทำข้ามสองเอนด์พอยต์
Claude Haiku 5.5 เองยังไม่มีอยู่ในแค็ตตาล็อกของ OrcaRouter และการบอกเช่นนั้นตรง ๆ ก็มีประโยชน์กว่าการทำให้เข้าใจเป็นอย่างอื่น ส่วนรุ่นอื่น ๆ ในสาย Anthropic ได้แก่ Claude Haiku 4.5, Claude Sonnet 5.5 และ Claude Opus 5.5 ล้วนเรียกใช้ได้จากเราวันนี้ในราคาตามที่ค่ายกำหนด โดยมีการบวกกำไร 0% ส่งผ่านตรงถึงคุณ ดังนั้นขา "ก่อน" ของการทดสอบย้ายระบบจึงรันบนคีย์เดียวกับที่คุณจะใช้ต่อ และหากค่ายปรับลดราคาในขานั้น ฝั่งเราก็พร้อมใช้ทันทีในวันเดียวกัน ขา "หลัง" คือ API ของ Anthropic จนกว่าโมเดลใหม่จะไปถึงรันไทม์ที่เราเราเตอร์ให้ สิ่งที่เอนด์พอยต์ร่วมมอบให้ระหว่างนี้คือการสลับไปใช้ระบบสำรองอัตโนมัติภายใต้การเรียกนั้น เพื่อให้โมเดลใหม่รับทราฟฟิกโปรดักชันได้โดยที่เส้นทางไม่ต้องพึ่งพามัน และมี DSL สำหรับจัดเส้นทางสำหรับกรณีที่การยกระดับจาก Haiku ไปเป็น Sonnet ควรอยู่ในเส้นทางมากกว่าในโค้ดแอปพลิเคชันของคุณ

ผลลัพธ์จากลูกค้าสองรายในการเปิดตัวครั้งนี้ควรนำไปใช้ต่อเป็นเบาะแสมากกว่าเป็นหลักฐาน Asana รายงานว่าลดความหน่วงได้กว่า 30% และการอนุมานเร็วขึ้นสูงสุด 2.5 เท่าต่อเทิร์นของเอเจนต์; HubSpot รายงาน 92.8% โดยเฉลี่ยจากการรันสามครั้งบนชุด CRM ของตน; AlphaSense รายงาน 0.84 เทียบกับ 0.76 จาก 400 คำค้นหา ตัวเลขลูกค้าเหล่านี้เป็นตัวเลขที่ผู้ขายเลือกมาเองในประกาศของผู้ขายเอง และคุณค่าของมันอยู่ที่การบอกคุณว่าควรทดสอบเวิร์กโหลดใดก่อน ไม่ใช่การบอกว่าคุณจะได้อะไร
อะไรจะทำให้ภาพเปลี่ยนไป
ตัวเลข 75% จะถูกตัดสินด้วยวิธีเดียวกับที่คำกล่าวอ้างของผู้ขายทุกรายที่ถ่วงน้ำหนักด้วยปริมาณทราฟฟิกถูกตัดสิน นั่นคือ ด้วยใบแจ้งหนี้ของคุณเอง สิ่งที่ยังเป็นข้อถกเถียงอย่างแท้จริงในฝั่งอิสระก็คือตัวเลขต้นทุนต่อภารกิจ หากตัวเลขนี้ยังคงอยู่เมื่อมีการรันสะสมมากขึ้น บทสรุปที่ซื่อตรงของการเปิดตัวครั้งนี้ก็คือ Anthropic ลดอัตราค่าบริการลง 80% และสร้างโมเดลที่ใช้โทเคนต่อคำตอบมากขึ้น ดังนั้นการประหยัดที่แท้จริงจึงมีอยู่จริง มีขนาดใหญ่ ขึ้นอยู่กับลักษณะงาน และแทบไม่เคยเป็นตัวเลขที่อยู่บนโปสเตอร์ หากตัวเลขนี้ลดลงเมื่อปรับค่าความพยายามและใช้แคช ระดับชั้นนี้ก็จะยิ่งดูดีขึ้นไปอีก ไม่ว่าจะทางไหน ตัวเลขที่ต้องตรวจสอบก่อนการย้ายระบบก็คือจำนวนโทเคนต่อภารกิจของคุณเองภายใต้ตัวแบ่งโทเคนตัวใหม่ — นั่นคือตัวเลขเดียวที่โพสต์เปิดตัวไม่สามารถให้คุณได้

การเปรียบเทียบในบทความนี้1
ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
