การ์ดชื่อเรื่องที่สร้างขึ้นซึ่งอ่านว่า 'Claude Haiku 5.5 เปิดให้ใช้งานแล้ว' พร้อมป้ายเปิดตัว 'GA 7 ต.ค. 2026' การ์ดข้อมูลสองใบที่อ่านว่า 'อินพุต $0.10 / 1M สูงสุด 100K โทเค็น' และ 'เอาต์พุต $0.50 / 1M สูงสุด 100K โทเค็น' และบรรทัดส่วนท้ายที่อ่านว่า 'พาดหัวหนึ่งรายการถูกตัดออก หมายเหตุสองรายการ: 90 เปอร์เซ็นต์ต่ำกว่าเกณฑ์, 50 เปอร์เซ็นต์สูงกว่าเกณฑ์, บนโทเค็นที่มากกว่าประมาณ 30 เปอร์เซ็นต์' โลโก้ OrcaRouter ตัวจริงถูกนำมาซ้อนทับไว้ที่มุมขวาล่าง
Guides & Insights

Claude Haiku 5.5 เปิดให้ใช้งานแล้วในราคา $0.10 ต่อล้านโทเค็น: ข้ออ้าง 75% และเชิงอรรถสองข้อของมัน

ผู้เขียน

Alistair Wren

วันที่เผยแพร่

โมเดลล่าสุด · 20ดูโมเดลทั้งหมด →
เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
กลับไปยังโพสต์ทั้งหมด

Anthropic เปิดให้ Claude Haiku 5.5พร้อมใช้งานทั่วไปเมื่อวันที่ 7 ตุลาคม 2026 ในราคา 0.10 ดอลลาร์ต่ออินพุตหนึ่งล้านโทเคน และ 0.50 ดอลลาร์ต่อเอาต์พุตหนึ่งล้านโทเคน — เป็นตัวเลขสองตัวเดียวกับที่ OpenAI เรียกเก็บสำหรับ GPT-6 Luna และคิดเป็นหนึ่งในห้าของราคาที่ Claude Haiku 4.5 เก็บมาตั้งแต่ปี 2025 ซึ่งตอนเปิดตัวอยู่ที่ 1.00 และ 5.00 ดอลลาร์ พาดหัวในโพสต์เปิดตัวของ Anthropic คือโมเดลใหม่มีต้นทุนการใช้งาน "ต่ำลงราว 75%" เมื่อเทียบกับรุ่นก่อนโดยเฉลี่ย และนั่นคือตัวเลขที่บทสรุปทุกชิ้นตั้งแต่นั้นพูดซ้ำ ตัวเลขนี้มาพร้อมเชิงอรรถสองข้อที่บทสรุปส่วนใหญ่ตัดทิ้งไป: ต่ำกว่า 100,000 โทเคน ลดลง 90% เหนือกว่านั้นลดลง 50% และ Claude Haiku 5.5 ใช้ตัวตัดคำ (tokenizer) รุ่นใหม่ที่ใช้ร่วมกับ Claude 4.7 เป็นต้นไป ข้อความชุดเดียวกันจึงถูกนับเป็นโทเคน มากกว่าเดิมราว 30% เมื่อเทียบกับ Claude Haiku 4.5 ดังนั้น 75% จึงเป็นข้อความเกี่ยวกับบิล ไม่ใช่เกี่ยวกับอัตราค่าบริการ และสำหรับใครก็ตามที่มีพรอมป์ยาว ๆ สองสิ่งนั้นไม่เหมือนกัน ตารางเปรียบเทียบของผู้ขายเองก็ยังมี GPT-6 Luna และ Claude Sonnet 5.5 เป็นคอลัมน์อยู่ข้าง ๆ ด้วย ซึ่งทำให้เอกสารเปิดตัวฉบับนี้เถียงได้ง่ายเป็นพิเศษ

คณิตศาสตร์เบื้องหลัง "ลด 75%"

เริ่มที่ราคาก่อน เพราะมันไม่ใช่ อินพุตอยู่ที่ $0.10 ต่อล้านโทเคนสำหรับไม่เกิน 100,000 โทเคน และ $0.50 ต่อล้านเมื่อเกินกว่านั้น — คิดเป็นห้าเท่า เอาต์พุตอยู่ที่ $0.50 และ $2.50 ตามลำดับ การแคชเป็นดังนี้: การเขียนแคชแบบห้านาทีอยู่ที่ $0.125 ต่อล้านเมื่อต่ำกว่าเส้นแบ่ง และ $0.625 เมื่อเกินเส้นนั้น การเขียนแบบหนึ่งชั่วโมงอยู่ที่ $0.20 และ $1.00 และการอ่านแคชอยู่ที่ $0.01 และ $0.05 Message Batches API ลด 50% จากทั้งสองมิเตอร์ และบนเส้นทางแบบแบตช์ โมเดลรองรับเอาต์พุตได้ถึง 300,000 โทเคนด้วย output-300k-2026-03-24 เฮดเดอร์ beta

ทีนี้ ลองวางตัวตัดโทเคนทับลงไปบนนั้น เพราะนั่นคือจุดที่ข้ออ้างในพาดหัวข่าวเริ่มน่าสนใจ พรอมป์ต์หนึ่งที่วัดได้ 90,000 โทเคนบนตัวตัดโทเคนของ Claude Haiku 4.5 จะวัดได้ราว 117,000 โทเคนบนตัวใหม่ มันไม่ได้เปลี่ยนขนาด แต่ข้ามเส้น 100,000 โทเคนไปแล้ว ดังนั้นจึงถูกคิดราคาที่ $0.50 ต่ออินพุตหนึ่งล้านโทเคน แทนที่จะเป็น $0.10 บน Claude Haiku 4.5 เนื้อหาเดียวกันนั้นมีค่าอินพุต $0.09 ($1.00 ต่อล้าน × 0.09 ล้าน) บน Claude Haiku 5.5 คิดเป็น $0.0585 นั่นคือการลดลง 35% — จริง และไม่ใกล้เคียง 90% เลย ตัวเลข 90% ใช้กับคำขอที่ยังอยู่ใต้เส้นหลังจากตัวตัดโทเคนขยายจำนวนโทเคนของคำขอเหล่านั้น ซึ่งเป็นจุดที่มีทราฟฟิกการเรียกแบบสั้นอยู่เป็นจำนวนมาก: การเรียกจำแนกประเภท 20,000 โทเคนกลายเป็น 26,000 โทเคน ยังอยู่ในเทียร์แรก และตรงนั้นราคาอินพุตเป็นหนึ่งในสิบของราคาเดิมจริง ๆ

มีสามสิ่งที่ตามมาจากเรื่องนั้น และมันคุ้มค่าที่จะแยกออกจากกันมากกว่า:

• การเรียกใช้งานแบบสั้นจะได้รับส่วนลดเต็มจำนวน การดึงข้อมูล การจัดเส้นทาง การจำแนกประเภท และการสรุปเอกสารที่พอดีอยู่ภายในขีดจำกัดนี้ สิ่งเหล่านี้จะเห็นตัวเลข 90% ทั้งในส่วนอินพุตและเอาต์พุต หักด้วยการขยายของโทเคไนเซอร์

• การเรียกที่ยาวนานจะได้ส่วนลดประมาณหนึ่งในสาม ไม่ใช่สามในสี่ คำขอที่ตกอยู่เหนือ 100,000 โทเคนหลังการแปลงโทเคนใหม่จะจ่าย $0.50 และ $2.50 ต่อล้าน — ยังคงเป็นครึ่งหนึ่งของอัตราของ Claude Haiku 4.5 แต่ระดับชั้นที่มันอยู่กลับสูงเป็นห้าเท่าของระดับชั้นที่ป้ายราคาโฆษณาไว้

• "ลดลง 75% โดยเฉลี่ย" เป็นตัวเลขที่ถ่วงน้ำหนักตามปริมาณทราฟฟิก และเป็นตัวเลขของ Anthropic เอง มันเป็นคำอธิบายของผู้ขายเองเกี่ยวกับส่วนผสมที่คาดหวังของตัวเอง และ Anthropic ระบุชัดเจนว่าพรอมป์ที่ต่ำกว่าเกณฑ์นั้นคิดเป็นสัดส่วนประมาณ 90% ของคำขอที่ส่งไปยัง Haiku รุ่นก่อน หากส่วนผสมของคุณไม่ได้เป็นแบบนั้น ค่าเฉลี่ยของคุณก็จะไม่เป็นแบบนั้น — และวิธีเดียวที่จะรู้ได้คือการนับโทเค็นบนทราฟฟิกของคุณเอง ด้วยโทเค็นไนเซอร์ตัวใหม่ ก่อนที่คุณจะกำหนดงบประมาณ

A generated one-column scoreboard titled 'Claude Haiku 5.5 — the scoreboard' with six rows reading 'Input: $0.10 / 1M up to 100K, then $0.50', 'Output: $0.50 / 1M up to 100K, then $2.50', 'Context: 1,000,000 tokens', 'Independent score: 43 at Max effort, rank 2 of 182', 'Cost per task: $0.21', and 'Throughput: 241.9 tokens per second', with a footer reading 'Independent figures per Artificial Analysis; pricing per Anthropic.' The real OrcaRouter logo is composited bottom-right.

มีอะไรอื่นที่มาพร้อมกับมันอีก

โมเดลนี้ไม่ใช่แค่เรื่องราคาเท่านั้น รายละเอียดการเปิดตัวหลายอย่างเปลี่ยนวิธีที่คุณเขียนโค้ดให้ทำงานกับมัน และหนึ่งในนั้นจะทำให้ไคลเอนต์ที่มีอยู่เดิมใช้การไม่ได้

• เปิดใช้ Adaptive thinking เป็นค่าเริ่มต้น พร้อมแป้นปรับระดับความพยายามตั้งแต่ Low ถึง Max โดยค่าเริ่มต้นคือ medium นี่คือโมเดลระดับ Haiku รุ่นแรกที่มีการตั้งค่าระดับความพยายามแบบปรับได้ และเป็นกลไกสำคัญที่สุดที่ส่งผลต่อทั้งคุณภาพและค่าใช้จ่ายต่อหนึ่งคำตอบ

• พารามิเตอร์การสุ่มตัวอย่างถูกปฏิเสธ การส่งค่าที่ไม่ใช่ค่าเริ่มต้น temperature, top_p หรือ top_k จะคืนค่า 400 การย้ายระบบใดก็ตามที่ส่งอาร์กิวเมนต์เหล่านี้ต่อไปจะล้มเหลวอย่างชัดเจนในคำขอแรก แทนที่จะเสื่อมลงอย่างเงียบ ๆ ซึ่งอย่างน้อยก็เป็นโหมดความล้มเหลวที่ซื่อสัตย์

• บริบท 1M โทเคน และเอาต์พุตสูงสุด 128,000 โทเคน ใน Messages API แบบซิงโครนัส โดยมีความรู้ถึงเดือนมิถุนายน 2026 และคำมั่นว่าจะเลิกให้บริการไม่เร็วกว่า 7 ตุลาคม 2027

• ห้าแพลตฟอร์มในวันแรก: Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry และ Claude Platform on AWS นั่นคือการเปิดตัวพร้อมกันในวันเดียวกัน แทนที่จะเป็นการทยอยเปิดให้ใช้งานแบบเป็นระยะอย่างที่การเปิดตัวเหล่านี้มักทำกัน

• เครื่องมือก็ขยับไปด้วยเช่นกัน SDK สำหรับ Python และ TypeScript ของ Anthropic ตอนนี้รองรับ computer use และ browser use ในเวอร์ชันเบต้า และบริษัทได้เพิ่มเครดิต API รายเดือนสำหรับผู้สมัครสมาชิก Max 5x ($100), Max 20x ($200) และ Team (ใช้ร่วมกันได้สูงสุด $500)

• ท่าทีด้านความปลอดภัยนั้นจำกัดกว่าที่ราคาบ่งชี้ไว้Anthropic กล่าวว่ามาตรการป้องกันทางไซเบอร์บน Claude Haiku 5.5 นั้นเข้มงวดกว่า Claude Haiku 4.5 แต่เข้มงวดน้อยกว่าโมเดลแนวหน้ารุ่นล่าสุด — เปิดให้ใช้เชิงป้องกันได้กว้างกว่าที่ Claude Sonnet 5.5 อนุญาต โดยการทดสอบเจาะระบบยังถูกบล็อกอยู่ — และมาตรการป้องกันด้านชีววิทยาเทียบเท่ากับ Claude Sonnet 5, Claude Sonnet 5.5 และ Claude Opus 5 การประเมินด้าน Alignment ดีขึ้นอย่างกว้างขวางเมื่อเทียบกับรุ่นก่อนหน้าบนชุดทดสอบของ Anthropic เอง

สิ่งที่ตารางของผู้ขายระบุ และสิ่งที่คณะกรรมการอิสระระบุ

Anthropic เผยแพร่ตาราง benchmark ที่มีสามคอลัมน์เปรียบเทียบ และมันคุ้มค่าที่จะอ่านในฐานะเอกสารเกี่ยวกับวิธีที่บรรดาผู้ขายโต้แย้งกัน ตัวเลขทุกตัวด้านล่างเป็นข้อมูลที่ผู้ขายรายงานเอง ผลิตขึ้นบนฮาร์เนสของ Anthropic และไม่มีข้อมูลใดเลยที่ได้รับการทำซ้ำอย่างอิสระ ส่วนตรงที่ GPT-6 Luna ปรากฏขึ้น นั่นคือ Anthropic กำลังรันการประเมินของตัวเองกับโมเดลของคู่แข่ง

• งานองค์ความรู้ — GDPval-AA v2.1 อยู่ที่ 1620 สำหรับ Claude Haiku 5.5 เทียบกับ 735 สำหรับ Claude Haiku 4.5, 1437 สำหรับ GPT-6 Luna และ 1840 สำหรับ Claude Sonnet 5.5 ส่วน AA-Briefcase v1.1 อยู่ที่ 1578, 614, 1336 และ 1824

• การใช้งานคอมพิวเตอร์ — OSWorld 2.1 แบบออฟไลน์อยู่ที่ 72.4% เทียบกับ 15.7%, 48.9% และ 83.9%

• การให้เหตุผล — Humanity's Last Exam ทำได้ 45.9% เมื่อไม่ใช้เครื่องมือ และ 57.4% เมื่อใช้เครื่องมือ เทียบกับ 10.2% และ 18.7% สำหรับ Claude Haiku 4.5 และ 56.9% และ 64.5% สำหรับ Claude Sonnet 5.5

• การเขียนโค้ดแบบเอเจนต์ — Terminal-Bench 4.0 อยู่ที่ 39.2% เทียบกับ 0.0%, 16.4% และ 70.6% FrontierCode 1.1 (Main) อยู่ที่ 46.4% เทียบกับ 42.4% สำหรับ GPT-6 Luna และ 52.1% สำหรับ Claude Sonnet 5.5

• การอ่านแผนภูมิ — Chartography อยู่ที่ 46.4% โดยไม่ใช้เครื่องมือ เทียบกับ 6.4%, 29.1% และ 61.6%

ในตารางนั้น Claude Haiku 5.5 ชนะทุกแถวเมื่อเทียบกับทั้ง Haiku รุ่นก่อนและ GPT-6 Luna และแพ้ให้กับ Claude Sonnet 5.5 ในแถวส่วนใหญ่ — ซึ่งเป็นรูปร่างที่ตรงไปตรงมาของระดับเล็ก: เป็นการก้าวกระโดดข้ามรุ่นครั้งใหญ่ และยังคงเป็นระดับที่ต่ำกว่าโมเดลระดับกลางในงานที่ยากที่สุด Anthropic พูดเช่นนั้นในโพสต์ โดยแนะนำ Claude Sonnet 5.5 และ Claude Opus 5.5 สำหรับการเขียนโค้ดแบบเอเจนต์ที่ซับซ้อน ในขณะที่วางตำแหน่ง Haiku สำหรับการบีบอัด การสรุป การจำแนกประเภท และบทบาทของเอเจนต์ย่อย

ภาพจากการประเมินอิสระมีความซับซ้อนกว่าและต้องใช้ความใส่ใจมากกว่า Artificial Analysis วัด Claude Haiku 5.5 ที่ Max effort ได้ 43 คะแนนบน Intelligence Index v4.3.2 ของตน เป็นอันดับสองจาก 182 โมเดล และได้ 241.9 output tokens ต่อวินาที — เร็วอย่างที่โฆษณาไว้ โดยยังวัดต้นทุนได้ที่ $0.21 ต่อ Index task ที่ทำสำเร็จหนึ่งงาน เพราะโมเดลสร้าง output tokens ถึง 440 ล้านโทเคนในการรันชุดทดสอบ เทียบกับค่ามัธยฐานที่ 100 ล้าน ผู้ประเมินจึงอธิบายว่ามันช่างพูดมากอย่างยิ่ง GPT-6 Luna ได้ 38 บนดัชนีเดียวกัน มีต้นทุน $0.07 ต่อ task ราคาติดป้ายเท่ากัน แต่บิลเป็นสามเท่า นั่นไม่ใช่การขัดแย้งกับคำกล่าวอ้างตอนเปิดตัว — มันคือปรากฏการณ์เดียวกันกับที่คำกล่าวอ้างตอนเปิดตัวพูดถึง เพียงแต่มองจากอีกด้านหนึ่ง: rate card คือสิ่งที่คุณจ่ายต่อโทเคน และตัวเลขที่คุณจ่ายจริงคือ rate คูณกับจำนวนโทเคน และ Claude Haiku 5.5 ใช้โทเคนต่อคำตอบมากกว่าคู่แข่ง Effort คือคันโยก และค่าเริ่มต้นของโมเดลคือ medium ไม่ใช่ Max และทีมที่ตั้งค่าให้ต่ำลงจะเห็นทั้งบิลที่เล็กลงและคะแนนที่ต่ำลงด้วย

เรียกมันจากที่เดียว

คำถามเรื่องการย้ายระบบที่การเปิดตัวครั้งนี้ก่อขึ้นมาไม่ใช่ "ดีกว่าหรือเปล่า" แต่เป็น "ทราฟฟิกของฉันมีค่าใช้จ่ายเท่าไรบนนั้น" และคำตอบนั้นขึ้นอยู่กับความยาวพรอมป์ต์ของคุณ อัตราการแฮิตแคช และการตั้งค่าระดับความพยายามที่คุณเลือก การไปให้ถึงจุดนั้นหมายถึงการรันชุดพรอมป์ต์ของคุณเองผ่านทั้งสองเจเนอเรชัน — ซึ่งทำได้ถูกเมื่ออยู่หลังเอนด์พอยต์เดียว และน่าเบื่อหน่ายเมื่อต้องทำข้ามสองเอนด์พอยต์

Claude Haiku 5.5 เองยังไม่มีอยู่ในแค็ตตาล็อกของ OrcaRouter และการบอกเช่นนั้นตรง ๆ ก็มีประโยชน์กว่าการทำให้เข้าใจเป็นอย่างอื่น ส่วนรุ่นอื่น ๆ ในสาย Anthropic ได้แก่ Claude Haiku 4.5, Claude Sonnet 5.5 และ Claude Opus 5.5 ล้วนเรียกใช้ได้จากเราวันนี้ในราคาตามที่ค่ายกำหนด โดยมีการบวกกำไร 0% ส่งผ่านตรงถึงคุณ ดังนั้นขา "ก่อน" ของการทดสอบย้ายระบบจึงรันบนคีย์เดียวกับที่คุณจะใช้ต่อ และหากค่ายปรับลดราคาในขานั้น ฝั่งเราก็พร้อมใช้ทันทีในวันเดียวกัน ขา "หลัง" คือ API ของ Anthropic จนกว่าโมเดลใหม่จะไปถึงรันไทม์ที่เราเราเตอร์ให้ สิ่งที่เอนด์พอยต์ร่วมมอบให้ระหว่างนี้คือการสลับไปใช้ระบบสำรองอัตโนมัติภายใต้การเรียกนั้น เพื่อให้โมเดลใหม่รับทราฟฟิกโปรดักชันได้โดยที่เส้นทางไม่ต้องพึ่งพามัน และมี DSL สำหรับจัดเส้นทางสำหรับกรณีที่การยกระดับจาก Haiku ไปเป็น Sonnet ควรอยู่ในเส้นทางมากกว่าในโค้ดแอปพลิเคชันของคุณ

A screenshot of OrcaRouter's model page for anthropic/claude-haiku-4.5, showing the model card and its list pricing of $1.00 per million input tokens and $5.00 per million output tokens, captured in English.

ผลลัพธ์จากลูกค้าสองรายในการเปิดตัวครั้งนี้ควรนำไปใช้ต่อเป็นเบาะแสมากกว่าเป็นหลักฐาน Asana รายงานว่าลดความหน่วงได้กว่า 30% และการอนุมานเร็วขึ้นสูงสุด 2.5 เท่าต่อเทิร์นของเอเจนต์; HubSpot รายงาน 92.8% โดยเฉลี่ยจากการรันสามครั้งบนชุด CRM ของตน; AlphaSense รายงาน 0.84 เทียบกับ 0.76 จาก 400 คำค้นหา ตัวเลขลูกค้าเหล่านี้เป็นตัวเลขที่ผู้ขายเลือกมาเองในประกาศของผู้ขายเอง และคุณค่าของมันอยู่ที่การบอกคุณว่าควรทดสอบเวิร์กโหลดใดก่อน ไม่ใช่การบอกว่าคุณจะได้อะไร

อะไรจะทำให้ภาพเปลี่ยนไป

ตัวเลข 75% จะถูกตัดสินด้วยวิธีเดียวกับที่คำกล่าวอ้างของผู้ขายทุกรายที่ถ่วงน้ำหนักด้วยปริมาณทราฟฟิกถูกตัดสิน นั่นคือ ด้วยใบแจ้งหนี้ของคุณเอง สิ่งที่ยังเป็นข้อถกเถียงอย่างแท้จริงในฝั่งอิสระก็คือตัวเลขต้นทุนต่อภารกิจ หากตัวเลขนี้ยังคงอยู่เมื่อมีการรันสะสมมากขึ้น บทสรุปที่ซื่อตรงของการเปิดตัวครั้งนี้ก็คือ Anthropic ลดอัตราค่าบริการลง 80% และสร้างโมเดลที่ใช้โทเคนต่อคำตอบมากขึ้น ดังนั้นการประหยัดที่แท้จริงจึงมีอยู่จริง มีขนาดใหญ่ ขึ้นอยู่กับลักษณะงาน และแทบไม่เคยเป็นตัวเลขที่อยู่บนโปสเตอร์ หากตัวเลขนี้ลดลงเมื่อปรับค่าความพยายามและใช้แคช ระดับชั้นนี้ก็จะยิ่งดูดีขึ้นไปอีก ไม่ว่าจะทางไหน ตัวเลขที่ต้องตรวจสอบก่อนการย้ายระบบก็คือจำนวนโทเคนต่อภารกิจของคุณเองภายใต้ตัวแบ่งโทเคนตัวใหม่ — นั่นคือตัวเลขเดียวที่โพสต์เปิดตัวไม่สามารถให้คุณได้

A screenshot of the Artificial Analysis model page for Claude Haiku 5.5 at maximum effort, showing an Intelligence Index of 43 on v4.3.2 at rank 2 of 182 models, a 1,000,000-token context window, 241.9 output tokens per second at rank 8 of 182, a cost of $0.21 per Intelligence Index task, and 440 million output tokens against a 100 million median.

การเปรียบเทียบในบทความนี้1

ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน

© 2026 OrcaRouter

สำหรับผู้ให้บริการ

ให้บริการแพลตฟอร์มการอนุมานอยู่หรือไม่ นำโมเดลของคุณขึ้น OrcaRouter

providers@orcarouter.ai

เข้าร่วมคอมมูนิตี้ของเรา

Discordsupport@orcarouter.aiXGitHubYouTube