
สรุปข่าว AI ประจำวัน, 8 ต.ค.: Claude Haiku 5.5 เปิดตัวที่ราคา $0.10 และ Sonnet 5.5 อ่านแคชลดลงครึ่งหนึ่ง
- openaiใหม่OpenAI: GPT-6.1 Sol2026-09-2952ความฉลาด
- anthropicใหม่Anthropic: Claude Sonnet 5.52026-09-2856ความฉลาด
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 ต่อ 1 ล้านโทเค็น · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238ความฉลาด
- OpenAIOpenAI: GPT-6 Sol2026-09-2248ความฉลาด
- AnthropicAnthropic: Claude Opus 5.52026-09-2258ความฉลาด
- xAIGrok 4.72026-09-2146ความฉลาด
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 ต่อ 1 ล้านโทเค็น · 56 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 ต่อ 1 ล้านโทเค็น · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040ความฉลาด
- OpenAIOpenAI: GPT-6 Astra2026-09-0453ความฉลาด77การเขียนโค้ด
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241ความฉลาด76การเขียนโค้ด
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245ความฉลาด76การเขียนโค้ด
- AnthropicAnthropic: Claude Fable 5.12026-09-0153ความฉลาด82การเขียนโค้ด
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 ต่อ 1 ล้านโทเค็น · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 ต่อ 1 ล้านโทเค็น · 347 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642ความฉลาด72การเขียนโค้ด
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 ต่อ 1 ล้านโทเค็น · 230 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845ความฉลาด75การเขียนโค้ด
- obsidianQwen3.8 27B2026-08-1534ความฉลาด68การเขียนโค้ด
Claude Haiku 5.5 เปิดตัวเมื่อวันที่ 7 ตุลาคม 2026 และเป็นสิ่งที่ถูกที่สุดที่บริษัทเคยเปิดให้ใช้ผ่าน API: $0.10 ต่อโทเค็นอินพุตหนึ่งล้านโทเค็น และ $0.50 ต่อโทเค็นเอาต์พุตหนึ่งล้านโทเค็นบนพร้อมท์ที่มีขนาดไม่เกิน 100,000 โทเค็น โดยมีหน้าต่างบริบทขนาด 1 ล้านโทเค็นและปุ่มปรับระดับความพยายามตั้งแต่ Low ถึง Max ในวันเดียวกัน โดยไม่มีโพสต์เปิดตัวของตัวเอง การอ่านแคชพร้อมท์บน Claude Sonnet 5.5 ลดลงจาก $0.20 เหลือ $0.10 ต่อล้านโทเค็น หนึ่งในนั้นคือผลิตภัณฑ์และอีกอย่างคือรายการในบัญชี และรายการในบัญชีคือสิ่งที่ทำให้เกิดเม็ดเงินมากกว่าในไตรมาสนี้
ราคาก่อน เพราะเป็นส่วนที่คุณลงมือทำได้วันนี้ จากนั้นคือความพยายาม ซึ่งเป็นสิ่งที่กำหนดราคาอย่างเงียบ ๆ จากนั้นก็คือการลดค่าแคช ซึ่งคนที่จ่ายเงินสำหรับ Sonnet 5.5 อยู่ครึ่งหนึ่งจะไม่ได้ยินเรื่องนี้จนกว่าจะถึงใบแจ้งหนี้ครั้งถัดไป
Claude Haiku 5.5 คืออะไร เรียงตามลำดับความสำคัญ
กรอบคำอธิบายของผู้ขายเองคือ "โมเดลขนาดเล็กที่ถูกที่สุด เร็วที่สุด และมีความสามารถสูงสุดเท่าที่เราเคยเปิดตัวมา" และวันเปิดตัวคือวันที่ 7 ตุลาคม 2026 — หนึ่งวันก่อนหน้าสรุปฉบับนี้ รหัสโมเดลคือ claude-haiku-5-5 โดยรับข้อความและภาพเข้า และส่งออกเป็นข้อความ หน้าต่างบริบทอยู่ที่ 1,000,000 โทเค็น เพิ่มขึ้นจาก 200,000 ใน Claude Haiku 4.5 และเอาต์พุตสูงสุดคือ 128,000 โทเค็น โดยมี beta header บน Batch API ที่เพิ่มจำนวนนั้นเป็น 300,000 จุดตัดของการฝึกข้อมูลคือเดือนมิถุนายน 2026 และ Anthropic ให้คำมั่นว่าจะไม่ยกเลิกโมเดลนี้ก่อนวันที่ 7 ตุลาคม 2027
ประเด็นที่สำคัญที่สุดสำหรับใครก็ตามที่ต้องจัดเส้นทางทราฟฟิกไม่ใช่หน้าต่างบริบท แต่คือการที่โมเดลนี้เป็นโมเดลระดับ Haiku รุ่นแรกที่มีระดับความพยายาม (effort) ปรับได้ โดยระดับความพยายามมีตั้งแต่ Low, Medium, High, Xhigh และ Max ค่าเริ่มต้นคือ Medium และ adaptive thinking เปิดใช้งานเป็นค่าเริ่มต้น — ฟีเจอร์ของ Sonnet และ Opus ที่ลงมาสู่ระดับล่างหนึ่งขั้น โพสต์เปิดตัวยังมีอีกสองเรื่องที่เกี่ยวกับการซื้อมากกว่าการสร้าง ได้แก่ เครดิต API รายเดือนสำหรับแผน Claude Max และ Team โดยให้ $100 ที่ Max 5x และ $200 ที่ Max 20x พร้อมวงเงินรวมสูงสุด $500 สำหรับ Team และการรองรับ computer-use และ browser-use แบบเบต้าใน SDK ด้านความปลอดภัยก็ก้าวทันระดับนี้เช่นกัน มาตรการป้องกันด้านไซเบอร์เข้มงวดกว่าของ Claude Haiku 4.5 โดยคำขอทดสอบเจาะระบบยังคงถูกบล็อกอยู่ และมาตรการป้องกันด้านชีววิทยาเทียบเท่ากับที่มีใน Claude Sonnet 5, Claude Sonnet 5.5 และ Claude Opus 5

ราคา และหน้าผา 100,000 โทเค็นที่อยู่ตรงกลางของมัน
อัตราที่ประกาศคือ $0.10 ต่อโทเคนอินพุตหนึ่งล้านโทเคน และ $0.50 ต่อโทเคนเอาต์พุตหนึ่งล้านโทเคน อ่านหมายเหตุดอกจัน: นั่นคืออัตราสำหรับพรอมป์ต์ที่ 100,000 โทเคนหรือต่ำกว่า เมื่อเกิน 100,000 ตัวเลขทั้งสองจะคูณด้วยห้า เป็น $0.50 สำหรับอินพุต และ $2.50 สำหรับเอาต์พุต การเขียนแคชมีค่าใช้จ่าย $0.125 ต่อล้านในระดับห้านาที และ $0.20 ในระดับหนึ่งชั่วโมงภายในช่วงราคาถูก และการอ่านแคชมีค่าใช้จ่าย $0.01 ต่อล้าน — หนึ่งในสิบของอัตราอินพุต ซึ่งเป็นส่วนลดแคชที่ลึกที่สุดที่ Anthropic เคยประกาศสำหรับโมเดลใด ๆ แบบแบตช์ลดทุกอย่างลงครึ่งหนึ่งอีกครั้ง: $0.05 และ $0.25 ภายในช่วงราคาถูก, $0.25 และ $1.25 เมื่อเกินช่วงนั้น
ลองเทียบกับ Claude Haiku 4.5 ซึ่งยังอยู่ในรายการราคาที่คงที่ $1.00 สำหรับอินพุต และ $5.00 สำหรับเอาต์พุต โดยไม่มีการแบ่งระดับตามบริบท การอ่านแคชราคา $0.10 และหน้าต่าง 200,000 โทเคน โมเดลใหม่มีราคาเป็นหนึ่งในสิบเมื่อใช้รูปแบบพรอมป์ต์เดียวกัน โดยมีบริบทมากกว่าถึงห้าเท่า ไม่มีอะไรต้องคำนวณเรื่องการย้ายระบบให้ยุ่งยากตรงนี้ ตัวเลขไม่ได้ใกล้เคียงกันเลย
หน้าผาคือส่วนที่ต้องออกแบบให้หลบเลี่ยง พรอมป์ต์ขนาด 99,000 โทเคนมีค่าใช้จ่าย 99 เซนต์ต่อการเรียกหนึ่งพันครั้งในอัตราอินพุต พรอมป์ต์ขนาด 101,000 โทเคนมีค่าใช้จ่าย $5.05 ต่อพันครั้ง โทเคนต่างกันสองพันตัวทำให้บิลต่างกัน 5 เท่า ดังนั้นอะไรก็ตามที่คุณสร้างในย่านราคาถูกควรอยู่ในระดับต่ำกว่า 100,000 โทเคนอย่างสบาย ๆ หรือไม่ก็ตั้งใจให้เกินอย่างสม่ำเสมอ ผลลัพธ์ที่แย่ที่สุดคือไปป์ไลน์ที่คร่อมเส้นไว้ แล้วต้องจ่ายอัตราสูงกับครึ่งหนึ่งของทราฟฟิก
ความพยายามกลายเป็นพารามิเตอร์ด้านราคาไปแล้ว และค่าเริ่มต้นก็ไม่ใช่ตัวที่ถูกที่สุด
เนื่องจาก effort มีค่าเริ่มต้นเป็น Medium และ thinking เปิดอยู่โดยค่าเริ่มต้น ราคาที่ติดป้ายกับราคาจริงจึงไม่ใช่ตัวเลขเดียวกัน โทเค็นการให้เหตุผลถูกคิดค่าใช้จ่ายเป็นโทเค็นเอาต์พุต ในการรันที่ Anthropic เผยแพร่เองของ Artificial Analysis Intelligence Index — ซึ่งผู้ขายรายงานเอง เราไม่ได้ทำซ้ำ — Claude Haiku 5.5 ส่งออกประมาณ 162,000 โทเค็นต่องาน โดยประมาณ 129,000 เป็นการให้เหตุผล โมเดลค่ามัธยฐานของดัชนีนี้ส่งออกในระดับ 100 ล้านโทเค็นตลอดชุดการทดสอบ; Haiku 5.5 ใช้ไป 440 ล้าน ที่ราคา $0.50 ต่อล้านโทเค็นเอาต์พุต ความเยิ่นเย้อนั้นจ่ายไหว และนั่นคือประเด็นสำคัญพอดี: ในอัตราของ Haiku 5.5 การคิดเยอะยังคงถูกกว่าการคิดน้อยบนโมเดลที่คิดราคา $5.00 ต่อเอาต์พุต
ตั้งค่า Effort เป็น Low สำหรับการตัดสินใจด้านการจำแนกประเภท การสกัดข้อมูล และการกำหนดเส้นทาง เมื่อคุณต้องการคำตอบที่รวดเร็วมากกว่าคำตอบที่ผ่านการพิจารณา และปล่อยไว้ที่ Medium สำหรับสิ่งใดก็ตามที่ผู้ใช้จะอ่าน การลดลงเป็น Low ยังเป็นวิธีที่เชื่อถือได้ในการทำให้เอเจนต์ที่ตอบยาวอยู่ภายในช่วง 100,000 โทเคน เนื่องจากมันตัดโทเคนสำหรับการให้เหตุผลก่อนที่จะตัดโทเคนเอาต์พุต
ประเด็นที่เงียบกว่า: การอ่านแคชของ Sonnet 5.5 ลดลงครึ่งหนึ่ง
Claude Sonnet 5.5 อ่านพรอมป์ที่แคชไว้ในราคา $0.10 ต่อหนึ่งล้านโทเค็น ณ วันที่ 7 ตุลาคม ลดลงจาก $0.20 ราคาอินพุตของ Sonnet 5.5 อยู่ที่ $2.00 และเอาต์พุตอยู่ที่ $10.00 ดังนั้นตัวคูณการอ่านแคช 0.05x ตอนนี้จึงเป็นตัวคูณเดียวกับที่ Haiku 5.5 มี โดยนำไปใช้กับอัตราอินพุตที่ใหญ่กว่ายี่สิบเท่า ประมาณการของ Anthropic เองระบุว่าสิ่งนี้ลดต้นทุนของงานแบบเอเจนติกส่วนใหญ่ลงราว 20% ซึ่งเป็นข้อกล่าวอ้างเกี่ยวกับลักษณะของภาระงานมากกว่าจะเป็นเบนช์มาร์ก โดยจะเป็นจริงก็ต่อเมื่ออินพุตส่วนใหญ่ของคุณเป็นพรีฟิกซ์ที่คงที่ซึ่งคุณส่งซ้ำในทุกเทิร์น หากพรอมป์ของคุณมีเอกลักษณ์เฉพาะในทุกการเรียก การเปลี่ยนแปลงนี้ไม่ทำให้คุณเสียค่าใช้จ่ายและไม่ช่วยคุณประหยัดอะไรเลย
น่าสังเกตว่าการลดราคานี้บ่งชี้ถึงอะไร Anthropic กำลังตั้งราคาพรีฟิกซ์อายุยาวอย่างเชิงรุกบนโมเดลระดับกลาง ในจังหวะเดียวกับที่เพิ่งเปิดตัวโมเดลขนาดเล็กที่ราคาถูกมาก ซึ่งอ่านได้ว่าเป็นข้อสนับสนุนสำหรับสถาปัตยกรรมแบบสองโมเดล: ขา Sonnet 5.5 ที่มีแคชร้อนสำหรับงานที่ต้องใช้วิจารณญาณ และขา Haiku 5.5 สำหรับปริมาณงานที่ไม่ต้องใช้วิจารณญาณ
สิ่งที่ตัวเลขอิสระแสดงให้เห็น ในหนึ่งวัน
Artificial Analysis ได้ให้คะแนน Claude Haiku 5.5 ในวันถัดจากเปิดตัว ดัชนี Intelligence Index อยู่ที่ 43 โดยรวม โดยการกำหนดค่า Max-effort รายงานที่ 43.40 เป็นอันดับสองจาก 182 โมเดลบนบอร์ด ค่าใช้จ่ายต่องานดัชนีคือ $0.21 ถูกเป็นอันดับที่ 46 ราคาผสมที่สัดส่วนอินพุตต่ออินพุตแคชต่อเอาต์พุต 7:2:1 อยู่ที่ $0.08 ต่อล้าน ซึ่งเป็นตัวเลขที่ทำให้การเปรียบเทียบระดับก่อนหน้ารู้สึกไม่ยุติธรรมกับอย่างอื่นทั้งหมด ความเร็วเอาต์พุตคือ 243.4 โทเคนต่อวินาที เร็วเป็นอันดับเก้าบนบอร์ด โดยมีเวลาแฝงของโทเคนแรกที่รายงานประมาณ 0.3 วินาที และส่วนลดแคช 90%
ตัวเลขผลลัพธ์ 440 ล้านโทเคนนั่นคือข้อแม้ที่แนบมากับคะแนน 43 คะแนนนั้น คะแนนนี้เป็นของจริงและถูกรันอย่างอิสระ ความยาวเยิ่นเย้อก็เช่นกัน โมเดลที่คิดมากขนาดนี้มีต้นทุนถูกต่อโทเคน แต่ไม่ได้ถูกต่อภารกิจเสมอไป และช่องว่างระหว่างตัวเลขสองตัวนั้นคือที่ที่การตัดสินใจเรื่องการจัดเส้นทางอยู่จริง ๆ
เพื่อให้เห็นขนาด การเปรียบเทียบที่ Anthropic เผยแพร่เองชี้ว่า Claude Haiku 5.5 อยู่ที่ 1620 บน GDPval-AA v2.1 เทียบกับ 735 สำหรับ Claude Haiku 4.5, 72.4% บน OSWorld 2.1 เทียบกับ 15.7%, 45.9% บน Humanity's Last Exam โดยไม่ใช้เครื่องมือ เทียบกับ 10.2%, และ 39.2% บน Terminal-Bench 4.0 เทียบกับ 0.0% ตัวเลขเหล่านั้นเป็นตัวเลขที่ผู้ขายรายงานจากการประเมินที่ผู้ขายเลือกเอง และควรอ่านเป็นเพียงทิศทาง แต่ทิศทางนั้นไม่ใช่เรื่องละเอียดอ่อน — นี่ไม่ใช่การอัปเกรดเล็ก ๆ ให้กับโมเดลเล็ก ๆ

การเข้าถึงโมเดลเหล่านี้โดยไม่ต้องมีสัญญาฉบับที่สอง
Claude Haiku 5.5 ให้บริการผ่าน API ของ Anthropic เอง และจากตรงนั้นก็มีให้ใช้ทุกที่ที่มีการจำหน่ายโมเดลของ Anthropic ต่อ ในแค็ตตาล็อกของ OrcaRouter ปัจจุบันสาย Anthropic ประกอบด้วย anthropic/claude-haiku-4.5, anthropic/claude-sonnet-5.5, anthropic/claude-opus-5.5 และ anthropic/claude-fable-5.1 — เราไม่ได้โฮสต์ Claude Haiku 5.5 และบทความนี้จะไม่แกล้งทำเป็นอย่างอื่น สิ่งที่เรามีให้บริการคือรุ่นที่อยู่เหนือขึ้นไปหนึ่งขั้น และ OrcaRouter ส่งต่อราคาตามที่ผู้ให้บริการระบุไว้โดยบวกเพิ่ม 0% ซึ่งเป็นเหตุผลว่าทำไม การลดราคาค่า cache-read ของ Sonnet 5.5 จึงปรากฏในราคาของเราวันเดียวกับที่ Anthropic ประกาศปรับลด แทนที่จะเป็นไปตามรอบการปรับราคาที่กำหนดไว้
เวอร์ชันที่นำไปใช้จริง: ถ้าคุณต้องการลองใช้ Haiku 5.5 กับขาการจำแนกประเภท ขณะที่ขาการตัดสินใจยังคงใช้ Claude Sonnet 5.5 อยู่ คุณกำลังถือกุญแจสองดอกแทนที่จะเป็นดอกเดียว และเลเยอร์การจัดเส้นทางคือจุดที่การทดสอบ A/B ถูกตัดสิน นั่นคือเหตุผลทั้งหมดที่ควรใช้เกตเวย์แทนการเชื่อมต่อโดยตรง — ปลายทางเดียว สตริงโมเดล และเส้นทาง failover เมื่อผู้ให้บริการสะดุด

สิ่งที่ต้องจับตาจากนี้ไป
สามเรื่องด้วยกัน เรื่องแรกคือผู้ให้บริการบุคคลที่สามจะเริ่มขายต่อ Haiku 5.5 ในอัตราผสมที่ต่ำกว่า $0.10 หรือไม่ ซึ่งเป็นจุดที่ชั้นการกำหนดเส้นทางจะพิสูจน์คุณค่าของตัวเอง แทนที่จะเพียงทำให้การจัดซื้อง่ายขึ้น เรื่องที่สองคือ Anthropic จะขยายขอบเขตระดับชั้น 100,000 โทเคนหรือไม่ เพราะหน้าผาตรงที่ 100,000 พอดีเป็นจุดที่แปลกสำหรับโมเดลที่มีหน้าต่าง 1M โทเคนที่จะมีหน้าผาแบบนั้น และเรื่องที่สามคือตัวเลขความเยิ่นเย้อ 440 ล้านโทเคนจะลดลงในพอยต์รีลีสหรือไม่ เพราะตัวเลขเดียวนี้คือสิ่งที่กั้นระหว่าง Haiku 5.5 กับการเป็นค่าเริ่มต้นที่ชัดเจนสำหรับครึ่งล่างทั้งหมดของสแตกโปรดักชัน
