
Claude Sonnet 5.5 เปิดตัวแล้วบน Claude และ API — พร้อมการเปลี่ยนแปลง 5 ข้อที่ทำให้โค้ดเดิมใช้งานไม่ได้
- typesafeใหม่TypeSafe: Jev 1.132026-09-24$0.04 / $0.00 ต่อ 1 ล้านโทเค็น · 348 tok/s
- OpenAIใหม่OpenAI: GPT-6 Luna2026-09-2237ความฉลาด
- OpenAIใหม่OpenAI: GPT-6 Sol2026-09-2248ความฉลาด
- Anthropicใหม่Anthropic: Claude Opus 5.52026-09-2258ความฉลาด
- xAIใหม่Grok 4.72026-09-2146ความฉลาด
- Orcaใหม่Orca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 ต่อ 1 ล้านโทเค็น · 107 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 ต่อ 1 ล้านโทเค็น · 969 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040ความฉลาด
- OpenAIOpenAI: GPT-6 Astra2026-09-0453ความฉลาด77การเขียนโค้ด
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241ความฉลาด76การเขียนโค้ด
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245ความฉลาด76การเขียนโค้ด
- AnthropicAnthropic: Claude Fable 5.12026-09-0153ความฉลาด82การเขียนโค้ด
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 ต่อ 1 ล้านโทเค็น · 48 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 ต่อ 1 ล้านโทเค็น · 106 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642ความฉลาด72การเขียนโค้ด
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 ต่อ 1 ล้านโทเค็น · 219 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845ความฉลาด75การเขียนโค้ด
- obsidianQwen3.8 27B2026-08-1534ความฉลาด68การเขียนโค้ด
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236ความฉลาด69การเขียนโค้ด
- xAISpaceXAI: Grok 4.62026-08-1244ความฉลาด77การเขียนโค้ด
Claude Sonnet 5.5 เปิดใช้งานแล้ว ประกาศของผู้ให้บริการลงวันที่ 28 กันยายน 2026 หน้าโมเดลของ Claude Platform ระบุว่าเป็น "Latest" และตัวระบุคือ claude-sonnet-5-5 ครอบคลุม Claude API, Amazon Bedrock, คอนโซลคลาวด์, Microsoft Foundry และ Claude Platform บน AWS การทยอยเปิดตัวไปยัง Claude เองและไปยัง API คือส่วนที่กำลังเกิดขึ้นในสัปดาห์นี้ ส่วนที่จะทำให้คุณเสียเวลาหนึ่งวันอยู่ที่อื่นในเอกสารเดียวกัน: การเปลี่ยนแปลงที่ทำให้โค้ดเดิมใช้งานไม่ได้ห้ารายการส่งผลกระทบต่อโค้ดที่ทำงานอยู่แล้วบน Claude Sonnet 5 และรายการที่หกเปลี่ยนแปลงรูปแบบการตอบกลับโดยไม่ทำให้คำขอใดล้มเหลวเลย
นี่คือหน้าตาของการออกรุ่นครั้งนี้ เรตการ์ดไม่ขยับ: Claude Sonnet 5.5 มีค่าใช้จ่าย $2 ต่อโทเคนอินพุตหนึ่งล้านโทเคน และ $10 ต่อโทเคนเอาต์พุตหนึ่งล้านโทเคน เท่ากับที่ Claude Sonnet 5 คิดพอดี โดยมีการอ่านแคชที่ $0.20 และการเขียนแคชแบบ 5 นาทีที่ $2.50 แต่ขีดความสามารถขยับไปไกลมาก ในฉบับปรับปรุงล่าสุดของ Artificial Analysis โมเดลใหม่นี้อยู่สูงกว่าโมเดลที่มันมาแทนถึง 18 คะแนน ซึ่งเป็นช่องว่างที่กว้างที่สุดระหว่างโมเดล Sonnet สองรุ่นที่ต่อเนื่องกันบนกระดานนั้น ต้นทุนในการย้ายจึงกว้างที่สุดตามไปด้วย ไม่มีข้อใดในนั้นเป็นการบ่น — โมเดลที่เก่งขึ้นโดยไม่แพงขึ้นถือเป็นกรณีที่ดี — แต่ข้อเท็จจริงสองข้อนี้มาพร้อมกัน และบันทึกการออกรุ่นคือครึ่งหนึ่งที่ตัดสินว่าสัปดาห์ของคุณจะราบรื่นหรือไม่
อะไรที่ถูกส่งมอบจริงในวันที่ 28 กันยายน

ข้อกำหนดนี้เป็นความต่อเนื่องโดยตรงของระดับมากกว่าที่จะเป็นรูปแบบใหม่:
• รหัสโมเดล — claude-sonnet-5-5 บน Claude API, Claude Platform บน AWS และ Microsoft Foundry; anthropic.claude-sonnet-5-5 บน Amazon Bedrock
• ราคา — $2 / MTok สำหรับอินพุต, $10 / MTok สำหรับเอาต์พุต, $2.50 สำหรับเขียนแคช 5 นาที, $4 สำหรับเขียนแคช 1 ชั่วโมง, $0.20 สำหรับอ่านแคช
• Batch — ลด 50% ทั้งสองทาง ดังนั้น $1 / $5 ต่อ MTok
• บริบทและเอาต์พุต — อินพุต 1M โทเคน, เอาต์พุต 128K โทเคนแบบซิงโครนัส, เอาต์พุต 300K บน Message Batches API เมื่อใช้{{2}}output-300k-2026-03-24{{/2}}{{3}} ส่วนหัวเบต้า{{/3}}output-300k-2026-03-24 ส่วนหัวเบต้า
• การคิด — ปรับเปลี่ยนได้ โดยมีระดับความพยายามเริ่มต้นที่ สูง; จุดตัดความรู้และการฝึกอบรมเป็นเดือนมิถุนายน 2026 ทั้งคู่
• วงจรชีวิต — ไม่มีการเก็บรักษาข้อมูลเลยตั้งแต่เปิดตัว และมีกำหนดการเลิกใช้งานขั้นต่ำที่เผยแพร่ไว้ซึ่งไม่เร็วกว่าวันที่ 28 กันยายน 2027
รายละเอียดสองข้อที่มองข้ามได้ง่ายและมีความสำคัญ ข้อแรก ไม่มีค่าธรรมเนียมเพิ่มเติมสำหรับบริบทแบบยาว: Anthropic คิดค่าบริการหน้าต่าง 1M โทเค็นเต็มในอัตรามาตรฐาน ดังนั้นคำขอ 900,000 โทเค็นจึงมีค่าใช้จ่ายต่อโทเค็นเท่ากับคำขอ 9,000 โทเค็น ข้อที่สอง อัตรา $2 / $10 สำหรับโมเดลก่อนหน้านี้เดิมทีเป็นราคาช่วงแนะนำ โดยมีกำหนดการขึ้นราคาเป็น $3 / $15 ในวันที่ 1 กันยายน 2026; หน้าเว็บราคาของ Anthropic ระบุในขณะนี้ว่าการขึ้นราคาจะไม่เกิดขึ้น ซึ่งทำให้ราคาปัจจุบันของระดับ Sonnet เป็นคำมั่นสัญญาถาวรแทนที่จะเป็นโปรโมชัน ทั้งสองข้อนั้นเป็นคำกล่าวอ้างของผู้ขาย ไม่ใช่ผลการค้นพบที่เป็นอิสระ
รายการการโยกย้าย เรียงตามลำดับที่จะส่งผลกระทบ
ภาพรวม Sonnet 5.5 ของ Anthropic ตรงไปตรงมาเกี่ยวกับเรื่องนี้อย่างผิดปกติ: การเปลี่ยนแปลงที่ทำให้โค้ดเดิมเสีย 5 ประการส่งผลต่อโค้ดที่ทำงานอยู่บน Claude Sonnet 5 แล้ว สิ่งเหล่านี้ไม่ใช่การเปลี่ยนแปลงเชิงสไตล์ แต่ละข้อจะส่งคืนข้อผิดพลาดหรือเปลี่ยนพฤติกรรมอย่างเงียบ ๆ
• การบังคับให้ใช้เครื่องมือจะถูกปฏิเสธการกำหนดค่า tool_choice เป็น "any" หรือเป็นชื่อเครื่องมือที่ระบุ ตอนนี้จะส่งคืนข้อผิดพลาดแทนที่จะบังคับโมเดล หากลูปเอเจนต์ของคุณตรึงเครื่องมือไว้เพื่อรับประกันการเรียกแบบมีโครงสร้าง ลูปนั้นจะหยุดทำงานตั้งแต่คำขอแรก ทางแก้คือปล่อยให้โมเดลเลือกและตรวจสอบความถูกต้องแทน หรือย้ายการรับประกันไปไว้ใน structured outputs
• thinking: {"type": "disabled"} ถูกปฏิเสธ การปิด thinking โดยสิ้นเชิงไม่ใช่การตั้งค่าที่รองรับอีกต่อไป สิ่งที่ใช้แทนคือ between_tools, ซึ่งปิดการคิดล่วงหน้าและทำงานที่ high ระดับความพยายามหรือต่ำกว่า เป็นการตั้งค่าการคิดที่ต่ำที่สุดบนโมเดล ไม่ใช่สวิตช์ปิด
• บล็อกการคิดถูกผูกไว้กับโมเดลและบทสนทนา การใช้เหตุผลที่เทิร์นก่อนหน้าสร้างขึ้นจะสืบทอดต่อไปจาก Claude Sonnet 5 ไปยัง Claude Sonnet 5.5 แต่จะไม่ส่งต่อไปยังตระกูลอื่น และไม่ข้ามบัญชี แอปพลิเคชันที่เล่นทรานสคริปต์ซ้ำข้ามเวอร์ชันโมเดลจะพบบล็อกการคิดถูกปฏิเสธในจุดที่ก่อนหน้านี้เคยได้รับการยอมรับ
• computer_20251124 ไม่ได้รับการยอมรับบน Claude API หรือ Google Cloud โค้ดที่ประกาศเวอร์ชันเครื่องมือ computer-use ก่อนหน้านี้ต้องย้ายไปยังชุดเครื่องมือปัจจุบัน
• เครื่องมือที่ปรึกษาปฏิเสธตระกูลของตัวเอง Claude Opus 4.8, Claude Opus 4.7 และ Claude Sonnet 5 ถูกปฏิเสธไม่ให้ทำหน้าที่เป็นที่ปรึกษา ดังนั้นไปป์ไลน์ใดก็ตามที่ใช้โมเดล Claude ขนาดเล็กกว่าเป็นตัวตรวจสอบเทียบกับโมเดลที่ใหญ่กว่า จึงจำเป็นต้องจับคู่ใหม่
จากนั้นก็มีการเปลี่ยนแปลงที่ไม่ได้ทำให้อะไรพัง ข้อความที่โมเดลส่งออกระหว่างการเรียกเครื่องมือตอนนี้จะมาอยู่ในthinkingบล็อก แทนที่จะเป็นเอาต์พุตปกติ แอปพลิเคชันที่สตรีมข้อความให้ผู้ใช้จะเงียบไประหว่างการเรียกเครื่องมือ — ไม่มีข้อผิดพลาด ไม่มีข้อยกเว้น แค่ UI ที่ดูเหมือนค้าง จนกว่าคุณจะตั้งค่า displayที่คืนข้อความ หรือสลับไปใช้ between_tools นี่คือโหมดความล้มเหลวที่มีแนวโน้มไปถึงโปรดักชันมากที่สุด เพราะไม่มีอะไรในชุดทดสอบโยนข้อผิดพลาด
อีกเรื่องหนึ่ง เพื่อความครบถ้วน: การตั้งค่า temperature, top_p หรือ top_kเป็นค่าใดก็ตามที่ไม่ใช่ค่าเริ่มต้นจะคืนค่า 400 หากเกตเวย์หรือไลบรารีไคลเอนต์ของคุณตั้งค่า temperature เพราะความเคยชินมากกว่าเจตนา ความเคยชินนั้นก็กลายเป็นเหตุขัดข้องไปแล้ว
ข้ออ้าง 30% เทียบกับตัวเลขอิสระ

ข้อความทางการตลาดของ Anthropic สำหรับ Claude Sonnet 5.5 คือ "มีค่าใช้จ่ายต่องานต่ำกว่ารุ่นก่อนได้สูงสุดถึง 30%" ณ อัตราต่อโทเค็นที่เท่ากัน และ "สร้างเอาต์พุตได้เร็วกว่า Claude Sonnet 5 ตั้งแต่ 30% ขึ้นไป" ทั้งสองเป็นข้อกล่าวอ้างเกี่ยวกับโทเค็น ไม่ใช่ราคา และทั้งคู่เป็นข้อมูลที่ผู้ขายรายงานเอง กลไกเบื้องหลังข้อแรกปรากฏให้เห็นในตาราง benchmark ของผู้ขายเอง: ที่ Medium effort บน Terminal-Bench Anthropic กล่าวว่า Claude Sonnet 5.5 เอาชนะคะแนนดีที่สุดของ Claude Sonnet 5 ได้ด้วย "ค่าใช้จ่ายต่องานน้อยกว่าหนึ่งในสิบ" และมีการกล่าวอ้างในลักษณะเดียวกันสำหรับ CursorBench ที่ Low effort และ AA-Briefcase ที่ Medium
ภาพจากแหล่งอิสระเห็นพ้องกันในเรื่องทิศทาง แต่เห็นต่างกันในเรื่องขนาด บนดัชนี Intelligence Index v4.3.2 ของ Artificial Analysis — การประเมินสิบรายการที่รันภายใต้การตั้งค่าเดียวกันสำหรับทุกโมเดล — Claude Sonnet 5.5 ได้ 56 คะแนน ซึ่งหน้านั้นจัดให้อยู่อันดับ 3 จาก 216 Claude Sonnet 5 ได้ 38 คะแนนบนกระดานเดียวกัน นั่นคือการขยับ 18 จุดระหว่างสองโมเดลที่ต่อเนื่องกันในระดับเดียวกันและราคาเดียวกัน และเป็นช่องว่างที่ใหญ่ที่สุดที่ Anthropic เปิดขึ้นภายในตระกูล Sonnet ในปีนี้
ตัวเลขต้นทุนคือจุดที่ข้อกล่าวอ้างของผู้ขายเริ่มยึดไว้ได้ยากขึ้น Artificial Analysis วัด Claude Sonnet 5.5 ไว้ที่ $7.60 ต่องาน Intelligence Index ที่ทำเสร็จหนึ่งงาน ตัวเลขนั้นไม่ได้ต่ำกว่าสิ่งใดในระดับเดียวกันถึง 30% เพราะโมเดลนี้เขียนยาวเยิ่นเย้ออย่างมาก: มันปล่อยโทเคนเอาต์พุต 410 ล้านโทเคนเพื่อทำการประเมิน Index ให้เสร็จ เทียบกับค่ามัธยฐานที่ 88 ล้านในบรรดาโมเดลที่เทียบเคียงได้ ประสิทธิภาพต่อโทเคนกับประสิทธิภาพต่องานเป็นปริมาณที่ต่างกัน และ Claude Sonnet 5.5 เก่งเป็นพิเศษในแบบแรก แต่แค่ระดับเฉลี่ยในแบบที่สอง
ตัวเลข benchmark ทั้งหมดของ Anthropic เองสำหรับการเปิดตัวครั้งนี้เป็นข้อมูลที่ผู้ขายรายงานและยังไม่ถูกทำซ้ำโดยบุคคลที่สาม และสองตัวเลขในนั้นมีเชิงอรรถที่ควรค่าแก่การกล่าวซ้ำ: ตัวเลข GDPval-AA v2.1 และ AA-Briefcase v1.1 ถูกทดสอบโดย Artificial Analysis บนดีพลอยเมนต์ก่อนเปิดตัวซึ่งมีบั๊กที่อาจทำให้คะแนนต่ำกว่าความเป็นจริง และบันทึกของ Anthropic เกี่ยวกับตัวเลข FrontierCode 1.1 อธิบายว่าทำไม Claude Sonnet 5.5 จึงได้คะแนนต่ำกว่าเมื่อใช้ Max effort เมื่อเทียบกับ Xhigh ในการประเมินนั้น ตารางที่โมเดลเอาชนะตัวเองได้ที่การตั้งค่า effort ต่ำกว่า คือตารางที่บอกคุณว่าคอนฟิกูเรชัน benchmark ของมันยังไม่ลงตัว
จะทดสอบมันได้อย่างไรโดยไม่ต้องเสี่ยงกับเส้นทางโปรดักชัน
มีเหตุผลเฉพาะเจาะจงในการรัน Claude Sonnet 5.5 ผ่านเราเตอร์ แทนที่จะยิงตรงไปยัง endpoint ของผู้ให้บริการในการย้ายระบบ: คุณไม่จำเป็นต้องเลือกระหว่างโมเดลเก่ากับโมเดลใหม่ในระหว่างที่คุณกำลังหาคำตอบ บน OrcaRouter, Claude Sonnet 5 สามารถกำหนดเส้นทางได้ตั้งแต่วันที่ 30 มิถุนายน ในราคา $2 / $10 ของ Anthropic เอง โดยไม่มีการบวกส่วนเพิ่ม เป็นหนึ่งในโมเดลมากกว่า 200 รายการที่อยู่เบื้องหลัง endpoint เดียวที่เข้ากันได้กับ OpenAI และยังคงเป็นโมเดลที่ปริมาณการใช้งาน Claude API ส่วนใหญ่ใช้อยู่ Claude Sonnet 5.5 ยังไม่อยู่ในแคตตาล็อกของเรา ดังนั้นเส้นทางไปยังมันในวันนี้คือ API ของ Anthropic เอง
รูปแบบที่ได้ผลในระหว่างนี้คือการส่งทราฟฟิกเพียงบางส่วนไปยังโมเดลใหม่ และ ให้ระบบสำรองรับช่วงส่วนที่เหลือ — โดยมี Claude Sonnet 5 เป็นตัวสำรอง ดังนั้น 400 จากหนึ่งในห้าการเปลี่ยนแปลงที่ทำให้เสียความเข้ากันได้จะถดถอยลงเป็นคำตอบที่ช้าลง แทนที่จะเป็นคำขอที่ล้มเหลว นี่เป็นวิธีที่ประหยัดที่สุดในการวัดสิ่งที่คำกล่าวอ้างของผู้ขายไม่ได้บอกคุณด้วยเช่นกัน: จำนวนโทเค็นต่องานของคุณเองบนทั้งสองโมเดลที่การตั้งค่าระดับความพยายามเดียวกัน ตัวเลข 30% เป็นค่าเฉลี่ยจากการประเมินของ Anthropic เอง ทราฟฟิกของคุณไม่ใช่ค่าเฉลี่ยนั้น
อะไรจะตามมาต่อไป
ประกาศของ Anthropic ระบุว่า Claude Haiku 5.5 จะเข้าร่วมครอบครัว "ในอีกไม่กี่สัปดาห์ข้างหน้า" ซึ่งจะทำให้รุ่น 5.5 ครบถ้วนในระดับเล็ก จนถึงตอนนั้น การตัดสินใจสองเรื่องที่ทีมซึ่งรัน Sonnet ในโปรดักชันต้องเผชิญนั้นแยกออกจากกันได้: การย้ายระบบเป็นงานหนึ่งวันที่คุณกำหนดเวลาได้ และการสลับโมเดลคือการวัดผลที่คุณเลื่อนออกไปได้ การทำสองสิ่งนี้ในลำดับตรงกันข้าม — สลับก่อนแล้วค้นพบข้อผิดพลาด forced-tool-use ในโปรดักชัน — คือรูปแบบการทยอยใช้งานนี้ที่ต้องแลกมาด้วยวันหยุดสุดสัปดาห์

