การ์ดชื่อเรื่องสำหรับ Claude Sonnet 5.5 ที่มีหัวข้อว่า 'ราคาเดิม งานน้อยลง' พร้อมคำบรรยายย่อย '$2 / $10 ต่อล้านโทเค็น ไม่เปลี่ยนแปลงจาก Sonnet 5' และการ์ดสถิติสามใบที่ระบุ 56 (AA Intelligence Index), #3 / 216 (อันดับในดัชนีนั้น) และ $7.60 (ค่าใช้จ่ายต่องานที่ความพยายามสูงสุด)
Guides & Insights

Claude Sonnet 5.5: ข้ออ้างลดต้นทุน 30% และการเปลี่ยนแปลง 6 ข้อที่ทำให้โค้ด Sonnet 5 พัง

ผู้เขียน

Magnus Corvin

วันที่เผยแพร่

โมเดลล่าสุด · 20ดูโมเดลทั้งหมด →
เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
กลับไปยังโพสต์ทั้งหมด

Claude Sonnet 5.5 เปิดตัวเมื่อวันที่ 28 กันยายน 2026 ด้วยอัตราค่าใช้จ่ายที่เท่ากันเป๊ะกับ Claude Sonnet 5 — 2 ดอลลาร์ต่ออินพุต 1 ล้านโทเคน, 10 ดอลลาร์ต่อเอาต์พุต 1 ล้านโทเคน, 0.20 ดอลลาร์ต่อการอ่านแคช 1 ล้านโทเคน — ขณะที่ประกาศของ Anthropic ขึ้นต้นด้วยข้อความว่า "เร็วขึ้น 30%+ และถูกลงได้ถึง 30% สำหรับงานส่วนใหญ่" ทั้งสองข้อความล้วนเป็นความจริง และระยะห่างระหว่างสองข้อความนั้นคือเรื่องราวทั้งหมด การประหยัดไม่ได้อยู่ที่ใบอัตราค่าใช้จ่าย เพราะใบอัตราค่าใช้จ่ายไม่ได้ขยับเลย มันมาจากการรันโมเดลที่ระดับความพยายาม (effort) ต่ำกว่าที่รุ่นก่อนหน้าจำเป็นต้องใช้ ซึ่งหมายความว่าตัวเลข 30% นั้นเป็นการกล่าวอ้างเกี่ยวกับจุดการทำงานที่คุณต้องเลือกเอง ไม่ใช่ราคาที่คุณได้มาโดยอัตโนมัติ การวัดผลโดยอิสระทำให้ทางแยกนี้คมชัดขึ้น: บน Artificial Analysis Claude Sonnet 5.5 ที่ระดับ effort สูงสุดมีค่าใช้จ่าย 7.60 ดอลลาร์ต่องาน บน Intelligence Index เทียบกับ 5.09 ดอลลาร์ สำหรับ Claude Sonnet 5 ที่ระดับสูงสุด — คิดเป็นราว 49% ที่เพิ่มขึ้น ไม่ใช่ถูกลง 30% นั่นไม่ใช่การขัดแย้งกับตัวเลขของ Anthropic มันคือปลายอีกด้านของเส้นโค้งเดียวกัน และเป็นจุดที่การย้ายระบบส่วนใหญ่จะลงเอยโดยค่าเริ่มต้น หากไม่มีใครรันการสำรวจค่า effort (effort sweep) ของตัวเองใหม่

สองข้อกล่าวอ้างที่ใช้หมายเลขเดียวกัน

โพสต์ของ Anthropic ยกข้ออ้างเรื่องต้นทุนต่องานในสามจุด และแต่ละจุดล้วนขึ้นอยู่กับค่า effort เวอร์ชันที่แข็งแกร่งที่สุด: บน Terminal-Bench 4.0 ที่ระดับ Medium effort — ซึ่งเป็นค่าเริ่มต้นในแอป Claude — Sonnet 5.5 "ทำได้เกินคะแนนดีที่สุดของ Sonnet 5 อย่างมาก ด้วยต้นทุนต่องานที่ต่ำกว่าหนึ่งในสิบ" บน AA-Briefcase v1.1 ที่ระดับ Medium effort มันเอาชนะคะแนนดีที่สุดของ Sonnet 5 ได้ด้วยต้นทุนประมาณหนึ่งในเก้า บน CursorBench 4.0 ที่ระดับ Low effort มันทำได้เกินคะแนนดีที่สุดของ Sonnet 5 ด้วยต้นทุนที่ต่ำกว่าหนึ่งในสิบ

อ่านสิ่งเหล่านั้นเป็นชุดเดียว แล้วกลไกก็ชัดเจน ค่าต่ำสุดของ Sonnet 5.5 อยู่เหนือค่าสูงสุดของ Sonnet 5 ในการประเมินหลายรายการ คุณไม่ได้ 30% จากการจ่ายต่อโทเค็นน้อยลง แต่ได้มาเพราะไม่จำเป็นต้องใช้การตั้งค่าที่แพงอีกต่อไป Anthropic กล่าวไว้เช่นนั้นในเอกสารการย้ายระบบ หนึ่งหน้าถัดจากส่วนการตลาด: "ระดับความพยายามถูกปรับเทียบใหม่ ระดับความพยายามไม่ได้สร้างปริมาณการคิดเท่ากับที่เคยเป็นบน Claude Sonnet 5 ให้รันการสำรวจระดับความพยายามของคุณใหม่ แทนที่จะนำการตั้งค่าเดิมมาใช้"

ประโยคนั้นเป็นบรรทัดที่สำคัญที่สุดในเชิงปฏิบัติการที่ Anthropic เผยแพร่ในสัปดาห์นี้ และเป็นประโยคที่ไม่ได้ปรากฏอยู่ใน{{1}}การรายงานข่าวการเปิดตัว{{/1}}ส่วนใหญ่

สิ่งที่ Anthropic เผยแพร่ — ตามรายงานของผู้ขาย ยังไม่ได้ทำซ้ำ

ทุกอย่างในส่วนนี้เป็นการวัดของ Anthropic เอง จากประกาศเปิดตัว Sonnet 5.5 และ System Card มันเป็นคำกล่าวอ้างของผู้ขาย ไม่ใช่ผลลัพธ์ที่เป็นอิสระ และรายละเอียดในเชิงอรรถก็สำคัญไม่แพ้ตัวเลขพาดหัว

• Terminal-Bench 4.0 (การเขียนโค้ดแบบเอเจนต์) — Sonnet 5.5 70.6% เทียบกับ Sonnet 5 10.3% นั่นคือการพุ่งขึ้นเจ็ดเท่าในแถวเดียวที่ถูกอ้างอิงมากที่สุด และเป็นตัวเลขที่สื่อส่วนใหญ่นำมาเป็นประเด็นเปิด

• FrontierCode 1.1 (Main) — Sonnet 5.5 52.1% ที่ Xhigh และ 46.2% ที่ Max; Sonnet 5 42.4%; Claude Opus 5.5 54.4%; GPT-6 Sol 49.3% สังเกตความกลับกัน: Sonnet 5.5 ได้คะแนนต่ำกว่าที่ Max เมื่อเทียบกับที่ Xhigh

• CursorBench 4.0 — 55.5% สำหรับ Sonnet 5.5 เทียบกับ 34.1% สำหรับ Sonnet 5 และ 57.8% สำหรับ Opus 5.5 CursorBench 4.0 ไม่รายงาน GPT-6 Sol ต่อสาธารณะ

• GDPval-AA v2.1 (งานที่ใช้ความรู้) — Sonnet 5.5 1844 Elo, Sonnet 5 1449, Opus 5.5 1846, GPT-6 Sol 1487.

• AA-Briefcase v1.1 — 1811 / 1359 / 1822 / 1483 บนสี่โมเดลเดียวกัน

• Humanity's Last Exam (พร้อมเครื่องมือ) — 64.5% / 54.9% / 67.7%

• OSWorld 2.1 (การใช้คอมพิวเตอร์ ให้คะแนนบางส่วน) — 80.1% / 57.0% / 81.8%

• Chartography (การจดจำแผนภูมิด้วยสายตา โดยไม่ใช้เครื่องมือ) — 61.6% / 15.6% / 64.4% / 53.6%

มีเชิงอรรถสามข้อที่ควรอยู่คู่ไปกับแถวเหล่านั้น มากกว่าจะอยู่ใต้แถวประการแรก ตัวเลข 66.4% ของ Opus 5.5 ใน Terminal-Bench 4.0 นั้นรายงานที่ระดับความพยายาม Xhigh ซึ่งเป็นคอนฟิกูเรชันที่ได้คะแนนสูงสุดของ Opus 5.5ประการที่สอง การกลับทิศของ FrontierCode Max ได้รับคำอธิบายแล้ว: ที่ระดับ Max นั้น Sonnet 5.5 รันสกิล code-review ของ Claude Code บ่อยกว่า ซึ่งเป็นการกระจายการรีวิวไปยังซับเอเจนต์หลายตัว และในสองกรณี สิ่งนี้ทำให้เกิดการหมดเวลาหรือการแก้ไขที่เกินขอบเขตของงาน — FrontierCode ลงโทษการเปลี่ยนแปลงที่เกินขอบเขตแม้ว่ามันจะดีก็ตามประการที่สาม และเป็นข้อที่ผู้ขายสบายใจน้อยที่สุด Artificial Analysis ได้รัน GDPval-AA และ AA-Briefcase บนก่อนเปิดตัว ดีพลอยเมนต์ของ Sonnet 5.5 ซึ่ง Anthropic บอกว่ามีบั๊กที่ทำให้การตอบสนองต่อคำขอเอาต์พุตแบบมีโครงสร้างแย่ลง Anthropic คาดว่าผลกระทบจะเล็กน้อยและทำให้ Sonnet 5.5 ดูต่ำกว่าความเป็นจริง และบอกว่าบั๊กนี้ได้รับการแก้ไขแล้ว ยังระบุด้วยว่า OpenAI เพิ่งแก้ไขบั๊กการทำความเข้าใจภาพใน GPT-6 Sol ดังนั้นตัวเลขของ GPT-6 Sol ในแถวเหล่านั้นอาจยังไม่สะท้อนโมเดลปัจจุบัน

Artificial Analysis model page for Claude Sonnet 5.5 (Adaptive Reasoning, Max Effort, Default Fallback), released September 2026, showing an Intelligence Index of 56 at rank #3 of 216, $2.00 input and $10.00 output per 1M tokens, and a $7.60 average cost per index task with 410M tokens generated.

สิ่งที่การรันแบบอิสระบอกเกี่ยวกับโมเดลเดียวกัน

Artificial Analysis ได้วัดค่า Sonnet 5.5 แล้ว และหน้าเพจของมันระบุชื่อการกำหนดค่าที่แน่นอนว่า "Claude Sonnet 5.5 (Adaptive Reasoning, Max Effort, Default Fallback)" ในเวอร์ชันเดียวกันของดัชนี มี 216 โมเดลในคลาส:

• Claude Sonnet 5.5 — ดัชนีวัดความสามารถทางปัญญา 56 อยู่ในอันดับที่ 3 จาก 216 โดยมีค่าใช้จ่าย $7.60 ต่องานดัชนี 1 งาน ในการรันดัชนี โมเดลนี้สร้างโทเค็นเอาต์พุต 410M เทียบกับค่ามัธยฐานที่ 88M

• Claude Sonnet 5 — ดัชนี 38 จัดอยู่ในอันดับที่ 58 จาก 216 บนหน้าของตนเองที่ติดป้ายกำกับว่า "(Adaptive Reasoning, Max Effort)" ค่าใช้จ่าย $5.09 ต่องาน โทเคนเอาต์พุต 370M

• Claude Opus 5.5 — ดัชนี 58 จัดอันดับ #1 จาก 216. $5.98 ต่องาน. 95.3 โทเคนเอาต์พุตต่อวินาที.

• GPT-6 Sol — Index 48 อยู่อันดับที่ 20 จาก 216 ราคาตามรายการ $2/$10 คิดเป็น $1.06 ต่องาน และ 89.8 โทเค็นเอาต์พุตต่อวินาที

ช่องว่างของ Intelligence Index — 56 เทียบกับ 38 หรือสิบแปดคะแนน — เป็นการยืนยันอิสระที่แข็งแกร่งที่สุดในบทความนี้ และเป็นตัวเลขที่ผู้อ่านควรจดจำไปจริง ๆ ตัวเลขต้นทุนเป็นตัวที่ต้องมีข้อแม้ และควรระบุให้ชัดเจนว่า ทั้งสองจุดเป็นการตั้งค่าแบบ max-effort และ max-effort บนโมเดลที่ใช้เวลาให้เหตุผลนานกว่านั้นเป็นจุดยืนที่แพงอย่างจงใจ Sonnet 5.5 ใช้ไป 410 ล้านโทเคนในการรันดัชนี ขณะที่ Sonnet 5 ใช้ 370 ล้าน และทั้งสองสูงกว่าค่ามัธยฐาน 88 ล้านมาก โมเดลที่คิดนานขึ้นในการตั้งค่าสูงสุดย่อมมีค่าใช้จ่ายสูงขึ้นในการตั้งค่าสูงสุด สิ่งที่ตัวเลขนี้หักล้างไม่ใช่ "ถูกกว่าต่องาน" แต่เป็นการตีความตัวเลขนี้ว่าเป็นคุณสมบัติของโมเดลมากกว่าของการตั้งค่า

Artificial Analysis ยังไม่ได้เผยแพร่ตัวเลขความเร็วเอาต์พุตสำหรับ Sonnet 5.5 — หน้าเพจของมันระบุ N/A สำหรับ Output tokens per second เทียบกับ 78.7 สำหรับ Sonnet 5 และ 95.3 สำหรับ Opus 5.5 ดังนั้นครึ่งที่เป็น "เร็วขึ้น 30%+" ของคำกล่าวอ้างของ Anthropic จึงเป็นข้อมูลที่ผู้ขายรายงานเองเท่านั้น ณ จุดนี้ ให้ถือเป็นเพียงทิศทางจนกว่าจะมีบุคคลที่สามมาวัด

A two-column comparison scoreboard titled 'Claude Sonnet 5.5 vs Claude Sonnet 5 - the cost-per-task fork'. The left column, Claude Sonnet 5.5, reads AA Intelligence Index 56, rank #3 of 216, cost per task at max effort $7.60, 410M output tokens on the index run, $2 / $10 input and output price, default effort high. The right column, Claude Sonnet 5, reads 38, #58 of 216, $5.09, 370M, $2 / $10, high.

เงินที่ประหยัดได้นั้นมาจากไหนกันแน่ และจะได้มาอย่างไร

หากคุณยอมรับกลไกนี้ คำแนะนำในการโยกย้ายก็จะเขียนขึ้นมาเอง และ Anthropic ได้เผยแพร่คำแนะนำเหล่านั้นแล้ว:

• เริ่มต้นที่ high เป็นค่าเริ่มต้น ไม่ใช่ค่าตามที่การตั้งค่า Sonnet 5 ของคุณระบุไว้ คำแนะนำของ Anthropic คือให้ใช้ high เว้นแต่ภาระงานของคุณเป็นแบบ agentic หรือมีความอ่อนไหวต่อความหน่วง

• การเขียนโค้ดแบบเอเจนต์และการใช้เครื่องมือหลายขั้นตอน — เริ่มที่ระดับกลาง สำหรับงานที่ระบุรายละเอียดไว้ชัดเจน และปรับขึ้นเป็นระดับสูงสำหรับงานที่ยากขึ้นหรือยาวขึ้น

• แชทและงานอื่น ๆ ที่ไวต่อความหน่วง — เริ่มที่ระดับกลางหรือต่ำ นี่คือช่วงที่คำกล่าวอ้างเรื่อง "หนึ่งในสิบของต้นทุน" อยู่

มีคำอธิบายที่สอดคล้องกันว่าทำไมการตั้งค่าที่ต่ำกว่าจึงได้ผล และนี่ไม่ใช่การตลาด ผู้ทดสอบช่วงแรกของ Anthropic รายงานว่า Sonnet 5.5 รวมกลุ่มการเรียกใช้เครื่องมือไว้ด้วยกันมากกว่า Sonnet 5 ทำให้แต่ละงานมีจำนวนขั้นตอนน้อยลง หมายเหตุของ CodeRabbit ในประกาศนั้นเจาะจงเป็นพิเศษสำหรับคำกล่าวเปิดตัว: "แนวโน้มของ Sonnet 5 ที่จะเรียกใช้การค้นหาเว็บบ่อยเกินไปและการใช้โทเคนในปริมาณสูงนั้นหายไปทั้งคู่ในโมเดลใหม่นี้" Sonnet 5.5 ยังคงใช้โทเคไนเซอร์ตัวเดียวกับ Sonnet 5 ข้อความที่เหมือนกันจึงมีต้นทุนโทเคนเท่ากัน การลดลงนี้เกิดจากจำนวนรอบที่น้อยลงและการเรียกซ้ำซ้อนที่น้อยลง ไม่ใช่คำศัพท์ที่ถูกกว่า นั่นยังหมายความว่าจำนวนโทเคนในบันทึกของคุณยังคงเปรียบเทียบกันได้ตลอดการอัปเกรด ซึ่งทำให้การวัดผลก่อนและหลังเป็นเรื่องตรงไปตรงมา

หกการเปลี่ยนแปลงที่ทำให้โค้ด Sonnet 5 พังหรือเปลี่ยนไป

นี่คือส่วนของรีลีสที่ทำให้ต้องเสียเวลาทางวิศวกรรม และเป็นจุดที่คู่มือการย้ายข้อมูลมีค่ามากกว่าแผนภูมิเปรียบเทียบประสิทธิภาพ ห้าในหกรายการส่งคืนข้อผิดพลาดแบบ hard ส่วนรายการที่หกล้มเหลวอย่างเงียบ ๆ

• thinking: {"type": "disabled"} ตอนนี้จะคืนค่า 400 ตัวเลือกที่ใช้แทนคือ thinking: {"type": "between_tools"} ซึ่งจะปิดการคิดล่วงหน้า และเป็นการตั้งค่าการคิดที่ต่ำที่สุดของโมเดลนี้ ใช้งานได้ที่ระดับ effort ต่ำ กลาง และสูง ไม่ต้องใช้ beta header และพร้อมใช้งานบนทุกแพลตฟอร์มที่ให้บริการ Sonnet 5.5 ที่ระดับ effort xhigh หรือ max ตัว between_tools เองจะคืนค่า 400 — ให้ใช้ adaptive thinking (ละเว้นฟิลด์นี้ หรือส่ง {"type": "adaptive"}) หากคุณต้องการระดับเหล่านั้น และเมื่อใช้ between_tools คุณจะไม่สามารถเปลี่ยน effort ระหว่างบทสนทนาได้ด้วย

• ไม่รองรับการใช้เครื่องมือแบบบังคับ การตั้งค่า tool_choice เป็น {"type": "any"} หรือ {"type": "tool", "name": "..."} จะคืนค่า 400 พร้อมข้อความ "tool_choice: type 'tool' and 'any' are not supported for this model." การตรวจสอบเดียวกันนี้ใช้กับ endpoint สำหรับการนับโทเคนด้วย วิธีแทนที่ที่เอกสารระบุไว้สำหรับอินพุตที่ถูกต้องตามสคีมาคือ tool_choice: {"type": "auto"} ร่วมกับ strict: true บนเครื่องมือ หรือย้ายสคีมาไปยัง structured outputs

• Thinking blocks ถูกผูกไว้กับโมเดลและบทสนทนา Sonnet 5.5 อ่าน thinking block จาก Sonnet 5, Opus 4.8, Haiku 4.5 และรุ่นก่อนหน้า — ไม่ได้อ่านจาก Opus 5, Opus 5.5 หรือโมเดล Fable หรือ Mythos ใด ๆ ไม่มีโมเดลอื่นอ่านบล็อกของ Sonnet 5.5 หากย้ายบทสนทนาจาก Sonnet 5 ไปเป็น 5.5 การให้เหตุผลจะยังคงอยู่ แต่ถ้าย้ายจาก Sonnet 5.5 ไปยังโมเดลอื่น เทิร์นหลังจากนั้นจะทำงานโดยไม่มีข้อมูลนั้น อีกส่วนหนึ่ง ตอนนี้ API ตรวจสอบว่า system prompt, รายการเครื่องมือ หรือข้อความก่อนหน้า มีการเปลี่ยนแปลงไปหรือไม่นับตั้งแต่มีการสร้าง thinking block ขึ้นมา และสำหรับบัญชีที่สร้างตั้งแต่วันที่ 31 สิงหาคม 2026 เป็นต้นไป ระบบจะส่งคืน 400 เมื่อมีการเปลี่ยนแปลงดังกล่าว ให้เก็บบทสนทนาแบบ append-only หรือส่ง beta header thinking-binding-controls-2026-08-01 พร้อมกับ prefix_mismatch_behavior: "drop_block"

• computer_20251124 ถูกปฏิเสธบน Claude API และ Google Cloud การใช้งานคอมพิวเตอร์บนแพลตฟอร์มเหล่านั้นต้องใช้ชุดเครื่องมือ computer_toolset_20260801 ส่วน Amazon Bedrock ยังคงยอมรับเครื่องมือเวอร์ชันเก่า ซึ่งเป็นความแตกต่างระหว่างแพลตฟอร์มที่ควรค่าแก่การแจ้งเตือน หากคุณรันเอเจนต์เดียวกันบนทั้งสองแพลตฟอร์ม

• การจับคู่ที่ปรึกษาบางคู่หายไปแล้ว เอ็กซ์คิวเตอร์ Sonnet 5.5 ยอมรับ Mythos 5.1, Fable 5.1, Mythos 5, Fable 5, Opus 5.5, Opus 5 หรือตัว Sonnet 5.5 เองเป็นที่ปรึกษา ส่วนที่ปรึกษา Opus 4.8, Opus 4.7 และ Sonnet 5 ซึ่งใช้ได้กับเอ็กซ์คิวเตอร์ Sonnet 5 จะคืนค่า 400 เมื่อใช้กับเอ็กซ์คิวเตอร์ Sonnet 5.5 ที่ปรึกษาทุกตัวที่ Sonnet 5.5 ยอมรับจะส่งคำแนะนำกลับมาในรูปแบบที่เข้ารหัสไว้ ไคลเอนต์ของคุณจึงไม่สามารถอ่านข้อความคำแนะนำได้

• ข้อความระหว่างการเรียกใช้เครื่องมือตอนนี้มาอยู่ในบล็อก thinking — และที่ค่า display เริ่มต้น: "omitted" มันว่างเปล่า นี่คืออันที่เงียบงัน บันทึกที่ยาวกว่าหนึ่งหรือสองประโยคระหว่างการเรียกใช้เครื่องมือจะกลับมาเป็นบล็อก thinking แบบอัปเดตความคืบหน้าแทนที่จะเป็นข้อความ แอปพลิเคชันที่สตรีมคำบรรยายนั้นให้ผู้ใช้จะเงียบไประหว่างการเรียกใช้เครื่องมือ โดยไม่มีข้อผิดพลาดและไม่มีอะไรในบันทึก วิธีแก้คือตั้งค่า thinking.display เพื่อให้ข้อความถูกส่งกลับ หรือเปลี่ยนไปใช้ between_tools ซึ่งในกรณีนั้นข้อความจะกลับมาเป็นข้อความธรรมดา

อีกสองเรื่องที่การย้ายโมเดลส่งผลกระทบ ซึ่งไม่ใช่ข้อผิดพลาดทั้งคู่ การมอนิเตอร์การปฏิเสธ: Sonnet 5.5 จะคืนค่า stop_reason: "refusal" พร้อมออบเจ็กต์ stop_details ที่ระบุหนึ่งในห้าพื้นที่นโยบาย — cyber, bio, frontier_llm, reasoning_extraction, general_harms — และกลไกสำรองฝั่งเซิร์ฟเวอร์ของ Anthropic จะลองใหม่กับการปฏิเสธด้าน cyber และ frontier_llm บน Sonnet 5 แต่จะไม่ลองใหม่กับอีกสามรายการ และท่าทีด้านความปลอดภัยเปลี่ยนแปลงไปจริง ๆ: Sonnet 5.5 เป็นโมเดล Sonnet ตัวแรกที่เปิดตัวพร้อมมาตรการป้องกันและกลไกสำรองด้านไซเบอร์เหมือนระดับ Opus ซึ่งหมายความว่าคำขอด้านความปลอดภัยไซเบอร์ที่มีความเสี่ยงสูงจะถูกส่งต่อไปยัง Sonnet 5 อย่างเห็นได้ชัด และเป็น Sonnet ตัวแรกที่มีตัวจำแนกเพื่อป้องกันการสกัดการให้เหตุผล หากข้อเสนอคุณค่าของผลิตภัณฑ์ของคุณคือเครื่องมือด้านความปลอดภัย จงทดสอบขอบเขตนั้นก่อนที่คุณจะปล่อยการสลับโมเดล

ราคา และสิ่งที่อยู่บนเส้นทางของเราจริง ๆ วันนี้

ตารางราคาไม่เปลี่ยนแปลงไปจาก Sonnet 5 และรูปแบบที่เผยแพร่ทั้งหมดนั้นสั้นพอที่จะระบุได้อย่างตรงไปตรงมา:

• อินพุต — 2.00 ดอลลาร์ต่อล้านโทเคน เอาต์พุต — 10.00 ดอลลาร์ต่อล้านโทเคน ทั้งสองราคาเหมือนกับ Sonnet 5 ทุกประการ โดยยืนยันได้จากหน้าของ Anthropic สำหรับ Sonnet 5.5

• การอ่านแคช — 0.20 ดอลลาร์ต่อล้านโทเค็น ลด 90% จากราคาอินพุต; การเขียนแคชแบบ 5 นาที 2.50 ดอลลาร์ต่อล้านโทเค็น; การเขียนแคชแบบ 1 ชั่วโมง 4.00 ดอลลาร์ต่อล้านโทเค็น พรอมป์ต์ขั้นต่ำที่แคชได้คือ 512 โทเค็นบน Sonnet 5.5 ลดลงจาก 1,024 บน Sonnet 5

• Batch — ลด 50% ทั้งสองทิศทาง ดังนั้น $1.00 / $5.00 ต่อล้าน ใน Message Batches API เอาต์พุตสามารถสูงถึง 300K โทเค็นด้วยเฮดเดอร์เบต้า output-300k-2026-03-24

• เทียบกับ Opus 5.5 — Sonnet 5.5 ถูกกว่าครึ่งหนึ่งพอดี: $2/$10 เทียบกับ $4/$20 โดยการเขียนแคชอยู่ที่ครึ่งหนึ่ง และการอ่านแคชเท่ากันที่ $0.20 นี่คือการย้ายระบบที่คุ้มค่า และ Anthropic พูดออกมาอย่างชัดเจนว่า โมเดลทั้งสองเสริมกันได้ดีที่สุดเมื่อ Sonnet ทำงานที่ระดับความพยายามต่ำลง และ Opus "ยังคงแข็งแกร่งกว่าอย่างชัดเจนในงานที่ซับซ้อนและเปิดกว้างซึ่งต้องใช้วิจารณญาณอย่างต่อเนื่อง"

• บริบทและเอาต์พุต — บริบท 1M โทเค็น, เอาต์พุตสูงสุด 128K, การคิดแบบปรับตัวเปิดเป็นค่าเริ่มต้น, ระดับความพยายามเริ่มต้นสูง, จุดตัดของความรู้ที่เชื่อถือได้คือมิถุนายน 2026, มีตัวเลือกไม่เก็บข้อมูลเลย, การยุติให้บริการไม่เร็วกว่า 28 กันยายน 2027

หมายเหตุเรื่องความพร้อมใช้งานที่เราอยากจะระบุไว้ตรง ๆ มากกว่าปล่อยให้ผู้อ่านอนุมานเอง: Claude Sonnet 5.5 ไม่ได้อยู่ในรายการโมเดลของเรา ณ วันที่ 29 กันยายน 2026 รุ่นก่อนหน้าอย่าง anthropic/claude-sonnet-5 และรุ่นพี่ที่ใหญ่กว่าอย่าง anthropic/claude-opus-5.5 ต่างก็มีอยู่ในรายการ และอัตราค่าบริการของฝั่งเราก็เป็นราคาของผู้ให้บริการเอง — $2.00 ขาเข้า, $10.00 ขาออก, $0.20 อ่านแคช, $2.50 เขียนแคช สำหรับ Sonnet 5 โดยไม่มีการบวกเพิ่มใด ๆ ดังนั้นหากผู้ขายเปลี่ยนราคา ที่นี่จะสะท้อนราคาใหม่ทันทีในวันเดียวกันที่ราคาเปลี่ยน แทนที่จะรอไปถึงรอบบิลถัดไป คุณสมบัติข้อหลังนี้เองที่ทำให้การอ่านตารางราคามีประโยชน์จริง而非เป็นเพียงของประดับ

OrcaRouter model page for anthropic/claude-sonnet-5, attributed to Anthropic and dated 2026-06-30, showing a 1M-token context window, up to 128K output tokens, and the unchanged rates of $2.00 per million input tokens and $10.00 per million output tokens. The page carries a link reading 'the Claude Sonnet 5 API'.

สิ่งที่คุณสามารถทำได้กับสิ่งนี้ในวันนี้

ลำดับขั้นที่ตรงไปตรงมาสำหรับทีมที่ใช้งาน Claude Sonnet 5 ในโปรดักชันอยู่แล้วคือสามขั้นตอน และไม่มีขั้นตอนใดเลยที่เป็นแค่ "สลับสตริงโมเดลแล้วดูกราฟ"

ก่อนอื่น ให้รัน effort sweep ใหม่อีกครั้ง หากคุณยกการตั้งค่า high หรือ max มาจาก Sonnet 5 เพราะนั่นคือสิ่งที่มาตรฐานคุณภาพของคุณกำหนดไว้ ตอนนี้คุณกำลังจ่ายสำหรับการให้เหตุผลที่คุณไม่จำเป็นต้องซื้ออีกต่อไป ตัวเลขต้นทุนต่องานที่เป็นอิสระบอกว่าจุดสูงสุดของบันไดกลับยิ่งแพงขึ้น ไม่ใช่ถูกลง และคำกล่าวอ้างเรื่องต้นทุนของผู้ขายเองล้วนอธิบายถึงส่วนกลางของมัน ข้อสอง แก้เส้นทางข้อผิดพลาดสองเส้นก่อนการดีพลอย — disabled thinking และ forced tool use — เพราะทั้งสองเส้นล้มเหลวอย่างเสียงดังและทันที ซึ่งเป็นข่าวดี ข้อสาม จับตาเส้นทางการบรรยาย เพราะมันล้มเหลวอย่างเงียบ ๆ

หากโมเดลนั้นยังไม่อยู่บนเส้นทางที่คุณใช้งาน วิธีประเมินความเสี่ยงต่ำคือรันมันควบคู่ไปด้วย ไม่ใช่รันแทนที่: ให้ปักหมุด Sonnet 5 ไว้เป็นตัวสำรองบนคีย์เดียวกัน เพื่อให้การปฏิเสธ การหมดเวลา หรือผลการประเมินที่ไม่ดี จะส่งคำขอไปยังโมเดลที่คุณเชื่อถืออยู่แล้ว และการสลับสำรองอัตโนมัติก็ปิดวงจรได้โดยไม่ต้องเชื่อมต่อครั้งที่สอง นั่นคือเหตุผลทั้งหมดของการประเมินโมเดลที่ยังไม่ผ่านการพิสูจน์ไว้เบื้องหลังปลายทางเดียว แทนที่จะวางไว้ข้างหน้าผู้ใช้ของคุณ — และยิ่งใช้ได้เป็นสองเท่าในกรณีนี้ เพราะหมวดหมู่การปฏิเสธของ Sonnet 5.5 เป็นของใหม่ และการปรับเทียบความพยายามของมันก็ไม่เหมือนรุ่นก่อนอย่างชัดเจน เมื่อคุณพร้อมที่จะเปลี่ยนค่าเริ่มต้น รายชื่อบนคีย์เดียวมีให้เลือกถึงมากกว่า 200 โมเดลซึ่งทำให้การเปรียบเทียบเป็นเพียงการแก้คอนฟิก ไม่ใช่สัญญาฉบับที่สอง

ดูอะไรดี

สามสิ่งจะไขข้อข้องใจที่ยังค้างอยู่ในบทความนี้ และยังไม่มีสิ่งใดเกิดขึ้นเลย

สิ่งแรกคือการวัดความเร็วเอาต์พุตจากแหล่งอิสระ Anthropic อ้างว่าเร็วกว่า Sonnet 5 ขึ้นไป 30%+; Artificial Analysis ยังไม่ได้เผยแพร่ตัวเลขสำหรับ Sonnet 5.5 และข้ออ้างนี้มีน้ำหนักจริงในข้อโต้แย้งด้านต้นทุน เนื่องจากโมเดลที่เร็วกว่าจะทำงานเดียวกันเสร็จในเวลาจริงที่น้อยลง และบ่อยครั้งใช้โทเค็นน้อยลง Claude Haiku 5.5 คืออันดับที่สอง — Anthropic กล่าวว่าจะมาถึง "ในอีกไม่กี่สัปดาห์ข้างหน้า" และจะอยู่ใต้ Sonnet 5.5 ซึ่งเปลี่ยนการคำนวณสำหรับกลุ่มแชทปริมาณสูงที่ความพยายามระดับกลางและต่ำทำให้ Sonnet 5.5 แข่งขันได้อยู่แล้ว อันดับที่สามคือรอบการแก้ไข: Artificial Analysis ได้รัน GDPval-AA และ AA-Briefcase บนบิลด์ก่อนเปิดตัวที่มีบั๊กเอาต์พุตแบบมีโครงสร้าง Anthropic คาดว่าคะแนนเหล่านั้นจะประเมินโมเดลต่ำเกินไป และยังไม่มีการรันตัวเลขทั้งสองใหม่ หากตัวเลขเหล่านั้นปรับขึ้น ช่องว่างงานความรู้กับ Opus 5.5 จะแคบลงอีก และข้อโต้แย้ง "ราคาครึ่งเดียว" จะแข็งแกร่งขึ้น

จนถึงตอนนั้น ข้อสรุปที่ยืนยันได้มีขอบเขตแคบกว่าคำประกาศ และมีประโยชน์มากกว่าตารางเปรียบเทียบมาตรฐาน Claude Sonnet 5.5 คือคะแนนสติปัญญาที่เพิ่มขึ้น 18 จุดจาก Sonnet 5 บนดัชนีอิสระ ในอัตราที่ประกาศไว้เท่าเดิม พร้อมการประหยัดที่แท้จริงและวัดผลได้สำหรับทุกคนที่ลดระดับความพยายามลง — และบทลงโทษที่แท้จริงและวัดผลได้สำหรับทุกคนที่ไม่ลดลง

การเปรียบเทียบในบทความนี้2

ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน

© 2026 OrcaRouter

สำหรับผู้ให้บริการ

ให้บริการแพลตฟอร์มการอนุมานอยู่หรือไม่ นำโมเดลของคุณขึ้น OrcaRouter

providers@orcarouter.ai

เข้าร่วมคอมมูนิตี้ของเรา

Discordsupport@orcarouter.aiXGitHubYouTube