
Claude Sonnet 5.5 กับ Claude Sonnet 5: ราคาเท่ากัน แต่บิลต่างกัน
- typesafeใหม่TypeSafe: Jev 1.132026-09-24$0.04 / $0.00 ต่อ 1 ล้านโทเค็น · 984 tok/s
- openaiใหม่OpenAI: GPT-6 Luna2026-09-2237ความฉลาด
- openaiใหม่OpenAI: GPT-6 Sol2026-09-2248ความฉลาด
- anthropicใหม่Anthropic: Claude Opus 5.52026-09-2258ความฉลาด
- grokใหม่Grok 4.72026-09-2146ความฉลาด
- Orcaใหม่Orca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 ต่อ 1 ล้านโทเค็น · 195 tok/s
- orcaใหม่Orca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 ต่อ 1 ล้านโทเค็น · 1327 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040ความฉลาด
- openaiOpenAI: GPT-6 Astra2026-09-0453ความฉลาด77การเขียนโค้ด
- googleGoogle: Gemini 3.8 Flash2026-09-0241ความฉลาด76การเขียนโค้ด
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245ความฉลาด76การเขียนโค้ด
- anthropicAnthropic: Claude Fable 5.12026-09-0153ความฉลาด82การเขียนโค้ด
- tencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 ต่อ 1 ล้านโทเค็น
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 ต่อ 1 ล้านโทเค็น · 109 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642ความฉลาด72การเขียนโค้ด
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 ต่อ 1 ล้านโทเค็น · 221 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845ความฉลาด75การเขียนโค้ด
- obsidianQwen3.8 27B2026-08-1534ความฉลาด68การเขียนโค้ด
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236ความฉลาด69การเขียนโค้ด
- grokSpaceXAI: Grok 4.62026-08-1244ความฉลาด77การเขียนโค้ด
โมเดลสองตัวจากผู้จำหน่ายรายเดียวกัน ระดับเดียวกัน ชื่อเดียวกัน และ — ในทุกบรรทัดของตารางราคาที่เผยแพร่ — ราคาเดียวกัน Claude Sonnet 5 เปิดตัวเมื่อวันที่ 30 มิถุนายน 2026 ในราคา $2.00 ต่อล้านโทเคนอินพุต และ $10.00 ต่อล้านโทเคนเอาต์พุต Claude Sonnet 5.5 เปิดให้ใช้งานทั่วไปเมื่อวันที่ 28 กันยายน 2026 ในราคา $2.00 และ $10.00 โดยมีการอ่านแคชที่ $0.20 และการเขียนแคชห้านาทีที่ $2.50 สำหรับทั้งสองรุ่น ไม่มีอะไรเกี่ยวกับราคาเปลี่ยนแปลงเลย สิ่งที่เปลี่ยนคือทุกอย่างที่ใบราคาไม่ได้วัด และผลลัพธ์คือหนึ่งในสองโมเดลนี้มีต้นทุนการใช้งานต่ำกว่าอีกตัวอย่างมีนัยสำคัญ ทั้งที่มีราคาต่อโทเคนเท่ากันเป๊ะ พาดหัวข่าวการเปิดตัวของ Anthropic เองก็สื่อเช่นนั้นโดยไม่พูดออกมาตรง ๆ ว่า ต้นทุนต่ำลงสูงสุด 30% สำหรับงานส่วนใหญ่ บนตารางราคาที่ไม่เปลี่ยนแปลง ทางเดียวที่ทั้งสองประโยคจะเป็นจริงได้คือถ้าโมเดลใหม่ทำงานเดียวกันให้เสร็จด้วยโทเคนที่น้อยกว่า ซึ่งเป็นสิ่งที่ผลการวัดประสิทธิภาพแสดงให้เห็น และเป็นสิ่งที่ตัวเลขต่องานจากแหล่งอิสระยืนยัน
Claude Sonnet 5.5 แพงกว่า Claude Sonnet 5 หรือไม่
ไม่ — และถึงอย่างไรคำถามนี้ก็ควรค่าแก่การพิจารณาอย่างจริงจัง เพราะการย้ายระบบจำนวนมากได้ผิดพลาดไปแล้วจากการมองตารางอัตราเหมาจ่ายว่าเป็นบิลเหมาจ่าย
ต่อโทเคน โมเดลทั้งสองมีราคาเท่ากัน: ขาเข้า $2.00 ขาออก $10.00 อ่านโทเคนที่แคชไว้ $0.20 เขียนหนึ่งโทเคน $2.50 ไม่มีช่วงราคาแบบขั้นบันไดและไม่มีค่าธรรมเนียมเพิ่มสำหรับบริบทแบบยาว ไม่ว่าโมเดลที่ใหม่กว่าจะเป็นอะไร มันก็ไม่ใช่การขึ้นราคาที่แต่งตัวให้ดูเป็นเจนเนอเรชันใหม่
ต่อหนึ่งงานที่ทำเสร็จ ภาพจะพลิกไปตามว่าคุณกำลัง описывงานของใคร Artificial Analysis รายงานว่าต้นทุนอยู่ที่ 5.09 ดอลลาร์ต่องานสำหรับ Claude Sonnet 5 และ 7.60 ดอลลาร์ต่องานสำหรับ Claude Sonnet 5.5 บนชุด Intelligence Index v4.3 เดียวกัน — โมเดลใหม่กว่ามีค่าใช้จ่ายแพงกว่า 49% ในการทำงานให้เสร็จ ในอัตราที่เท่ากัน รายงานเดียวกันระบุว่า Sonnet 5.5 ปล่อยโทเคน 410 ล้านโทเคนตลอดทั้งชุด เทียบกับ 370 ล้านของ Sonnet 5 โดยทั้งคู่เทียบกับค่ามัธยฐานที่ 88 ล้านสำหรับกลุ่มที่ติดตามอยู่ บนพรอมป์แบบเปิดกว้างของตัวประเมิน โมเดลใหม่กว่าเพียงแค่เขียนมากกว่า และในราคาที่เท่ากัน โทเคนที่มากกว่าก็หมายถึงบิลที่สูงกว่า
ข้ออ้างของ Anthropic เรื่องราคาถูกกว่า 30% เป็นข้ออ้างของผู้ขายเกี่ยวกับงานที่ตนเลือกเอง ส่วนการเปรียบเทียบ 7.60 ดอลลาร์กับ 5.09 ดอลลาร์โดยบุคคลที่สามก็เป็นการวัดบนชุดงานที่แตกต่างกัน ทั้งสองฝ่ายไม่ได้ผิด สิ่งที่ขัดแย้งกันนั่นแหละคือเรื่องทั้งหมด และปัจจัยชี้ขาดคือว่างานของคุณกำหนดขอบเขตเอาต์พุตของตัวเองหรือไม่
อะไรที่เปลี่ยนไปจริง ๆ ระหว่างสองรุ่น
ตารางราคานั้นคงที่ แต่โมเดลไม่คงที่ เมื่อจัดเรียงเป็นรายการเดียว ส่วนต่างมีขนาดใหญ่และส่วนใหญ่เป็นไปในทิศทางเดียว
• Terminal-Bench 4.0 — 70.6% สำหรับ Claude Sonnet 5.5 เมื่อเทียบกับ 10.3% สำหรับ Claude Sonnet 5 ซึ่งเป็นการก้าวกระโดดข้ามรุ่นเดียวที่ใหญ่ที่สุดที่ Anthropic เคยเผยแพร่บนแบบทดสอบนี้
• CursorBench 4.0 — 55.5% เทียบกับ 34.1%
• Chartography โดยไม่ใช้เครื่องมือ — 61.6% เทียบกับ 15.6%
• GDPval-AA v2.1 — 1844 ต่อ 1449
• AA-Briefcase v1.1 — 1811 เทียบกับ 1359
• Humanity's Last Exam เมื่อใช้เครื่องมือ — 64.5% เทียบกับ 54.9%
• OSWorld 2.1, การทำสำเร็จบางส่วน — 80.1% เทียบกับ 57.0%
• Artificial Analysis Intelligence Index v4.3 — 56 ต่อ 38 ห่างกัน 18 คะแนนบนมาตรวัดของบุคคลที่สาม ซึ่งวัดภายใต้การตั้งค่า "Adaptive Reasoning, Max Effort" เดียวกัน
รูปร่างของรายการนั้นไม่ใช่ความก้าวหน้าที่สม่ำเสมอ Chartography ที่ขยับจาก 15.6% เป็น 61.6% และ Terminal-Bench จาก 10.3% เป็น 70.6% ดูเหมือนความสามารถที่เคยขาดหายและตอนนี้มีอยู่ ไม่ใช่ความสามารถที่พัฒนาขึ้น Humanity's Last Exam ที่ขยับสิบจุดและ OSWorld ยี่สิบสามจุดในราคาที่ไม่เปลี่ยนแปลงเป็นรูปแบบของรุ่นที่ปิดช่องว่างเฉพาะเจาะจงมากกว่ารุ่นที่ฉลาดขึ้นโดยทั่วไป ช่องว่างดัชนีสิบแปดจุดคือค่าเฉลี่ยเลขคณิตของสิ่งนั้น: จริง ใหญ่ และกระจุกตัวอยู่ที่การใช้เครื่องมือ การรันโค้ด และงานด้านภาพ
มีเชิงอรรถหนึ่งข้อที่สำคัญสำหรับใครก็ตามที่อ่านตารางผู้ขายอย่างละเอียด Anthropic ระบุว่าบน FrontierCode การตั้งค่า Max effort ได้คะแนนต่ำกว่า Xhigh และชี้ให้เห็นว่าการรัน GDPval-AA และ AA-Briefcase ถูกดำเนินการบนการปรับใช้ก่อนเปิดตัวที่มีบั๊กของ structured-outputs ตัวเลขข้างต้นยังคงเป็นตัวเลขที่ดีที่สุดเท่าที่มี แต่ให้ถือว่าเป็นสแนปช็อตจากการปรับใช้ครั้งหนึ่ง มากกว่าที่จะเป็นคุณสมบัติถาวรของโมเดล
ทำไมราคาถึงเท่ากัน แต่บิลไม่เท่ากัน
กลไกสามประการ โดยเรียงจากมากไปน้อยตามระดับที่แต่ละกลไกส่งผลต่อใบแจ้งหนี้จริง
ประการแรกคือวินัยด้านความยาวของผลลัพธ์ Sonnet 5.5 เป็นเอเจนต์ที่มีความสามารถมากกว่า ซึ่งหมายความว่ามันทำสิ่งต่างๆ มากกว่าก่อนที่จะตอบ และบนชุดทดสอบที่ไม่มีการจำกัดความยาว มันเขียนมากกว่า Sonnet 5 ราว 11% ในขณะที่มีต้นทุนต่อโทเคนเท่ากัน ในงานที่จำกัดผลลัพธ์ — การสกัดข้อมูลลงในสคีมาคงที่ การจำแนกประเภท สรุปที่มีขอบเขตจำกัด — 11% นั้นไม่เคยเกิดขึ้นจริง และข้ออ้าง 30% ก็กลายเป็นเรื่องน่าเชื่อ เพราะชัยชนะอยู่ที่การไปถึงคำตอบในจำนวนรอบที่น้อยลง ไม่ใช่การใช้โทเคนต่อรอบที่น้อยลง
ประการที่สองคือพฤติกรรมของแคช และนี่คือเหตุผลที่ราคาการอ่านแคชที่ไม่เปลี่ยนแปลงไม่ได้หมายความว่าต้นทุนแคชจะไม่เปลี่ยนแปลง การอ่านและการเขียนแคชมีราคาเท่ากันในทั้งสองโมเดล ดังนั้นการเปลี่ยนแปลงใดๆ ในปริมาณโทเค็นที่แคชไว้จะส่งผลโดยตรงถึงบิล โมเดลที่ใช้จำนวนรอบน้อยกว่าในการทำงานเอเจนติกให้สำเร็จ จะอ่านคำนำหน้าของตนน้อยครั้งกว่า นั่นคือการประหยัดโดยที่ราคาไม่มีการเปลี่ยนแปลงเลย และมันมองไม่เห็นในตารางเปรียบเทียบทุกตารางที่แสดงเฉพาะบรรทัดเรทการ์ด
ประการที่สามคือสิ่งที่ทีมส่วนใหญ่ทำพลาดในวันย้ายระบบ: ค่าเริ่มต้นของ effort Claude Sonnet 5.5 กำหนดค่าการคิดวิเคราะห์ผ่านพารามิเตอร์ effort ที่มีค่า low, medium, high, xhigh และ max โดยค่าเริ่มต้นเป็น high บน Claude Platform และ medium ภายในแอป Claude หากคุณย้ายจากระบบที่ใช้งาน Sonnet 5 ซึ่งคุณกำหนด reasoning budget ไว้ตายตัว ค่าเริ่มต้นใหม่อาจมีความลึกที่แตกต่างจากที่คุณเคยจ่าย วัดผลก่อนที่จะสันนิษฐานว่าเป็นการประหยัดหรือเพิ่มขึ้น
นอกจากนี้ยังมีผลกระทบด้านพฤติกรรมที่ควรแจ้งให้ทราบก่อนการเปิดใช้งานมากกว่าหลังจากนั้น Anthropic ระบุว่า Claude Sonnet 5.5 เป็น Sonnet รุ่นแรกที่เปิดตัวพร้อมมาตรการป้องกันด้านไซเบอร์และกลไกสำรองในระดับเดียวกับโมเดลระดับสูงสุดของตน ดังนั้นคำขอด้านความปลอดภัยไซเบอร์ที่มีความเสี่ยงสูงจะถูกส่งต่อไปยัง Sonnet รุ่นก่อนหน้าอย่างเห็นได้ชัด บันทึกของคุณจะแสดงโมเดลที่คุณไม่ได้ร้องขอ ในทำนองเดียวกัน หากคุณรัน Sonnet โดยปิดการคิด คุณต้องเปลี่ยนไปใช้พฤติกรรมระหว่างเครื่องมือ ซึ่งเป็นการแก้ไขโค้ด ไม่ใช่แฟล็ก
บน OrcaRouter, anthropic/claude-sonnet-5 สามารถจัดเส้นทางได้แล้ววันนี้ด้วยข้อมูลรับรองเพียงรายการเดียว ในราคาตามที่ผู้ให้บริการประกาศ โดยบวกเพิ่ม 0%ควบคู่ไปกับ Claude Opus 5.5, Claude Opus 5, DeepSeek V4 Pro และ Gemini 3.1 Pro Preview ตัว Claude Sonnet 5.5 เองยังไม่ใช่เส้นทางบนแพลตฟอร์มของเราในตอนนี้ ดังนั้นรูปแบบที่ใช้ได้จริงของการเปรียบเทียบนี้ในเวลานี้ก็คือ ทีมที่รัน Sonnet 5 อยู่แล้วสามารถวัดส่วนต่างได้ในวันที่มันถูกเพิ่มเข้าไป โดยไม่ต้องแตะคีย์ API และ ในระหว่างนี้ก็สามารถสลับสำรองระหว่างระดับชั้นได้เพียงเปลี่ยนสตริง
คำถามที่ผู้คนถามก่อนตัดสินใจเปลี่ยน
ฉันสามารถรันทั้งสองพร้อมกันและเปรียบเทียบบนทราฟฟิกของตัวเองได้ไหมยังทำผ่าน credential เดียวของ OrcaRouter ไม่ได้ เนื่องจาก Claude Sonnet 5.5 ยังไม่ใช่เส้นทางที่ระบุไว้ วิธีเลี่ยงคือรันโมเดลใหม่กว่าบน API ของ Anthropic เอง และรันโมเดลเก่าผ่านเรา จากนั้นเปรียบเทียบจำนวนโทเคนต่องานที่ทำสำเร็จ แทนที่จะเปรียบเทียบต้นทุนต่อโทเคน เพราะนั่นคือตัวเลขที่สองโมเดลนี้แตกต่างกันจริง ๆ
ราคาที่ไม่เปลี่ยนแปลงหมายความว่า Anthropic ไม่คิดค่าบริการสำหรับความสามารถใหม่นี้หรือไม่ นั่นหมายความว่าราคาตามประกาศยังคงเดิมในขณะที่โมเดลพัฒนาขึ้น ซึ่งเป็นรูปแบบเดียวกับสองรุ่น Sonnet ก่อนหน้า การที่ราคาจะคงอยู่เช่นนี้ต่อไปหรือไม่นั้นเป็นคำถามเชิงพาณิชย์ ไม่ใช่เชิงเทคนิค และกรอบเวลาการเลิกใช้งานที่ประกาศไว้ — ไม่เร็วกว่ากันยายน 2027 — เป็นข้อผูกมัดเดียวที่แนบมาด้วย
ฉันควรเชื่อตัวเลขไหน 30% ของ Anthropic หรือ 49% ของบุคคลที่สาม?ไม่ควรเชื่อถือทั้งสองอย่างในฐานะข้ออ้างทั่วไป ตัวเลขของ Anthropic อธิบายภาระงานที่โมเดลไปถึงคำตอบในรอบที่น้อยลง ส่วนตัวเลขของ Artificial Analysis อธิบายชุดดัชนีที่ไม่มีข้อจำกัด ซึ่งความยาวของคำตอบสามารถเพิ่มขึ้นได้อย่างอิสระ เลือกอันที่ใกล้เคียงกับชุดพรอมป์ของคุณ และหากคุณไม่สามารถบอกได้ว่าอันไหนคืออันนั้น ความกำกวมนั้นเองคือคำตอบ — วัดมัน
ประเด็นสำคัญ
Claude Sonnet 5.5 ไม่ใช่การขึ้นราคา แต่ก็ไม่ใช่การประหยัดโดยอัตโนมัติเช่นกัน Anthropic คงอัตราทุกบรรทัดในตารางราคาไว้เท่าเดิม และเปลี่ยนรุ่นโมเดลที่อยู่ภายใต้ตารางนั้น ซึ่งหมายความว่ากรณีทางเศรษฐศาสตร์ทั้งหมดขึ้นอยู่กับโทเค็นต่องานที่เสร็จสมบูรณ์ ตัวเลขที่ 30% ดีกว่าบนภาระงานที่ผู้ขายเลือก และแย่ลง 49% บนชุดการทดสอบที่ผู้ประเมินอิสระเลือก ถ้างานของคุณจำกัดเอาต์พุตของตัวเอง ให้เปลี่ยนไปใช้และคว้าชัยชนะนั้นไป ถ้าไม่ ราคาที่คงที่ก็ไม่ใช่เหตุผลที่จะข้ามการวัดผล เพราะคุณอาจต้องจ่ายแพงขึ้นครึ่งหนึ่งต่องานสำหรับโมเดลที่ทำงานได้ดีกว่าอย่างชัดเจน



