
Claude Sonnet 5.5: ค่าเริ่มต้นระดับกลางที่ระบุสเปกไว้ครบถ้วน
- openaiใหม่OpenAI: GPT-6.1 Sol2026-09-2952ความฉลาด
- anthropicใหม่Anthropic: Claude Sonnet 5.52026-09-2856ความฉลาด
- typesafeใหม่TypeSafe: Jev 1.132026-09-24$0.04 / $0.00 ต่อ 1 ล้านโทเค็น · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238ความฉลาด
- OpenAIOpenAI: GPT-6 Sol2026-09-2248ความฉลาด
- AnthropicAnthropic: Claude Opus 5.52026-09-2258ความฉลาด
- xAIGrok 4.72026-09-2146ความฉลาด
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 ต่อ 1 ล้านโทเค็น · 64 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 ต่อ 1 ล้านโทเค็น · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040ความฉลาด
- OpenAIOpenAI: GPT-6 Astra2026-09-0453ความฉลาด77การเขียนโค้ด
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241ความฉลาด76การเขียนโค้ด
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245ความฉลาด76การเขียนโค้ด
- AnthropicAnthropic: Claude Fable 5.12026-09-0153ความฉลาด82การเขียนโค้ด
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 ต่อ 1 ล้านโทเค็น · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 ต่อ 1 ล้านโทเค็น · 360 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642ความฉลาด72การเขียนโค้ด
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 ต่อ 1 ล้านโทเค็น · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845ความฉลาด75การเขียนโค้ด
- obsidianQwen3.8 27B2026-08-1534ความฉลาด68การเขียนโค้ด
Claude Sonnet 5.5เป็นโมเดลระดับกลางของตระกูล Claude เปิดตัวเมื่อวันที่ 28 กันยายน 2026 และราคาคือเหตุผลทั้งหมดที่ทำให้มันควรค่าแก่การมีหน้าเพจเป็นของตัวเอง: 2 ดอลลาร์ต่อล้านโทเค็นอินพุต และ 10 ดอลลาร์ต่อล้านโทเค็นเอาต์พุต เทียบกับ 4 และ 20 ดอลลาร์สำหรับClaude Opus 5.5 ซึ่งเป็นเรือธงที่เปิดตัวก่อนหน้าหกวัน นั่นคือราคาเอาต์พุตครึ่งหนึ่งแลกกับ 1.62 คะแนนของ Artificial Analysis Intelligence Index — 56.00 สำหรับรุ่นระดับกลาง เทียบกับ 57.62 สำหรับเรือธง โดยตัวเลขทั้งสองวัดโดย Artificial Analysis บนการแก้ไขดัชนี v4.3.2 ไม่ใช่โดยเราและไม่ใช่โดยผู้ขาย เหนือทั้งสองรุ่นขึ้นไปมีClaude Fable 5.1 ที่ราคา $10 / $50 และ 53.35 บนการแก้ไขเดียวกัน: แพงกว่าเรือธง และยังตามหลังเรือธงด้วย ในราคาป้ายเดียวกันที่ $2 / $10 กับ Claude Sonnet 5.5 มีGPT-6.1 Solของ OpenAI ที่ 51.83 — ห่างออกไป 417 ในร้อยของดัชนีอีกฝั่งของเส้น ซึ่งเป็นการเปรียบเทียบที่ผู้อ่านที่กำลังชั่งน้ำหนักรุ่นระดับกลางต้องทำจริง ๆ
หน้านี้เป็นเอกสารอ้างอิง และวันที่ต่าง ๆ บอกเหตุผลว่าทำไมจึงเป็นเช่นนั้น แทนที่จะบอกความสดใหม่ Claude Sonnet 5.5 มีอายุสิบวัน ณ วันที่ 2026-10-08 ซึ่งทำให้มันอยู่นอกหน้าต่างเจ็ดวันที่บล็อกนี้รายงานข่าว สิ่งที่อยู่ในหน้าต่างนั้นคือเหตุการณ์ที่มีอายุหกวัน: โพสต์สองโพสต์บน X ลงวันที่ 2026-10-02 โดยอ้างว่าโมเดลรุ่นสืบทอดในตระกูลนี้เอาชนะคู่แข่งที่ผู้ขายของมันเองสร้างเสร็จแล้วแต่ไม่เปิดตัว การอ้างนั้นไม่มีรหัสโมเดล ไม่มีบัตรราคา ไม่มีหน้าต่างบริบท และไม่มีการวัดประสิทธิภาพรองรับในทะเบียนใด ๆ ที่เข้าถึงได้จากที่นี่ และมันไม่ใช่หัวข้อของหน้านี้ — ห่วงโซ่แหล่งที่มา การตรวจสอบการไม่มีอยู่บนช่องทางของผู้ขาย และการกระจายดัชนีของห้าโมเดล ล้วนเป็นของบทความที่บล็อกนี้ได้เผยแพร่ไปแล้วอย่างเต็มรูปแบบ ภายใต้ชื่อเรื่อง Claude Fable 5.5 เอาชนะ GPT-6.1 Astra ก่อนที่มันจะมีอยู่จริง — และนั่นคือส่วนที่น่าสนใจ ซึ่งลงวันที่ 2026-10-03 สิ่งที่การอ้างนั้นก่อให้เกิดขึ้นคือคิวของผู้อ่านที่ถามว่าโมเดล Claude รุ่นที่วางจำหน่ายแล้วรุ่นไหนที่ควรใช้เป็นมาตรฐานในระหว่างที่พวกเขารอ และคำถามนั้นต้องการหน้าที่เกี่ยวกับโมเดลที่มีอยู่จริง นี่คือหน้านั้น
มีอะไรเปิดตัวเมื่อวันที่ 28 กันยายน 2026
เอกสารของผู้จำหน่ายเองระบุข้อกำหนดไว้โดยตรง และมันเป็นความต่อเนื่องของระดับชั้น (tier) มากกว่าที่จะเป็นรูปแบบใหม่ ทุกสิ่งด้านล่างนี้อ่านมาจากเอกสาร Claude Platform ของ Anthropic เมื่อวันที่ 2026-10-08 ดังนั้นจึงเป็นข้อกำหนดของ Anthropic เอง ไม่ใช่การทดสอบที่เป็นอิสระ
• เปิดตัว — 28 กันยายน 2026. หน้าเอกสารของโมเดลเองขึ้นต้นด้วยบรรทัดที่ว่า “ล่าสุด เปิดตัว 28 กันยายน 2026”
• การวางตำแหน่ง — "สุดยอดการผสมผสานระหว่างความเร็วและความฉลาด" โดยมีค่าความหน่วงเชิงเปรียบเทียบระบุเป็น เร็ว เมื่อเทียบกับ ปานกลาง สำหรับ Claude Opus 5.5, ช้ากว่า สำหรับ Claude Fable 5.1 และ เร็วที่สุด สำหรับระดับเล็ก
• ID โมเดล — claude-sonnet-5-5 บน Claude API, Google Cloud, Microsoft Foundry และ Claude Platform บน AWS; anthropic.claude-sonnet-5-5 บน Amazon Bedrock ทุก ID โมเดลของ Claude เป็นสแนปช็อตที่ปักหมุดไว้ ดังนั้นสตริงนี้จึงไม่ใช่ตัวชี้ที่เลื่อนไปมาใต้คุณ
• บริบทและเอาต์พุต — คอนเท็กซ์ 1,000,000 โทเค็น และเอาต์พุตแบบซิงโครนัส 128,000 โทเค็นบน Messages API เพิ่มขึ้นเป็น 300,000 เมื่อใช้output-300k-2026-03-24 beta header บน Message Batches API
• Thinking — ปรับตามบริบท เปิดใช้งานเป็นค่าเริ่มต้นเสมอ โดยมีค่า effort เริ่มต้นที่ high ค่าต่ำสุดคือ between_tools ซึ่งจะปิดการคิดล่วงหน้า และยอมรับที่ค่า effort high หรือต่ำกว่า การตั้งค่า temperature, top_p หรือ top_k เป็นค่าอื่นที่ไม่ใช่ค่าเริ่มต้นจะคืนค่าเป็นข้อผิดพลาด 400 ดังนั้นคำขอที่ย้ายมาจากโมเดล Claude รุ่นเก่าที่มีการตั้งค่า temperature ไว้จะล้มเหลวอย่างชัดเจนแทนที่จะล้มเหลวอย่างเงียบ ๆ
• วันตัดข้อมูลความรู้ — มิถุนายน 2026 สำหรับทั้งวันตัดข้อมูลที่เชื่อถือได้และวันตัดข้อมูลชุดฝึก
• วงจรชีวิต — ใช้งานอยู่ (ล่าสุด) โดยมีข้อผูกพันว่าจะไม่เลิกให้บริการก่อนวันที่ 28 กันยายน 2027 บนแพลตฟอร์มที่ Anthropic ดำเนินการเอง ส่วน Amazon Bedrock และ Google Cloud กำหนดวันของตนเอง
กรอบการเปิดตัวของผู้ขายรายนี้น่าอ้างอิง เพราะมันเป็นข้อกล่าวอ้าง ไม่ใช่ผลการวัด: ประกาศของ Anthropic อธิบาย Claude Sonnet 5.5 ว่า "เป็นอัปเกรดที่ชัดเจนเหนือ Sonnet 5 ซึ่งทำงานเร็วขึ้น 30% และมีค่าใช้จ่ายต่ำลงได้ถึง 30% สำหรับงานส่วนใหญ่" ประโยคนั้นเป็นถ้อยคำของผู้ขาย ซึ่งเราไม่ได้ทำซ้ำ และเป็นข้อกล่าวอ้างประเภทที่ขึ้นอยู่กับว่าคุณเอางานแบบใดไปให้มันทำทั้งหมด ยังมีต้นทุนการโยกย้ายที่มาพร้อมกับรีลีสนี้ ซึ่งหน้านี้ไม่ใช่ที่ที่ควรพูดถึง: การเปลี่ยนแปลงที่ทำให้โค้ดเดิมพัง 5 รายการส่งผลกระทบต่อโค้ดที่รันอยู่บน Claude Sonnet 5 แล้ว และรายการที่หกเปลี่ยนรูปแบบการตอบกลับโดยไม่ทำให้คำขอใดล้มเหลว การแจกแจงส่วนนั้นอยู่ในบทความการทยอยเปิดตัวที่บล็อกนี้ตีพิมพ์ในสัปดาห์ที่ปล่อย และเป็นสิ่งแรกที่ควรอ่านหากคุณมี Sonnet 5 ใช้งานในโปรดักชันอยู่ในวันนี้

1.62 แต้ม และราคาครึ่ง
คะแนนอิสระสำหรับโมเดลนี้มาจากแหล่งเดียว และมันมีตัวเลขหนึ่งตัวที่ชี้ขาดการโต้แย้ง Artificial Analysis วัด Claude Sonnet 5.5 ได้56.00 บน Intelligence Index ฉบับแก้ไข v4.3.2 ในการตั้งค่าที่หน้าเว็บระบุชื่อว่า "Claude Sonnet 5.5 (Max, Default Fallback)" เราอ่านหน้านั้นเมื่อ 2026-10-08 ในฉบับแก้ไขเดียวกัน วันเดียวกันนั้น:
• Claude Opus 5.5 — 57.62, เปิดตัว 2026-09-22, $4 / $20
• Claude Sonnet 5.5 — 56.00 เปิดตัวเมื่อ 2026-09-28, $2 / $10
• Claude Fable 5.1 — 53.35, เปิดตัวเมื่อ 2026-09-01, $10 / $50
• GPT-6 Astra — 52.67, เปิดตัวเมื่อ 2026-09-03, $10 / $50, พร้อมระดับบริบทแบบยาวสำหรับพรอมต์ที่เกิน 272,000 โทเคน ในราคา $20 / $75
• GPT-6.1 Sol — 51.83 เผยแพร่เมื่อ 2026-09-29, $2 / $10
การระบุว่ารีวิชันใดมีความสำคัญ เนื่องจากคะแนนจากเวอร์ชันหนึ่งของดัชนีไม่สามารถเปรียบเทียบกับคะแนนจากอีกเวอร์ชันหนึ่งได้: v4.3.2 รวมการประเมินสิบรายการ — AA-Briefcase v1.1, GDPval-AA v2.1, AutomationBench-AA, Terminal-Bench 4.0, SciCode, Humanity's Last Exam, GDP.pdf, CritPt, AA-Omniscience และ AA-LCR v1.1 — และองค์ประกอบของชุดนั้นเปลี่ยนแปลงไปตามรีวิชันต่างๆ ตัวเลขทั้งห้ารายการข้างต้นมาจากรีวิชันเดียวกัน ซึ่งเป็นเหตุผลว่าทำไมจึงสามารถอ่านเทียบกันได้ และทำไมไม่มีตัวเลขใดเลยที่สามารถอ่านเทียบกับตัวเลขที่อ้างอิงจากเวอร์ชันก่อนหน้าได้
การเปรียบเทียบราคาเป็นส่วนที่กำหนดพฤติกรรม อัตราเอาต์พุตของ Claude Sonnet 5.5 เป็นครึ่งหนึ่งของ Claude Opus 5.5 และอัตราอินพุตก็เป็นครึ่งหนึ่งเช่นกัน ในรายการของผู้ขายเอง รุ่นกลางมีราคา $2 / $10 ในขณะที่รุ่นเรือธงมีราคา $4 / $20 เมื่อนำตัวเลขที่เผยแพร่ทั้งสองมาคำนวณร่วมกัน อัตราส่วนก็ชัดเจน: ต่อหนึ่งดอลลาร์ของราคาตามรายการสำหรับเอาต์พุต Claude Sonnet 5.5 ให้ 5.60 คะแนนดัชนี และ Claude Opus 5.5 ให้ 2.88 — เกือบสองเท่าของดัชนีต่อดอลลาร์ของเอาต์พุต ตามตารางราคาของ Anthropic เองและการวัดของ Artificial Analysis เอง นั่นคือการคำนวณเลขคณิตจากตัวเลขที่เผยแพร่สองตัว มากกว่าจะเป็นการวัดสิ่งใด และมันเป็นรูปแบบที่ซื่อตรงของข้อโต้แย้งเพื่อสนับสนุนรุ่นกลาง มันก็ไม่ใช่คำตัดสินเช่นกัน: คะแนนดัชนีไม่ใช่หน่วยของความถูกต้อง และประเด็นของส่วนที่เหลือของหน้านี้คือว่า 1.62 ประกอบขึ้นจากอะไรและไม่ได้ประกอบขึ้นจากอะไร

เรทการ์ด และสองไลน์ที่ขายดีที่สุด
รายการราคาฉบับเต็มของ Anthropic ข้อมูล ณ วันที่ 2026-10-08 ตัวเลขทุกตัวในส่วนนี้เป็นของผู้ขาย
• อินพุต — $2.00 ต่อล้านโทเคน. เอาต์พุต — $10.00 ต่อล้าน และโทเคนการคิดจะถูกคิดค่าใช้จ่ายเป็นเอาต์พุต ซึ่งไม่สามารถระงับได้เนื่องจาก adaptive thinking เปิดใช้งานตามค่าเริ่มต้น.
• การอ่านแคช — $0.10 ต่อล้าน ซึ่ง Anthropic ระบุว่าเป็น 5 เปอร์เซ็นต์ของราคาอินพุตพื้นฐาน นั่นเป็นส่วนลดตามสัดส่วนเดียวกันกับที่ Claude Opus 5.5 มี ดังนั้นแคชจึงไม่เปลี่ยนอันดับระหว่างทั้งสอง และหมายความว่าการรันเอเจนต์แบบยาวที่เก็บคำนำหน้าที่คงที่ไว้จะจ่ายหนึ่งในสิบของอัตราอินพุตสำหรับทุกสิ่งที่อ่านซ้ำ
• การเขียนแคช — 2.50 ดอลลาร์ต่อล้านโทเคนสำหรับแคชอายุห้านาที และ 4.00 ดอลลาร์สำหรับแคชอายุหนึ่งชั่วโมง ความยาวพรอมต์ขั้นต่ำที่สามารถแคชได้คือ 512 โทเคน ดังนั้นพรอมต์สั้นจึงไม่ได้รับส่วนลดนี้เลย
• Batch API — ลด 50 เปอร์เซ็นต์ทั้งสองทิศทาง ดังนั้นอินพุต $1.00 และเอาต์พุต $5.00 สำหรับงานที่รอได้
• ไม่มีค่าธรรมเนียมเพิ่มสำหรับบริบทยาว — Anthropic คิดค่าบริการหน้าต่าง 1M โทเคนเต็มในอัตราต่อโทเคนมาตรฐานสำหรับโมเดลนี้ ดังนั้นคำขอ 900,000 โทเคนจึงมีค่าใช้จ่ายต่อโทเคนเท่ากับคำขอ 9,000 โทเคน นี่เป็นความแตกต่างที่แท้จริงจาก GPT-6 Astra ซึ่งระดับบริบทยาวที่สูงกว่า 272,000 โทเคนพรอมป์จะขยับเป็น $20 / $75 — น่าพูดถึงเพราะเป็นจุดเดียวที่ตัวเลขเด่นของทั้งสองผู้ให้บริการแตกต่างกันอย่างชัดเจนเมื่อพรอมป์ยาวขึ้น
สองรายการนี้ต่างหากที่เป็นตัวกำหนดบิลส่วนใหญ่ ไม่ใช่อัตราที่พาดหัว: ส่วนลดการอ่านแคชตลอดการรันเอเจนต์ที่ยาวนาน และส่วนลดแบบแบตช์สำหรับงานอะซิงโครนัสใด ๆ ราคาพาดหัว $2 / $10 คือสิ่งที่ถูกนำไปเปรียบเทียบบนลีดเดอร์บอร์ด ส่วนรายการแคชและแบตช์ต่างหากที่ใบแจ้งหนี้รายเดือนถูกสร้างขึ้นมาจริง ๆ
ช่องว่างนี้หมายความว่าอะไรและไม่หมายความว่าอะไร
The Intelligence Index คือตัวเลขตัวเดียวบนชุดงานแบบคงที่ และคุณสมบัติเดี่ยวนี้เองที่อธิบายความสับสนส่วนใหญ่ที่อยู่รอบ ๆ มัน การประเมินสิบรายการที่อยู่เบื้องหลัง v4.3.2 ประกอบด้วยงานเขียนโค้ดแบบเอเจนต์และงานในเทอร์มินัล การใช้เหตุผลทางวิทยาศาสตร์ระดับบัณฑิตศึกษา ชุดงานวิศวกรรมซอฟต์แวร์ ชุดงานระบบอัตโนมัติแบบเอเจนต์ และชุดการดึงข้อมูลบริบทยาว ซึ่งถ่วงน้ำหนักรวมเป็นค่าผสม โมเดลที่ตามหลังอีกโมเดลอยู่ 1.62 คะแนน คือตามหลังอยู่ในค่าผสมนั้น — ไม่ใช่ตามหลังในภาระงานของคุณ ซึ่งอาจถ่วงน้ำหนักงานทั้งสิบนั้นในสัดส่วนที่แตกต่างไปโดยสิ้นเชิง และอาจมีงานที่ไม่มีรายการใดในสิบรายการเหล่านี้เป็นตัวแทนเลย
ในทางปฏิบัติ นั่นหมายความว่าการแบ่งแยกเป็นไปตามรูปร่างของงาน ไม่ใช่ตามบารมีของระดับชั้น ตัวเลือกโมเดลของ Anthropic เองก็แสดงการแบ่งนี้อย่างชัดเจน และน่าอ่าน เพราะมันไม่ได้ประจบประแจงระดับกลาง: เอกสารบอกผู้อ่านว่า "ให้เริ่มต้นด้วย Claude Opus 5.5 สำหรับเวิร์กโหลดส่วนใหญ่" และให้เลือก Claude Fable 5.1 "สำหรับงานที่ต้องใช้การให้เหตุผลที่หนักหน่วงและงานแบบเอเจนต์ระยะยาว หรือเมื่อการประเมิน (evals) ของคุณบน Claude Opus 5.5 ที่ความพยายามสูงขึ้นยังไม่เพียงพอ" Claude Sonnet 5.5 ไม่ใช่โมเดลที่ประโยคนั้นเริ่มต้นด้วย แต่เป็นโมเดลที่เอกสารเดียวกันบรรยายว่าเป็นการผสมผสานที่ดีที่สุดของความเร็วและความฉลาด โดยมีความหน่วงเมื่อเทียบกันที่เร็วที่สุดนอกระดับเล็ก — ซึ่งเป็นข้อโต้แย้งที่ต่างออกไป และเป็นข้อโต้แย้งที่แคบกว่า
ดังนั้นการตีความที่ตรงไปตรงมาคือแบบนี้ รุ่นกลางมักเป็นคำตอบที่ถูกต้องสำหรับงานที่ขอบเขตชัดเจนในปริมาณมาก คือ ฟีเจอร์และการแก้บั๊กบนโค้ดเบสที่รู้จักดี การสกัดและการจำแนกข้อมูลที่มีรูปแบบผลลัพธ์กำหนดไว้ชัดเจน ลูปการเรียกเครื่องมือที่ส่วนที่ยากคือฮาร์เนสมากกว่าการให้เหตุผล และงานใดก็ตามที่โทเคนแรกที่เร็วกับต้นทุนต่อการเรียกที่ต่ำสำคัญกว่าขีดความสามารถอีก 2 เปอร์เซ็นต์สุดท้าย รุ่นเรือธงคุ้มค่ากับราคาก็เมื่องานเป็นงานระยะยาวจริง ๆ คือ การรันเอเจนต์หลายชั่วโมง รีแฟกเตอร์ที่ครอบคลุมหลายไฟล์ซึ่งพรอมป์ทเดียวบรรจุไม่หมด และการประเมินผลบนรุ่นกลางที่วัดแล้วยังด้อยกว่าอย่างเห็นได้ชัดเมื่อเพิ่มระดับความพยายาม เงื่อนไขสุดท้ายนี้เป็นเงื่อนไขที่ผู้ขายกำหนดเอง และเป็นเงื่อนไขที่ทดสอบได้ นั่นคือ เพิ่มระดับความพยายามบนรุ่นกลาง รันอีวัลของคุณเอง แล้วดูว่ามันปิดช่องว่างได้หรือไม่ ถ้าปิดได้ 1.62 ก็ไม่ได้เป็นตัวแบกน้ำหนักให้คุณ ถ้าปิดไม่ได้ คุณก็ได้คำตอบมาด้วยตัวเลขของคุณเอง ไม่ใช่คะแนนรวมของคนอื่น
สิ่งที่ช่องว่างนี้ไม่ได้หมายความก็คือ 1.62 คะแนนไม่ใช่เรื่องเล็กน้อยเลย มันคือส่วนต่างทั้งหมดระหว่างสองโมเดล และบนชุดทดสอบแบบคงที่ที่ประเมินภายใต้เงื่อนไขเดียวกัน มันคือการจัดอันดับที่มีอยู่จริง มันเป็นเพียงการจัดอันดับของส่วนผสมงานเฉพาะเจาะจง ภายใต้ความพยายามสูงสุดพร้อม fallback ค่าเริ่มต้น และไม่ได้บอกอะไรเลยว่าสองตัวนี้ตัวไหนจะเป็นตัวเลือกที่คุ้มค่ากว่ากันสำหรับภาระงานที่ทั้งคู่ไม่ได้ถูกวัดประสิทธิภาพไว้
กับดักของชื่อ: นี่คือหน้า Claude Sonnet 5.5 หน้าไหนกันแน่
ผู้อ่านที่ค้นหาชื่อของโมเดลนี้จะพบหน้าหลายหน้าบนบล็อกนี้ที่ดูเหมือนหน้านี้ แต่ไม่ใช่ หน้าลงวันที่ 2026-09-24 คือหน้าคาดการณ์: มันถูกเขียนขึ้นก่อนที่โมเดลจะวางจำหน่าย และเนื้อหาของมันคือโพสต์ X เพียงโพสต์เดียวที่อ้างว่ามีการทดสอบแบบลับ ซึ่งถูกสร้างขึ้นใหม่โดยเทียบกับตัวเลขของโมเดลที่มันจะมาแทนที่ หน้าที่เผยแพร่ในสัปดาห์เปิดตัวคือบทความการเปิดตัว: เนื้อหาของมันคือการเปลี่ยนแปลงที่ทำให้โค้ดเดิมเสียห้ารายการที่ส่งผลกระทบต่อโค้ดที่ทำงานอยู่แล้วบน Claude Sonnet 5 บวกกับการเปลี่ยนแปลงที่หกที่เปลี่ยนรูปแบบการตอบกลับโดยไม่ทำให้เกิดข้อผิดพลาด ยังมีชุดหน้าเปรียบเทียบที่นำชื่อโมเดลนี้ไปเทียบกับโมเดลของผู้ขายรายอื่น และหน้าที่เน้นการนำไปใช้เกี่ยวกับสิ่งที่โปรโมชันของการเปิดตัวครอบคลุม
ไม่มีหน้าใดเป็นหน้าโมเดล และนั่นคือช่องว่างที่ชิ้นงานนี้เติมเต็ม หน้านี้คือแหล่งอ้างอิงที่ผู้อ่านไปถึงหลังจากค้นหาชื่อของโมเดลนั้นเอง: มันคืออะไร ราคาเท่าไร วัดอะไร และงานชิ้นใดเป็นของมัน รายละเอียดการโยกย้ายบนหน้า rollout และคำวิจารณ์เรื่องแหล่งที่มาบนหน้า anticipation ยังอยู่ที่เดิม หากคุณมีโค้ด Sonnet 5 อยู่ในการใช้งานจริง หน้า rollout คือหน้าแรกที่คุณควรคลิก และหน้านี้คือสิ่งที่บอกคุณว่าโมเดลที่คุณกำลังโยกย้ายไปหานั้นเป็นโมเดลที่คุณต้องการหรือไม่
มีธรรมเนียมการตั้งชื่ออย่างหนึ่งที่ควรแก้ตั้งแต่ตอนนี้ เพราะมันทำให้เข้าใจผิดได้ด้วยตัวมันเอง คำต่อท้าย 5.5 บ่งบอกถึงรุ่น ไม่ใช่อันดับ Claude Sonnet 5.5 กับ Claude Opus 5.5 อยู่ในรุ่นเดียวกันของตระกูลเดียวกัน และตัวเลขหน้าเครื่องหมายจุดคือระดับ ไม่มีอะไรในคำต่อท้ายที่บอกคุณได้ว่ารุ่นไหนชนะเบนช์มาร์ก
ความพร้อมใช้งาน, ลงวันที่
Claude Sonnet 5.5 อยู่บน OrcaRouter ตั้งแต่เปิดตัว โดยใช้ชื่อ anthropic/claude-sonnet-5.5 ในราคาตามที่ Anthropic ประกาศเองโดยไม่บวกเพิ่ม: อินพุต $2.00 และเอาต์พุต $10.00 ต่อล้านโทเค็น ตัวเลขสองค่านี้อ่านจาก endpoint โมเดลของเราเองเมื่อ 2026-10-08 และตรงกับ rate card ของผู้ให้บริการทุกบรรทัด หน้าของเราสำหรับโมเดลนี้ระบุหน้าต่างบริบท 1M โทเค็น และเอาต์พุตสูงสุด 128K เช่นเดียวกัน ระบุข้อความ รูปภาพ และไฟล์เป็นประเภทอินพุตที่รองรับ และมีข้อความเป็นเอาต์พุตเดียว ทำเครื่องหมายว่าออกจำหน่าย 2026-09-28 และไม่เลิกใช้ และแสดงว่าเข้าถึงได้ทั้งผ่าน endpoint chat-completions ที่เข้ากันได้กับ OpenAI และผ่าน endpoint messages ของ Anthropic เอง — ซึ่งทำให้มันเป็นการเปลี่ยนแปลงแบบแทนได้ทันทีสำหรับการผสานรวมที่รองรับตัวใดตัวหนึ่งอยู่แล้ว
ทุกอย่างอื่นในแคตตาล็อกเดียวกันเข้าถึงได้จากคีย์เดียวกัน: API เดียวสำหรับโมเดล 200+ ตัว พร้อมกับ ราคาตามรายการของผู้ให้บริการที่ส่งต่อโดยไม่บวกเพิ่ม 0% ดังนั้นเมื่อผู้ขายลดราคา ลูกค้าจึงได้รับในวันเดียวกับที่ประกาศ การสลับไปใช้ระบบสำรองอัตโนมัติ เมื่อปลายทางเริ่มทำงานได้แย่ลง และมี routing DSL สำหรับกรณีที่คุณต้องการตรึงโมเดลใดโมเดลหนึ่งหรือประกอบหลายโมเดลเข้าด้วยกันเป็นคำตอบเดียว การผสมผสานนี้เองที่ทำให้คำถามในหน้านี้ตอบได้อย่างถูกเงินแทนที่จะแพง โมเดลทั้งสองในตารางเปรียบเทียบข้างต้นอยู่ภายใต้ข้อมูลรับรองชุดเดียวกัน ดังนั้นราคาที่คุณนำมาเปรียบเทียบจึงเป็นราคาที่ผู้ขายประกาศเอง ไม่ใช่ราคาของตัวแทนจำหน่าย และการทดสอบเวอร์ชันมีค่าใช้จ่ายเพียงการรัน eval หนึ่งครั้ง ไม่ใช่โปรเจกต์ย้ายระบบ: ให้กำหนดทราฟฟิกส่วนหนึ่งไปที่ anthropic/claude-sonnet-5.5 ส่วนที่เหลือให้ใช้ตัว flagship ต่อไป และให้ตัวเลขต้นทุนต่องานที่ทำสำเร็จของคุณเองเป็นตัวตัดสินว่าโมเดลใดควรเป็นค่าเริ่มต้น

เวอร์ชันสั้น
Claude Sonnet 5.5 เป็นโมเดลระดับกลางที่มีตัวเลขใกล้เคียงระดับเรือธง และมีราคาเอาต์พุตเพียงครึ่งหนึ่งของเรือธง และมีสามข้อเท็จจริงที่ตัดสินว่าโมเดลนี้จะเป็นค่าเริ่มต้นของคุณหรือไม่ มันตามหลัง Claude Opus 5.5 อยู่ 1.62 คะแนนบนดัชนี v4.3.2 ของ Artificial Analysis โดยอยู่ที่ 56.00 เทียบกับ 57.62 โดยตัวเลขทั้งสองวัดจาก revision เดียวกันและในการตั้งค่า max-effort แบบเดียวกันพร้อม fallback ตามค่าเริ่มต้น มันมีค่าใช้จ่าย $2 / $10 เทียบกับ $4 / $20 ของเรือธง โดยส่วนลดแคชและแบตช์เป็นสัดส่วนเดียวกัน而非ต่างกัน ช่องว่างด้านราคาจึงยังคงอยู่ผ่านทุกส่วนลดที่ทั้งสองโมเดลมีให้ และมันตั้งค่าเริ่มต้นที่ high effort ในขณะที่เรือธงตั้งค่าเริ่มต้นที่ medium ซึ่งหมายความว่าการตั้งค่าที่สืบทอดมาจากเรือธงจะทำงานสูงขึ้นหนึ่งระดับที่นี่แทนที่จะต่ำลง และค่าใช้จ่ายของเรื่องนี้เป็นหน้าที่ของคุณที่จะวัด ไม่ใช่สันนิษฐาน
ตัวเลือกของ Anthropic เองก็ยังเริ่มที่ Claude Opus 5.5 สำหรับงานส่วนใหญ่ และนั่นก็เป็นสิ่งที่ควรรู้ก่อนที่คุณจะตัดสินใจมาตรฐานกับอะไรสักอย่าง แต่สำหรับผู้อ่านส่วนใหญ่ที่มาถึงหน้านี้จากการค้นหาชื่อโมเดลนี้ ระดับกลางคือค่าเริ่มต้นที่สมเหตุสมผล ส่วนเรือธงคือข้อยกเว้นที่คุณซื้อเมื่อการประเมินของคุณเองเรียกร้อง — งานที่ขอบเขตชัดเจนในปริมาณมาก ความหน่วงต่ำ หน้าต่างล้านโทเค็นโดยไม่มีค่าธรรมเนียมเพิ่มสำหรับคอนเท็กซ์ยาว และอัตราที่ลดครึ่งในบรรทัดเอาต์พุต ทั้งสองตัวห่างกันแค่คีย์เดียวบน OrcaRouter และการประเมินที่ใช้ตัดสินเลือกระหว่างสองตัวนั้นใช้เวลาแค่บ่ายเดียว ไม่ใช่การย้ายระบบทั้งครั้ง
การเปรียบเทียบในบทความนี้4
ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
