การ์ดชื่อเรื่องหลักสำหรับ Claude Opus 5.5 พาดหัวว่า 'Anthropic ลดราคาเรือธงของตัวเอง' พร้อมป้ายที่ระบุราคา $4 ขาเข้า / $20 ขาออก, อ่านแคช $0.20 และวันที่ 22 กันยายน 2026 และโลโก้ OrcaRouter ที่มุมขวาล่าง
Guides & Insights

Claude Opus 5.5: Anthropic ลดราคาโมเดลเรือธง และนั่นคือเรื่องราวที่แท้จริง

ผู้เขียน

Alistair Wren

วันที่เผยแพร่

โมเดลล่าสุด · 20ดูโมเดลทั้งหมด
เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
กลับไปยังโพสต์ทั้งหมด

ผู้ขายเปิดตัว Claude Opus 5.5 เมื่อวันที่ 22 กันยายน 2026 และตัวเลขที่สำคัญไม่ได้อยู่บนแผนภูมิ benchmark ใด ๆ มันคือ $4 โมเดลเรือธงตัวใหม่มีราคา $4 ต่อล้านโทเคนอินพุต และ $20 ต่อล้านโทเคนเอาต์พุต ลดลงจาก $5/$25 ที่ Claude Opus 5 เก็บมาตั้งแต่ 24 กรกฎาคม — และการอ่านแคชลดจาก $0.50 เหลือ $0.20 ต่อล้าน ซึ่งเป็นการลด 60% ในรายการค่าใช้จ่ายที่ครองสัดส่วนการรันเอเจนต์ระยะยาว โมเดลนี้ยังดีขึ้นด้วย: บริษัทรายงานว่ามันเทียบเท่า Claude Fable 5.1 ซึ่งเป็นระดับราคา $10/$50 ที่สูงกว่านั้น ในงานส่วนใหญ่ แต่การที่แล็บแนวหน้าลดราคาป้ายของโมเดลที่พร้อมใช้งานทั่วไประดับท็อปของตนลง 20% — และบอกว่าต้นทุนจริงในการรันลดลง 40% — คือส่วนของการเปิดตัวครั้งนี้ที่เปลี่ยนสิ่งที่คุณสามารถจ่ายเพื่อสร้างได้ การเปิดตัวขีดความสามารถใหม่ ๆ จะถูกเลียนแบบภายในหนึ่งไตรมาส การลดราคาในระดับเรือธงเป็นการกำหนดพื้นราคาใหม่ให้กับทุกคน

ส่วนต่าง ในตัวเลขที่คุณจ่ายจริง

A single-column scoreboard for Claude Opus 5.5 listing input price $4.00 per million down from $5.00, output $20.00 down from $25.00, cache read $0.20 down from $0.50, default effort medium versus high, Terminal-Bench 4.0 66.4% at xhigh effort, and an AA Intelligence Index of 54, with a sourcing footer.

ทุกอย่างด้านล่างนี้คือตารางราคาที่ Anthropic เผยแพร่อย่างเป็นทางการ ไม่ใช่การประมาณการ:

• อินพุต — 4 ดอลลาร์ต่อล้านโทเค็น ลดลงจาก 5.00 ดอลลาร์ของ Opus 5

• เอาต์พุต — $20 ต่อล้านโทเคน ลดลงจาก $25.00

• อ่านแคช — $0.20 ต่อล้าน ลดลงจาก $0.50

• การเขียนแคช 5 นาที — $5 ต่อล้าน; การเขียนแคช 1 ชั่วโมง — $8

• Batch API — ลด 50% ทั้งสองทิศทาง เหมือนเดิม

• บริบทและเอาต์พุต — บริบท 1M โทเคน, เอาต์พุตสูงสุด 128K, เอาต์พุต 300K บน Batch API ที่อยู่เบื้องหลังoutput-300k-2026-03-24 เฮดเดอร์เบต้า

• ขีดจำกัดข้อมูลความรู้ — มิถุนายน 2026

• ความพยายาม (Effort) — การคิดแบบปรับได้เปิดทำงานตลอดเวลา ค่าเริ่มต้นคือ medium; สเกลมีตั้งแต่ low, medium, high, xhigh, max

นอกจากนี้ยังมีโหมด Fast บน Claude API โดยคิดราคาแยกต่างหากที่ $8/$40 ต่อล้าน และ Anthropic อธิบายว่าเป็นพรีวิวสำหรับการวิจัยมากกว่าจะเป็นตัวเลือกทั่วไป

บรรทัดค่าแคชสมควรได้รับความสนใจมากที่สุด และเป็นบรรทัดเดียวที่การรายงานข่าวการเปิดตัวมองข้ามไป สำหรับเอเจนต์ที่ส่งพรอมต์ระบบขนาดใหญ่และโครงสร้างไฟล์แบบต้นไม้ยาว ๆ ซ้ำใหม่ในทุกเทิร์น การอ่านแคชคือต้นทุนหลัก ไม่ใช่อินพุตใหม่ การลด 60% ตรงจุดนั้นช่วยงานเขียนโค้ดจริงได้มากกว่าการลด 20% ของอัตราที่เป็นหัวข้อข่าว และนี่คือเหตุผลที่การคำนวณในส่วนถัดไปออกมาอย่างที่มันเป็น

คำกล่าวอ้าง "ถูกกว่า 40%" มาจากไหน

Anthropic กล่าวว่า Opus 5.5 มีต้นทุนการรันบนเวิร์กโหลดทั่วไปต่ำกว่า Opus 5 ประมาณ 40% นั่นคิดเป็นประมาณสองเท่าของส่วนลดราคา ซึ่งหมายความว่าส่วนใหญ่ไม่ได้มาจากราคาเลย — แต่เป็นเพราะโมเดลทำงานน้อยลงเพื่อให้ได้คำตอบเดียวกัน Anthropic รายงานว่าผลลัพธ์ที่สร้างขึ้นเร็วกว่า Opus 5 มากกว่า 30% และลูกค้ากลุ่มเปิดตัวหลายรายระบุถึงการลดจำนวนโทเคนที่เกี่ยวข้อง: Box กล่าวว่าใช้โทเคนเพียงหนึ่งในสาม โดยคำตอบมีความยาวน้อยลงประมาณ 40% Kiro รายงานว่าใช้โทเคนราวครึ่งหนึ่งและเรียกใช้งานน้อยลง 40% Factory ระบุว่าโทเคนเอาต์พุตลดลง 20–25% และ GitHub กล่าวว่าโมเดลนี้เป็นหนึ่งในโมเดลที่ใช้โทเคนและจำนวนขั้นตอนน้อยที่สุดเท่าที่บริษัทเคยวัดมา

นั่นคือคำรับรองจากลูกค้าที่ผู้ขายเผยแพร่เอง ไม่ใช่การวัดที่ผ่านการตรวจสอบ และโดยเฉพาะ "40%" นั้นเป็นคำอธิบายของ Anthropic เองเกี่ยวกับค่าเฉลี่ยข้ามภาระงานที่บริษัทเลือกเอง ให้มองเป็นทิศทางมากกว่าตัวเลขที่จะใส่ในงบประมาณ ส่วนที่คุณตรวจสอบได้อย่างอิสระในวันนี้คือเรตการ์ด — ซึ่งอยู่บนหน้าตาราคาสาธารณะของ Anthropic — และจำนวนโทเคนที่ภาระงานของคุณสร้างขึ้นเมื่อคุณรันมัน

ตัวอย่างการใช้งานที่มีประโยชน์ที่สุดในเอกสารเปิดตัวก็เป็นตัวอย่างที่ดูไม่หวือหวาที่สุดเช่นกัน: การวิเคราะห์การควบรวมกิจการที่ใช้ Opus 5.5 เวลา 63 นาที และมีค่าใช้จ่ายน้อยกว่างานเดียวกันบน Opus 5 ถึง 50% ซึ่งใช้เวลา 93 นาที หากคุณกำลังตั้งราคาให้เอเจนต์ ปริมาณที่น่าสนใจคืออัตราส่วนนั้น ไม่ใช่อัตราต่อโทเคน — โมเดลที่ถูกกว่าซึ่งต้องรันสามรอบจึงจะเสร็จไม่ได้ประหยัดอะไรให้คุณเลย

ตารางเกณฑ์มาตรฐาน และใครเป็นผู้จัดทำ

ตัวเลขเปรียบเทียบแบบตัวต่อตัวทุกตัวด้านล่างนี้มาจากเอกสารเปิดตัวของ Anthropic ซึ่งรันเทียบกับโมเดลของบริษัทเองและของคู่แข่ง นี่เป็นเรื่องปกติสำหรับการเปิดตัว และเป็นเหตุผลว่าทำไมจึงไม่ควรตีความข้อมูลเหล่านี้ว่าเป็นคำตัดสินที่เป็นอิสระ ตลอดทั้งฉบับ ตัวเลขต่างๆ ถูกระบุว่าเป็นข้อมูลที่ผู้ขายรายงานเอง

• Terminal-Bench 4.0 — Opus 5.5 66.4%, Opus 5 52.3%, Fable 5.1 55.8%, GPT-6 Astra 57.9% Anthropic ระบุว่าการรันนี้ใช้ระดับความพยายาม xhigh ไม่ใช่ค่าเริ่มต้น

• FrontierCode v1.1 (Main) — Opus 5.5 54.4%, Opus 5 48.0%, Fable 5.1 50.3%, GPT-6 Astra 53.3%; 54.6% ที่ระดับความพยายามปานกลางซึ่งเป็นค่าเริ่มต้น

• CursorBench 4.0 — Opus 5.5 57.8%, Opus 5 46.6%, Fable 5.1 51.8%; 52.5% ที่ระดับความพยายามปานกลาง

• GDPval-AA v2.1 งานด้านความรู้ — Opus 5.5 1846 Elo, Fable 5.1 1735, Opus 5 1708, GPT-6 Astra 1542

• Terminal-Bench-Science 0.1 — Opus 5.5 ทำได้ 58.7% เมื่อเทียบกับ Opus 5 ที่ 29.0% โดยมี GPT-6 Astra นำอยู่ที่ 64.6%

• OSWorld 2.0 การใช้งานคอมพิวเตอร์ — 81.8% สำหรับ Opus 5.5 เทียบกับ 74.0% สำหรับ Opus 5 โดยระบุว่าเป็นผลลัพธ์เพียงบางส่วน

สองเรื่องที่ควรดึงออกมาจากรายการนั้น เรื่องแรก effort ระดับ medium ไม่ได้แย่กว่า max มากนัก: 54.6% เทียบกับ 54.4% บน FrontierCode และ 52.5% เทียบกับ 57.8% บน CursorBench เนื่องจาก effort ส่งผลต่อค่าใช้จ่ายโดยตรง ผลลัพธ์ FrontierCode นั้น — ไม่มีความสูญเสียที่วัดได้ในการตั้งค่าเริ่มต้น — จึงเป็นข้อค้นพบที่ผูกกับเงินไว้ เรื่องที่สอง Anthropic เองเตือนว่า ณ ระดับความสามารถนี้ ความต่างของ benchmark เป็น "คู่มือที่เชื่อถือได้น้อยลงสำหรับความแตกต่างในโลกจริง" และช่องว่างภายในของบริษัทเมื่อเทียบกับ Fable 5.1 นั้นแคบกว่าที่คะแนนบ่งชี้ ผู้ขายที่บอกให้คุณลดความเชื่อถือในตารางของตัวเองนั้นคือประโยคที่น่าเชื่อถือที่สุดในเอกสาร

ในฝั่งของผู้ประเมินอิสระ Artificial Analysis ให้คะแนน Claude Opus 5.5 อยู่ที่ 54 บน Intelligence Index ของตน เป็นอันดับสามในบรรดาโมเดลที่ติดตาม ภายใต้การตั้งค่าที่ระบุว่า "Adaptive Reasoning, High Effort, Default Fallback" วลีสุดท้ายนั้นมีนัยสำคัญจริง ๆ และนำไปสู่หัวข้อถัดไปโดยตรง

การกำหนดเส้นทางเพื่อความปลอดภัยเป็นส่วนหนึ่งของสเปก

ป้ายกำกับ "Default Fallback" ในผลลัพธ์อิสระนั้นไม่ใช่อาร์ติแฟกต์ของ benchmark Opus 5.5 มาพร้อมระดับการป้องกันที่ Anthropic เคยสงวนไว้สำหรับ Fable 5.1 เพราะเทียบได้กับ Claude Mythos 5.1 ในด้านชีววิทยาและความมั่นคงปลอดภัยทางไซเบอร์ ในทางปฏิบัติ นั่นหมายความว่าคำขอด้านความมั่นคงปลอดภัยทางไซเบอร์ส่วนใหญ่จะถูกเปลี่ยนเส้นทางไปยัง Claude Opus 4.8 และงานด้านชีววิทยาจะถูกส่งไปใช้ Claude Opus 5 แทน เว้นแต่บัญชีจะได้รับการยืนยันผ่านโปรแกรม Life Sciences หรือ Cyber Verification ของ Anthropic

หากผลิตภัณฑ์ของคุณส่งพรอมป์ตที่เกี่ยวข้องกับไซเบอร์หรือวิทยาศาสตร์ชีวภาพไปยัง claude-opus-5-5 คำตอบที่คุณได้รับกลับมาอาจไม่ได้มาจาก Claude Opus 5.5 เลยก็ได้ การประเมินของคุณ ต้นทุนต่องานของคุณ และการวัดคุณภาพของคุณ ล้วนแอบรวมโมเดลที่เล็กกว่าไว้ในเทิร์นเหล่านั้นอย่างเงียบ ๆ สำหรับทีมส่วนใหญ่ สิ่งนี้ไม่เคยเกิดขึ้น แต่สำหรับใครก็ตามที่อยู่ในสายเครื่องมือด้านความปลอดภัยหรือไบโอเทค มันเกิดขึ้นตลอดเวลา และมันเป็นรายละเอียดด้านปฏิบัติการที่สำคัญที่สุดเพียงอย่างเดียวของการเปิดตัวครั้งนี้ — มันยังหมายความว่าการผสานรวม API ที่ทำงานได้ก็ยังสามารถให้ผลลัพธ์ที่แย่กว่าโมเดลก่อนหน้าของคุณได้ ในพรอมป์ตที่คุณให้ความสำคัญมากที่สุด มีระดับการยืนยันใหม่พร้อมให้ใช้งานแล้ว โปรดตรวจสอบว่าคุณอยู่ในระดับใดระดับหนึ่งหรือไม่ ก่อนที่คุณจะสันนิษฐานว่าสตริงชื่อโมเดลหมายถึงสิ่งที่มันระบุ

สี่การเปลี่ยนแปลงที่ทำให้โค้ดเดิมใช้งานไม่ได้ ก่อนที่คุณจะสลับสตริง

Screenshot of Anthropic's Claude Platform documentation page for Claude Opus 5.5, showing the model overview line 'For long-running agentic coding and knowledge work', the model ID claude-opus-5-5, a 1M-token context window, 128K max output, and input pricing $4 and output pricing $20 per million tokens.

Opus 5.5 ไม่ใช่ตัวแทนที่สามารถนำมาใช้แทน Claude Opus 5 ได้ทันที หรือไม่ใช่การเปลี่ยนชื่อ Claude Opus 5 บันทึกการย้ายระบบของ Anthropic เองระบุการเปลี่ยนแปลงสี่ประการที่จะทำให้โค้ดที่มีอยู่ใช้ไม่ได้:

• ไม่สามารถปิดใช้งาน Thinking ได้อีกต่อไป โค้ดที่กำหนด thinking: disabled หรือพึ่งพาเส้นทางที่ไม่ใช้ Thinking จะเกิดข้อผิดพลาดหรือเปลี่ยนพฤติกรรมโดยไม่แจ้งให้ทราบ; ตอนนี้ความลึกถูกควบคุมผ่านพารามิเตอร์ effort เท่านั้น

• การบังคับใช้เครื่องมือจะส่งคืนข้อผิดพลาด การส่ง tool_choice ที่บังคับให้ใช้เครื่องมือที่ระบุไว้เฉพาะไม่ได้รับการสนับสนุน

• บล็อก Thinking ถูกผูกติดกับโมเดลที่สร้างบล็อกเหล่านั้นและกับบทสนทนา ดังนั้นจึงไม่สามารถนำมาเล่นซ้ำข้ามโมเดลได้ในแบบที่ไปป์ไลน์บางระบบสันนิษฐานไว้

• ก่อนหน้านี้ computer_20251124 เครื่องมือ computer-use ไม่เป็นที่ยอมรับบน Claude API หรือ Google Cloud

มีการเปลี่ยนแปลงที่ห้าที่ไม่ได้ทำให้อะไรพัง แต่เปลี่ยนผลลัพธ์: ข้อความระหว่างการเรียกใช้เครื่องมือตอนนี้ส่งกลับมาอยู่ในบล็อก thinking ซึ่งมีข้อความว่างเปล่าที่การตั้งค่าการแสดงผลเริ่มต้น แอปพลิเคชันที่สตรีมข้อความนั้นให้ผู้ใช้เป็นอัปเดตความคืบหน้าจะเงียบไประหว่างการเรียกใช้เครื่องมือ จนกว่าจะตั้งค่าการแสดงผลที่ทำให้ข้อความนั้นกลับมา ไม่มีข้อผิดพลาดใด ๆ; UI ก็แค่หยุดพูด นั่นคือรีเกรสชันแบบที่ถูกส่งขึ้นโปรดักชันเพราะการทดสอบทุกอย่างผ่าน

การเปลี่ยนแปลงสามข้อแรกมีผลกับ Fable 5.1 ด้วยเช่นกัน ดังนั้นหากคุณได้ย้ายไปใช้โมเดลดังกล่าวแล้ว งานก็เสร็จไปส่วนหนึ่งแล้ว

รันมันควบคู่ไปกับสิ่งที่คุณมีอยู่แล้ว

รายละเอียดของการย้ายระบบที่ทำให้ทีมต้องจ่ายแพงที่สุดไม่ใช่การเปลี่ยนแปลงของ API แต่คือการที่ Opus ตัวใหม่ที่มีสเกลความพยายาม (effort scale) ต่างออกไป ทำให้โมเดลต้นทุนที่คุณสร้างขึ้นโดยอิงกับตัวเก่าใช้ไม่ได้อีกต่อไป คำแนะนำของ Anthropic เองก็คือให้ทดสอบหลายระดับความพยายาม แทนที่จะยกการตั้งค่าของ Opus 5 มาใช้ต่อ ซึ่งหมายความว่าคำตอบสำหรับคำถามที่ว่า "5.5 ถูกกว่าสำหรับเราหรือไม่" ขึ้นอยู่กับการวัดผลที่ยังไม่มีใครได้รันกับพรอมป์ของคุณเลย

การวัดผลนั้นทำได้ง่ายขึ้นเมื่อโมเดลเก่ายังคงห่างแค่การเรียกครั้งเดียวบนคีย์เดียวกัน. Claude Opus 5 อยู่บน OrcaRouter แล้ววันนี้ในราคา $5.00/$25.00 ของ Anthropic เอง โดยบวกเพิ่ม 0% — ราคาตามที่ผู้ให้บริการประกาศส่งผ่านตรง ดังนั้นอัตราที่คุณเห็นคืออัตราที่ Anthropic ประกาศ Claude Opus 5.5 ยังไม่ใช่หนึ่งในเส้นทางของเรา แต่เปิดให้ใช้ผ่าน API ของ Anthropic เองและคลาวด์รายใหญ่ เมื่อมันมาถึง การเปรียบเทียบทั้งสองที่ความพยายามเท่ากันจะกลายเป็นกฎการจัดเส้นทาง แทนที่จะเป็นการผสานรวมครั้งที่สอง: ส่งทราฟฟิกส่วนหนึ่งไปยังโมเดลใหม่ เก็บการสลับสำรองอัตโนมัติให้ชี้ไปที่ตัวที่คุณระบุลักษณะไว้แล้ว และอ่านจำนวนโทเค็นของคุณเองแทนที่จะดูตารางเปิดตัว การประกอบการเรียกข้ามหลายโมเดล — ตัวหนึ่งร่าง อีกตัวตรวจสอบ — เป็นเพียงบรรทัด routing-DSL บนปลายทางเดียวกัน

Screenshot of the OrcaRouter model page for Claude Opus 5 (anthropic/claude-opus-5), showing the model header, the Vision, Tools, JSON and Reasoning capability tags, the attribution 'by Anthropic - 2026-07-24', and the model description.

สิ่งที่มันไม่ได้ให้กับคุณก็คือคำตัดสินที่เป็นอิสระเกี่ยวกับ Opus 5.5 ยังไม่มีอะไรทำได้เลย การเปรียบเทียบแบบตัวต่อตัวที่เผยแพร่ออกมานั้นเป็นของ Anthropic เอง และคะแนนจากภายนอกที่มีอยู่เพียงหนึ่งเดียวก็คือการกำหนดค่าความพยายามแบบเดียวของระบบที่นำไปใช้งาน ซึ่งมีการจัดเส้นทางสำรองฝังมาในตัว

การได้รับมัน และสิ่งที่กำลังจะมาถึง

Claude Opus 5.5 เปิดให้ใช้งานแล้วภายใต้ Model ID claude-opus-5-5บน Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry และ Claude Platform บน AWS โดย Anthropic ระบุสถานะเป็น active และจะยังไม่ปลดระวางก่อนวันที่ 22 กันยายน 2027

มีสองเรื่องตามมา Anthropic กล่าวว่า Claude Sonnet 5.5 และ Claude Haiku 5.5 กำลังจะมา "ในอีกไม่กี่สัปดาห์ข้างหน้า" พร้อมการปรับปรุงด้านประสิทธิภาพและความปลอดภัยหลายอย่างเช่นเดียวกัน — ซึ่งหากเป็นจริง นั่นคือเหตุการณ์ที่มีนัยสำคัญมากกว่าสำหรับใครก็ตามที่ภาระงานไม่จำเป็นต้องใช้ Opus ระดับแนวหน้า และภาพรวมการวัดประสิทธิภาพจากผู้ทดสอบอิสระยังคงนิ่งไม่ลงตัว: คะแนนจาก Artificial Analysis เป็นเพียงภาพแรกของรูปแบบการทำงานแบบหนึ่ง ในระบบที่นำไปใช้งานจริงซึ่งมีพฤติกรรมสำรองตามที่อธิบายไว้ข้างต้น ไม่ใช่การจัดอันดับที่มั่นคง

ช่องโหว่หนึ่งที่ยอมรับกันอย่างตรงไปตรงมาในการเปิดตัวครั้งนี้: Anthropic รายงานว่า Opus 5.5 มักสงสัยว่าตนกำลังถูกประเมินอยู่ ซึ่งมีการเปิดเผยว่าเป็นข้อจำกัด และมันตัดตรงเข้าที่สิ่งที่ตารางเปรียบเทียบผลการทดสอบวัดพอดี โมเดลที่แสดงพฤติกรรมแตกต่างออกไปเมื่อรู้ว่าตนกำลังถูกจับตามอง คือโมเดลที่คะแนนของมัน ไม่ว่าจะมาจากผู้ขายหรือจากหน่วยงานอิสระ ก็คาดการณ์ได้น้อยกว่าที่รูปแบบนั้นบ่งชี้

Claude Opus 5.5 เป็นการเปิดตัวระดับ Opus รุ่นที่สามในรอบสี่เดือน และเป็นการเปิดตัวครั้งแรกนับตั้งแต่ผู้บริหารสูงสุดของ Anthropic ออกมาแสดงจุดยืนต่อสาธารณะว่าควรกำกับจังหวะการพัฒนาระดับแนวหน้า ข้อเท็จจริงทั้งสองประการนี้อยู่ในเอกสารฉบับเดียวกัน ตัวเลขขีดความสามารถจะเป็นที่ถกเถียงกันไปอีกหนึ่งสัปดาห์ ส่วนราคาและอัตราแคชนั้นจะยังคงเป็นจริงแม้ผ่านไปอีกหนึ่งปี

การเปรียบเทียบในบทความนี้1

ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน

© 2026 OrcaRouter

สำหรับผู้ให้บริการ

ให้บริการแพลตฟอร์มการอนุมานอยู่หรือไม่ นำโมเดลของคุณขึ้น OrcaRouter

providers@orcarouter.ai

เข้าร่วมคอมมูนิตี้ของเรา

Discordsupport@orcarouter.aiXGitHubYouTube