
Claude Opus 5.5 ราคา: ตารางราคาฉบับเต็ม บรรทัดแคช และงานหนึ่งงานมีค่าใช้จ่ายจริงเท่าไร
- openaiใหม่OpenAI: GPT-6 Luna2026-09-2237ความฉลาด
- openaiใหม่OpenAI: GPT-6 Sol2026-09-2248ความฉลาด
- anthropicใหม่Anthropic: Claude Opus 5.52026-09-2258ความฉลาด
- grokใหม่Grok 4.72026-09-2146ความฉลาด
- Orcaใหม่Orca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 ต่อ 1 ล้านโทเค็น · 177 tok/s
- orcaใหม่Orca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 ต่อ 1 ล้านโทเค็น · 1323 tok/s
- deepseekใหม่DeepSeek: DeepSeek V4.1 Flash2026-09-1040ความฉลาด
- openaiOpenAI: GPT-6 Astra2026-09-0453ความฉลาด77การเขียนโค้ด
- googleGoogle: Gemini 3.8 Flash2026-09-0241ความฉลาด76การเขียนโค้ด
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245ความฉลาด76การเขียนโค้ด
- anthropicAnthropic: Claude Fable 5.12026-09-0153ความฉลาด82การเขียนโค้ด
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 ต่อ 1 ล้านโทเค็น · 108 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642ความฉลาด72การเขียนโค้ด
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 ต่อ 1 ล้านโทเค็น · 220 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845ความฉลาด75การเขียนโค้ด
- obsidianQwen3.8 27B2026-08-1534ความฉลาด68การเขียนโค้ด
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236ความฉลาด69การเขียนโค้ด
- grokSpaceXAI: Grok 4.62026-08-1244ความฉลาด77การเขียนโค้ด
- metaMeta: Muse Spark 1.22026-08-0540ความฉลาด72การเขียนโค้ด
- qwenQwen: Qwen3.8 Max2026-08-0345ความฉลาด76การเขียนโค้ด
Claude Opus 5.5 มีราคาตั้งไว้ที่ 4.00 ดอลลาร์ต่อล้านโทเคนอินพุต และ 20.00 ดอลลาร์ต่อล้านโทเคนเอาต์พุต ซึ่งเป็นการลดลง 20% แบบคงที่จาก 5.00/25.00 ดอลลาร์ที่ Claude Opus 5 เคยเป็นอยู่ โดยการอ่านแคชลดลง 60% เหลือ 0.20 ดอลลาร์ต่อล้าน นี่คือราคาที่ Anthropic ประกาศ ซึ่งอ่านได้จากเอกสารราคาของ Anthropic เองเมื่อวันที่ 24 กันยายน 2026 สองวันหลังจากที่โมเดลเปิดตัว ราคาที่ติดป้ายไว้เป็นส่วนที่ง่าย Anthropic ยังระบุอีกว่าโมเดลนี้มีต้นทุนในการรัน "ต่ำลงประมาณ 40%" สำหรับปริมาณงานทั่วไป และตัวเลขนั้นไม่ได้อยู่ในตารางราคา — มันเป็นคำอธิบายจากผู้ขายที่สร้างขึ้นจากการลดราคาต่อโทเคน บวกกับสมมติฐานว่าโมเดลใช้โทเคนน้อยลงและใช้จำนวนรอบน้อยลงในการทำงานเดิมให้เสร็จ หน้านี้แยกสองส่วนนี้ออกจากกัน: ทุกอัตราที่คุณตรวจสอบได้จากตารางวันนี้ และคณิตศาสตร์เบื้องหลังอัตราที่คุณตรวจสอบไม่ได้ Claude Fable 5.1 ซึ่งเป็นระดับราคา 10/50 ดอลลาร์ที่อยู่เหนือขึ้นไป ปรากฏอยู่ตลอดในฐานะการเปรียบเทียบที่ Anthropic เองเป็นผู้ทำ
ตารางราคาฉบับเต็ม ทุกบรรทัดตามที่ Anthropic เผยแพร่
ทุกอย่างในส่วนนี้ได้มาจากการอ่านเอกสารราคาของ Anthropic ที่ platform.claude.com และ claude.com เมื่อวันที่ 24 กันยายน 2026 ไม่มีข้อความใดในที่นี้ที่ยกมาจากบทความอื่น
• อินพุต — 4.00 ดอลลาร์ต่อล้านโทเค็น (อัตราที่ Anthropic ประกาศไว้)
• เอาต์พุต — $20.00 ต่อหนึ่งล้านโทเค็น โทเค็นการคิดจะถูกคิดค่าบริการเป็นโทเค็นเอาต์พุต และการคิดแบบปรับตัวของ Claude Opus 5.5 จะเปิดอยู่เสมอและไม่สามารถปิดได้
• การอ่านแคช — $0.20 ต่อหนึ่งล้านโทเคน Anthropic ระบุในเอกสารว่าเป็น 0.05 เท่าของราคาอินพุตพื้นฐาน ซึ่งเป็นข้อยกเว้นที่ระบุไว้ในเชิงอรรถเฉพาะสำหรับโมเดลนี้
• การเขียนแคช 5 นาที — 5.00 ดอลลาร์ต่อล้านโทเค็น ซึ่งเป็นตัวคูณอินพุตพื้นฐานมาตรฐาน 1.25 เท่า ที่ Anthhropic ใช้กับทุกโมเดลในตารางนี้
• การเขียนแคช 1 ชั่วโมง — $8.00 ต่อล้านโทเค็น ซึ่งเป็นตัวคูณมาตรฐาน 2 เท่าของอินพุตพื้นฐาน
• Batch API — ลด 50% ทั้งสองทิศทาง: อินพุต $2.00 และเอาต์พุต $10.00 ต่อล้าน Anthropic เผยแพร่ตัวเลขส่วนลดให้โดยตรง แทนที่จะปล่อยให้คุณต้องหารครึ่งเอง
• โหมดเร็ว — 8.00 ดอลลาร์สำหรับอินพุต และ 40.00 ดอลลาร์สำหรับเอาต์พุตต่อล้านพอดี คิดเป็น 2 เท่าของมาตรฐานพอดี เอกสารของ Anthropic ตั้งชื่อหน้านี้ว่า "Fast mode (research preview)"
• การประมวลผลเฉพาะในสหรัฐฯ — ตัวคูณ 1.1 เท่าสำหรับอินพุต เอาต์พุต และการเขียนแคช รวมถึงการอ่านแคช เมื่อ inference_geo: "us"ถูกตั้งค่าไว้ การกำหนดเส้นทางแบบทั่วโลกซึ่งเป็นค่าเริ่มต้นจะใช้ราคามาตรฐาน
• บริบทและเพดานเอาต์พุต — บริบท 1 ล้านโทเคนและเอาต์พุตแบบซิงโครนัส 128K ในราคามาตรฐาน โดยไม่มีค่าธรรมเนียมเพิ่มสำหรับบริบทขนาดยาว Anthropic ระบุว่าคำขอขนาด 900k โทเคนคิดค่าบริการในอัตราต่อโทเคนเดียวกับคำขอขนาด 9k โทเคน บน Batch API เพดานเอาต์พุตจะเพิ่มขึ้นเป็น 300K เมื่อเปิดใช้ output-300k-2026-03-24 beta header.
Anthropic ยังระบุด้วยว่าตัวคูณของการแคช "ซ้อนทับกับตัวปรับราคาอื่น ๆ เช่นส่วนลด Batch API และข้อกำหนดเรื่องที่ตั้งข้อมูล" — ดังนั้นคำขอที่จัดเป็นชุด แคชไว้ และปักหมุดให้อยู่ในสหรัฐฯ จะคูณทั้งสามอย่างเข้าด้วยกัน และการคำนวณจะทบต้นกันแทนที่จะแทนที่กัน
นี่คือสิ่งที่ผู้อ่านของทั้งสองโมเดลชั่งน้ำหนักต้นทุนบนชีตเดียวกัน:
• Claude Opus 5 — อินพุต $5.00, เอาต์พุต $25.00, การอ่านแคช $0.50, การเขียนแคช 5 นาที $6.25, การเขียน 1 ชั่วโมง $10.00, $2.50/$12.50 สำหรับ Batch (อัตราที่ Anthropic เผยแพร่, อ่านเมื่อ 2026-09-24)
• Claude Fable 5.1 — $10.00 สำหรับอินพุต, $50.00 สำหรับเอาต์พุต, $0.25 สำหรับการอ่านแคช, $12.50 สำหรับการเขียนแคช 5 นาที, $20.00 สำหรับการเขียน 1 ชั่วโมง, $5.00/$25.00 สำหรับ Batch (อัตราที่ Anthropic เผยแพร่, อ่านเมื่อ 2026-09-24)

แคชไลน์คือจุดที่บิลของเอเจนต์ถูกตัดสินจริง ๆ
การรายงานข่าวการเปิดตัวมองว่าการอ่านแคชเป็นเพียงหมายเหตุท้ายบท ทั้งที่มันคือคันโยกเดี่ยวที่ทรงพลังที่สุดบนตารางสำหรับทุกเวิร์กโหลดที่ส่งคำนำหน้าขนาดใหญ่ซ้ำ ซึ่งก็คือเวิร์กโหลดด้านการเขียนโค้ดและเอเจนต์ส่วนใหญ่
เชิงอรรถของ Anthropic เองระบุอัตราส่วนไว้อย่างชัดเจนผิดปกติ: แคชฮิตและการรีเฟรชมีค่าใช้จ่าย 0.1 เท่าของราคาอินพุตพื้นฐานในโมเดล Claude ส่วนใหญ่, 0.025 เท่าใน Claude Fable 5.1 และ 0.05 เท่าใน Claude Opus 5.5 ดังนั้นอัตราแคชของ Claude Opus 5.5 จึงแย่กว่าอัตรามาตรฐานถึงสองเท่า และแย่กว่าของ Claude Fable 5.1 ถึงสองเท่า
ในหน่วยดอลลาร์ยังไงมันก็ชนะอยู่ดี และนี่คือส่วนที่ควรค่าแก่การทำความเข้าใจให้ลึกซึ้ง: ตัวคูณที่ดีกว่าจะไม่ชนะในหน่วยดอลลาร์ เมื่ออัตราฐานสูงกว่าถึงสองเท่าครึ่ง
• Claude Fable 5.1 — 2.5% ของฐาน $10.00 คือ $0.25 ต่อหนึ่งล้านโทเคนที่แคชไว้
• Claude Opus 5.5 — 5% ของฐาน $4.00 คือ $0.20 ต่อล้านโทเคนที่แคชไว้
• Claude Opus 5 — 10% ของฐาน $5.00 คือ $0.50 ต่อล้านโทเค็นที่แคชไว้
การกลับทิศแบบเดียวกันนี้ยังใช้กับการเขียนด้วย Claude Fable 5.1 คิดค่าบริการ $12.50 สำหรับการเขียนหนึ่งล้านโทเค็นลงแคช 5 นาที และ $20.00 สำหรับช่วงเวลา 1 ชั่วโมง ส่วน Claude Opus 5.5 คิดค่าบริการ $5.00 และ $8.00 การอ่านแคชเป็นรายการเดียวที่ Claude Opus 5.5 เอาชนะทั้งสองรุ่นพี่น้องในด้านจำนวนเงินจริง แม้ว่าจะมีอัตราส่วนอยู่ตรงกลาง
สองกฎตัดสินว่าการเขียนแคชนั้นคุ้มค่าที่จะจ่ายเลยหรือไม่ เอกสารของ Anthropic ระบุว่าการเขียนที่มีอายุ 5 นาทีมีค่าใช้จ่าย 1.25x ของอินพุตพื้นฐาน ดังนั้นจะคุ้มทุนหลังการอ่านแคชเพียงครั้งเดียว ขณะที่การเขียนที่มีอายุ 1 ชั่วโมงมีค่าใช้จ่าย 2x ของอินพุตพื้นฐาน และต้องอ่านสองครั้งจึงจะคุ้มทุน และแคชผูกติดกับพรีฟิกซ์ที่สร้างมันขึ้นมา Anthropic ระบุว่าการสลับระหว่างความเร็วแบบเร็วและความเร็วมาตรฐานจะทำให้แคชเป็นโมฆะ เพราะคำขอที่ใช้ความเร็วต่างกันไม่ได้แชร์พรีฟิกซ์ที่แคชไว้ร่วมกัน การเปลี่ยนโมเดล ระดับความพยายาม หรือคำนิยามเครื่องมือ ก็ให้ผลแบบเดียวกัน โมเดลที่ถูกกว่าซึ่งบังคับให้เขียนพรีฟิกซ์ใหม่ทุกครั้งที่สลับ อาจมีค่าใช้จ่ายมากกว่าโมเดลแพงที่มันมาแทนที่
ต้นทุนที่แท้จริงของลูปเอเจนต์ที่ยาวนาน
ลองนึกถึง coding agent ที่ทำงาน 40 เทิร์น ซึ่งส่งคำนำหน้าขนาด 120,000 โทเคนซ้ำใหม่ทุกเทิร์น — พรอมป์ระบบ สคีมาของเครื่องมือ โครงสร้างไฟล์ — และเพิ่มโทเคนอินพุตใหม่ 1,000 โทเคนต่อเทิร์นจากผลลัพธ์ของเครื่องมือ พร้อมสร้างเอาต์พุต 800 โทเคนต่อเทิร์น การแทนที่คือประเด็นตรงนี้: เปลี่ยนตัวเลขใดก็ได้ในสี่ตัวนั้นให้ตรงกับทราฟฟิกของคุณ แล้วการคำนวณด้านล่างก็ยังใช้ได้เหมือนเดิม
เกี่ยวกับ Claude Opus 5.5:
• การเขียนแคช ครั้งเดียว — 120,000 โทเค็น ในราคา $5.00 ต่อล้านโทเค็น = $0.60
• การอ่านแคช 39 เทิร์น — 4,680,000 โทเคน ในราคา $0.20 ต่อล้าน = $0.94
• อินพุตใหม่ 40 เทิร์น — 40,000 โทเคน ในราคา $4.00 ต่อล้าน = $0.16
• เอาต์พุต 40 เทิร์น — 32,000 โทเค็น ที่ $20.00 ต่อล้าน = $0.64
• ยอดรวมเซสชัน — $2.34 ซึ่งการอ่านแคชคิดเป็นประมาณ 40%
บน Claude Opus 5 ด้วยจำนวนโทเคนที่เท่ากัน: การเขียนแคช $0.75, การอ่านแคช $2.34, อินพุตใหม่ $0.20 และเอาต์พุต $0.80 — $4.09
บน Claude Fable 5.1 เมื่อจำนวนโทเค็นเท่ากัน: $1.50 สำหรับการเขียนแคช, $1.17 สำหรับการอ่านแคช, $0.40 สำหรับอินพุตใหม่ และ $1.60 สำหรับเอาต์พุต — $4.67
โทเค็นเท่ากัน จำนวนรอบเท่ากัน ไม่ต้องมีข้ออ้างเรื่องประสิทธิภาพใด ๆ: Claude Opus 5.5 ต่ำกว่า Claude Opus 5 อยู่ 43% และต่ำกว่า Claude Fable 5.1 อยู่ 50% และ 1.40 ดอลลาร์จากช่องว่าง 1.75 ดอลลาร์เมื่อเทียบกับ Claude Opus 5 — แปดสิบเปอร์เซ็นต์ของการประหยัด — มาจากบรรทัดค่าอ่านแคชเพียงอย่างเดียว, ไม่ใช่มาจากอัตราอินพุตที่เป็นตัวเลขพาดหัว
ตอนนี้ลองรันรูปแบบตรงกันข้าม: การเรียกแบบครั้งเดียวด้วยโทเค็นอินพุต 20,000 และเอาต์พุต 8,000 โดยไม่ใช้แคช Claude Opus 5.5 มีค่าใช้จ่ายอินพุต $0.08 บวกเอาต์พุต $0.16 — $0.24 Claude Opus 5 มีค่าใช้จ่าย $0.10 บวก $0.20 — $0.30 นั่นคือส่วนลดตามป้ายราคา 20% พอดี และไม่มากไปกว่านั้นแม้แต่จุดเดียว
ดังนั้น ตารางราคาเพียงอย่างเดียวให้ส่วนลดอยู่ระหว่าง 20% ถึง 43% ขึ้นอยู่กับว่าใบเรียกเก็บเงินของคุณมาจากการอ่านแคชมากแค่ไหน ข้อกล่าวอ้างใดที่สูงกว่าช่วงดังกล่าวมาจากจำนวนโทเคน ไม่ใช่จากราคา
ที่มาของคำกล่าวที่ว่า Anthropic "มีค่าใช้จ่ายในการรันถูกกว่าประมาณ 40%"
เอกสารเปิดตัวของ Anthropic ระบุว่า Claude Opus 5.5 "ใช้พลังประมวลผลในการให้บริการน้อยกว่า Opus 5" และการทดสอบของบริษัทแสดงให้เห็นว่า "จะมีค่าใช้จ่ายน้อยกว่า Opus 5 ถึง 40% สำหรับภาระงานทั่วไป" ในการตั้งค่าเริ่มต้น คำอธิบายที่ Anthropic ให้คือโมเดลนี้ "มีค่าใช้จ่ายต่อโทเค็นน้อยกว่า Opus 5 และใช้โทเค็นต่องานน้อยกว่า ซึ่งเมื่อรวมแล้วทำให้ค่าใช้จ่ายลดลง 40%"
เรียกมันให้ตรงตามที่เป็น: คำอธิบายลักษณะจากผู้ขายเกี่ยวกับค่าเฉลี่ยข้ามเวิร์กโหลดที่ Anthropic เลือก ไม่ใช่ผลลัพธ์ที่ผ่านการตรวจสอบ และไม่ใช่อัตราที่เผยแพร่บนตารางราคา ครึ่งที่ตรวจสอบได้คือครึ่งแรก — ลด 20% สำหรับอินพุตและเอาต์พุต ลด 60% สำหรับการอ่านแคช ทั้งสองอ่านได้บนตารางวันนี้ ครึ่งหลังขึ้นอยู่กับว่าโมเดลใช้โทเค็นน้อยลงและใช้จำนวนรอบน้อยลงกับงานเวิร์กโหลดของคุณ ซึ่งตรวจสอบได้โดยการรันเท่านั้น
หลักฐานที่ Anthropic นำเสนอสำหรับส่วนที่เกี่ยวกับโทเคน คือชุดคำกล่าวของลูกค้าในช่วงเปิดตัว ทั้งหมดต่อไปนี้เผยแพร่โดยผู้จำหน่าย โดยอธิบายถึงเวิร์กโหลดที่ผู้จำหน่ายและลูกค้าของตนเลือกใช้:
• Box — โมเดลนี้ "ใช้โทเค็นเพียงหนึ่งในสามของที่ Opus 5 ใช้" โดยคำตอบ "ใช้คำน้อยลง 40% โดยไม่สูญเสียความแม่นยำ"
• Kiro — มัน "แก้โจทย์ได้มากกว่า Opus 5 ขณะที่เรียกใช้งานน้อยลงประมาณ 40% และใช้โทเค็นเพียงครึ่งเดียว"
• Factory — มัน "เทียบเท่า Opus 5 ที่ความพยายามสูง โดยใช้โทเคนเอาต์พุตน้อยลง 20 ถึง 25%"
• GitHub — ใช้โทเค็นและจำนวนขั้นตอนน้อยที่สุดในบรรดาที่เราวัดมา และใน VS Code "แก้ไขงานในเทอร์มินัลได้มากกว่า Opus 5 ด้วยจำนวนขั้นตอนที่น้อยกว่าครึ่ง"
• การวิเคราะห์การควบรวมกิจการ ตัวอย่างที่ลงมือทำจริงหนึ่งกรณี — บริษัทซอฟต์แวร์ด้าน HR สมมติสองแห่ง โดยแต่ละโมเดลสร้างโมเดล Excel และงานนำเสนอสำหรับผู้บริหาร Anthropic รายงานว่า Claude Opus 5.5 ทำเสร็จใน 63 นาที เทียบกับ 93 นาทีของ Claude Opus 5 และ "มีต้นทุนการผลิตต่ำกว่า 50%" รายงานโดยผู้ขายเอง, n=1
ตัวถ่วงดุลที่เป็นอิสระมีความสำคัญตรงนี้ เพราะมันชี้ไปในทิศทางตรงกันข้าม Artificial Analysis วัด Claude Opus 5.5 ที่ความพยายามสูงสุดไว้ที่ประมาณ 119,000 โทเค็นเอาต์พุตต่องานใน Intelligence Index เทียบกับประมาณ 73,000 สำหรับ Claude Opus 5 ที่ความพยายามสูงสุด — จำนวนโทเค็นกลับเพิ่มขึ้น ไม่ได้ลดลง บทสรุปของมันต่อการตั้งค่านั้นคือ Claude Opus 5.5 "อยู่ในระดับเดียวกับ Opus 5 ในแง่ต้นทุนต่องาน แม้จะมีโทเค็นเอาต์พุตมากกว่า 1.6 เท่า" ที่ต้นทุนซึ่งประกาศไว้ $5.98 ต่อหนึ่งงานใน Intelligence Index นี่คือการวัดที่เป็นอิสระที่ความพยายามสูงสุด และไม่ใช่การขัดแย้งกับคำกล่าวอ้างของ Anthropic — มันคือปลายอีกด้านหนึ่งของมาตรวัดความพยายาม
ซึ่งนำมาสู่ข้อควรระวังที่ครอบคลุมตัวเลขทุกตัวในส่วนนี้ Anthropic ระบุว่า เว้นแต่จะระบุไว้เป็นอย่างอื่น ผลลัพธ์ Claude Opus 5.5 ทั้งหมดใช้ adaptive thinking ที่ความพยายามสูงสุด Claude Opus 5.5 ตั้งค่าเริ่มต้นที่ปานกลาง ส่วน Claude Opus 5 ตั้งค่าเริ่มต้นที่สูง และระดับที่เรียกชื่อเดียวกันไม่ได้มี thinking budget เท่ากันในสองโมเดลนี้ ดังนั้นตารางของผู้ขายที่รันด้วยความพยายามสูงสุด กับตารางอิสระที่รันด้วยความพยายามสูงสุดโดยเปิด default fallback ไว้ จึงไม่ใช่การตั้งค่าเดียวกัน และการตั้งค่าเริ่มต้นก็ไม่ใช่สิ่งที่ผู้อ่านจะนำไปใช้งานจริงเช่นกัน ค่าเฉลี่ย 40% ที่วัดได้จากชุดเวิร์กโหลดที่คัดเลือกมา ภายใต้การตั้งค่าที่คุณอาจไม่ได้ใช้ เป็นเพียงสมมติฐานเริ่มต้น — ไม่ใช่รายการในงบประมาณ
Fast mode เป็นพรีวิวสำหรับการวิจัย ไม่ใช่ระดับการให้บริการ
โหมดเร็วบน Claude Opus 5.5 คือ8.00 ดอลลาร์ต่ออินพุต 1 ล้านโทเค็น และ 40.00 ดอลลาร์ต่อเอาต์พุต 1 ล้านโทเค็น — ซึ่งเป็นราคาเป็นสองเท่าของราคามาตรฐานพอดี — เพื่อให้ได้จำนวนโทเค็นเอาต์พุตต่อวินาทีสูงขึ้นถึง 2.5 เท่า โดยไม่ได้ช่วยลดเวลาถึงโทเค็นแรก ประโยชน์ที่ได้จึงอยู่ที่ความเร็วในการส่งออก และจะเห็นผลชัดเจนที่สุดเมื่อใช้การสตรีม
พูดส่วนที่เหลือให้ตรง ๆ เถอะ เพราะเรื่องนี้ง่ายที่จะถูกจัดงบเป็นอีกระดับชั้นหนึ่ง ทั้งที่มันไม่ใช่ Anthropic ติดป้ายโหมดเร็วว่าเป็น ตัวอย่างให้ทดลองใช้ การเข้าถึงต้องขอผ่านผู้จัดการบัญชีหรือรายการรอ ต้องใช้เฮดเดอร์เบต้า fast-mode-2026-02-01 และ speed: "fast" ในคำขอ ใช้งานได้เฉพาะบน Claude API เท่านั้น — ไม่มีบน Amazon Bedrock, Google Cloud, Microsoft Foundry หรือ Claude Platform บน AWS ใช้ร่วมกับ Batch API หรือข้อผูกพัน Priority Tier ไม่ได้ แต่ใช้ซ้อนกับการแคชพรอมป์ต์และตัวคูณด้านการเก็บข้อมูลในประเทศได้ ดังนั้นคำขอโหมดเร็วที่แคชไว้และปักหมุดไว้ที่สหรัฐฯ จะจ่าย 1.1 เท่าซ้อนทับบน 2 เท่า และการสลับเวิร์กโหลดระหว่างโหมดเร็วกับความเร็วมาตรฐานจะทำให้แคชพรอมป์ต์ใช้ไม่ได้ ซึ่งในลูปของเอเจนต์ที่ยาวนานอาจมีค่าใช้จ่ายสูงกว่าที่ความเร็วประหยัดได้
Claude Opus 5 และ Claude Opus 4.8 ยังรองรับโหมดเร็ว ในราคา $10.00/$50.00 ส่วน Claude Opus 4.7 ปฏิเสธพารามิเตอร์นี้ทันที
หน่วยที่ใช้ตัดสินบิลคือต้นทุนต่องานที่เสร็จสมบูรณ์
อัตราทุกอัตราข้างต้นคือราคาต่อโทเคน ไม่มีใครซื้อโทเคน ราคาต่อโทเคนจะกลายเป็นต้นทุนก็ต่อเมื่อถูกคูณด้วยจำนวนโทเคนที่งานหนึ่งใช้ไป และจำนวนครั้งที่ต้องลองจนกว่าจะทำเสร็จ
ลองคิดเลขจากตัวอย่างแบบใช้แคชน้อย (cache-light) เมื่อสักครู่ ที่ราคา $0.24 ต่อรอบ โมเดลที่ทำงานเสร็จในความพยายามครั้งแรกจะมีค่าใช้จ่าย $0.24 งานเดียวกันกับคู่แข่งที่ราคา $0.30 ต่อรอบมีค่าใช้จ่าย $0.30 — ดังนั้นโมเดลที่ถูกกว่าดูเหมือนจะนำอยู่ 20% ทีนี้สมมติให้โมเดลที่ถูกกว่าต้องใช้ 1.2 รอบต่องานที่เสร็จหนึ่งงาน ซึ่งเป็นอัตราความสำเร็จที่ค่อนข้างสูงสำหรับงานแบบ agentic: 1.2 × $0.24 เท่ากับ $0.288 เทียบกับ $0.30 สำหรับทางเลือกที่ใช้รอบเดียว การประหยัดหายไปหมด ที่สามรอบจะเป็น $0.72 และโมเดลที่ดูเหมือนถูกกว่า 20% ต่อโทเคนกลับแพงกว่า 140% ต่องานที่ทำเสร็จหนึ่งงาน
นั่นคือเหตุผลที่ข้ออ้างด้านประสิทธิภาพของ Anthropic เอง — โทเค็นน้อยลง เรียกใช้น้อยลง ขั้นตอนน้อยลง — ถูกวางกรอบในหน่วยที่ถูกต้อง นี่ก็เป็นเหตุผลที่ไม่มีข้อใดควรถูกนำมาใช้เป็นรายการงบประมาณจนกว่าคุณจะทำซ้ำผลเหล่านั้นได้ การตรวจสอบเป็นเชิงกลไก: ราคาต่อรอบ คูณจำนวนรอบต่องานที่เสร็จสมบูรณ์ โดยวัดจากทราฟฟิกของคุณเอง ตัวเลขทั้งสองเป็นสิ่งที่คุณต้องสร้างขึ้นเอง และไม่มีผู้ขายรายใดเผยแพร่ตัวเลขตัวที่สองสำหรับภาระงานของคุณ
หากคุณต้องการจุดอ้างอิงเพียงหนึ่งจุดจากแหล่งที่ไม่ใช่ผู้จำหน่าย Artificial Analysis ระบุว่า Claude Opus 5.5 อยู่ที่ $5.98 ต่อหนึ่งงาน Intelligence Index ในการตั้งค่า max-effort ซึ่งเป็นตัวเลขอิสระที่การตั้งค่าดังกล่าวปริมาณงานในโปรดักชันส่วนใหญ่จะไม่ได้ใช้ จึงมีประโยชน์ในฐานะเพดานมากกว่าการคาดการณ์

สายที่อัตราที่โฆษณาไว้ไม่รวมถึง
• Residencyการประมวลผลเฉพาะในสหรัฐฯ คิดอัตรา 1.1x กับโทเค็นทุกหมวดหมู่ รวมถึงการอ่านและการเขียนแคช โดยใช้ร่วมกับโหมดเร็วและส่วนลดแบบ Batch ได้
• นิยามเครื่องมือ Anthropic เผยแพร่ค่าโอเวอร์เฮดของพรอมป์ระบบสำหรับการใช้เครื่องมือแบบรายโมเดล: การประกาศเครื่องมือจะเพิ่ม 286 โทเคน ให้กับทุกคำขอของ Claude Opus 5.5 น้อยนิดที่ 4.00 ดอลลาร์ต่อล้านโทเคน แต่คิดค่าบริการต่อคำขอ และลูปของเอเจนต์สร้างคำขอเป็นจำนวนมาก
• การทำให้แคชเป็นโมฆะ คำนำหน้าที่ถูกเขียนใหม่หลังจากการเปลี่ยนแปลงโมเดล ระดับความพยายาม คำจำกัดความของเครื่องมือ หรือความเร็ว จะถูกคิดค่าบริการในอัตราการเขียน — $5.00 หรือ $8.00 ต่อล้านบน Claude Opus 5.5 — ไม่ใช่อัตราการอ่าน $0.20
• โมเดลที่อยู่ถัดลงไป Claude Sonnet 5 อยู่ที่ราคา 2.00 ดอลลาร์สำหรับอินพุต และ 10.00 ดอลลาร์สำหรับเอาต์พุตต่อล้าน ซึ่งเชิงอรรถด้านราคาของ Anthropic ยืนยันว่านี่คือราคามาตรฐานในตอนนี้ ไม่ใช่ราคาเปิดตัวอย่างที่เคยประกาศไว้ Claude Opus 5.5 มีราคาสูงเป็น 2 เท่าของ Sonnet 5 พอดีในทั้งสองทิศทาง

เรียกใช้ Claude Opus 5.5 ในราคาตามรายการของ Anthropic
Claude Opus 5.5 พร้อมใช้งานบน OrcaRouter ที่ anthropic/claude-opus-5.5ในราคา $4.00 สำหรับอินพุต และ $20.00 สำหรับเอาต์พุตต่อหนึ่งล้าน — เป็นราคาตามรายการของ Anthropic เอง ส่งผ่านแบบไม่บวกเพิ่มที่ มาร์กอัป 0% การส่งผ่านราคาแบบนี้ควรระบุไว้อย่างชัดเจนบนหน้าราคา เพราะอัตราของผู้ให้บริการถูกส่งต่อโดยตรง แทนที่จะถูกแคชไว้ในตาราง การเปลี่ยนแปลงอัตราของผู้ขายจึงมีผลที่นี่ในวันเดียวกับที่ประกาศ ไม่ใช่หลังผ่านช่วงเวลาซิงก์ข้อมูล หาก Anthropic ปรับเปลี่ยนตารางนี้ ตัวเลขที่คุณเรียกใช้ก็จะเปลี่ยนตามไปด้วย
คีย์เดียวกันนี้เข้าถึงระดับต่าง ๆ ที่หน้านี้เปรียบเทียบด้วย — anthropic/claude-opus-5 ที่ $5.00/$25.00 และ anthropic/claude-fable-5.1 ที่ $10.00/$50.00 — พร้อมกับโมเดลอื่น ๆ ที่เหลือในไลน์อัป Claude และ โมเดลอื่นอีกกว่า 200 รายการ ดังนั้นการทดสอบว่าอัตราต่อโทเคนที่ถูกกว่านั้นยังคงใช้ได้เมื่อเจอกับจำนวนรอบการใช้งานจริงของคุณหรือไม่ จึงไม่จำเป็นต้องมีสัญญาที่สองหรือแก้ไขโค้ด การสลับไปใช้ระบบสำรองอัตโนมัติ มีไว้สำหรับกรณีที่คุณต้องการรันโมเดลที่ไม่คุ้นเคยบนเส้นทางโปรดักชันโดยไม่ต้องเดิมพันทั้งเส้นทางกับมัน
คำตอบแบบสองบรรทัดว่าหน้านี้เกี่ยวกับอะไร: เรตการ์ดคือ $4.00 ขาเข้า, $20.00 ขาออก และ $0.20 ต่อการอ่านแคชหนึ่งล้านครั้ง และส่วนลด 20% นั้นเป็นของจริงและตรวจสอบได้ในวันนี้ ส่วน 40% เป็นค่าเฉลี่ยของ Anthropic จากเวิร์กโหลดต่างๆ ที่บริษัทเลือกไว้ ลองรันลูป agent ของคุณเองหนึ่งรอบผ่านมันก่อนที่คุณจะตั้งงบโดยอิงจากตัวเลขตัวที่สอง
การเปรียบเทียบในบทความนี้3
ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
