
Claude Sonnet 5.5: การรั่วไหลของการทดสอบแบบลับที่สร้างขึ้นจากตัวเลขสี่ตัวที่มีอยู่แล้ว
- typesafeใหม่TypeSafe: Jev 1.132026-09-24$0.04 / $0.00 ต่อ 1 ล้านโทเค็น · 36 tok/s
- openaiใหม่OpenAI: GPT-6 Luna2026-09-2237ความฉลาด
- openaiใหม่OpenAI: GPT-6 Sol2026-09-2248ความฉลาด
- anthropicใหม่Anthropic: Claude Opus 5.52026-09-2258ความฉลาด
- grokใหม่Grok 4.72026-09-2146ความฉลาด
- Orcaใหม่Orca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 ต่อ 1 ล้านโทเค็น · 181 tok/s
- orcaใหม่Orca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 ต่อ 1 ล้านโทเค็น · 1277 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040ความฉลาด
- openaiOpenAI: GPT-6 Astra2026-09-0453ความฉลาด77การเขียนโค้ด
- googleGoogle: Gemini 3.8 Flash2026-09-0241ความฉลาด76การเขียนโค้ด
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245ความฉลาด76การเขียนโค้ด
- anthropicAnthropic: Claude Fable 5.12026-09-0153ความฉลาด82การเขียนโค้ด
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 ต่อ 1 ล้านโทเค็น · 110 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642ความฉลาด72การเขียนโค้ด
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 ต่อ 1 ล้านโทเค็น · 220 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845ความฉลาด75การเขียนโค้ด
- obsidianQwen3.8 27B2026-08-1534ความฉลาด68การเขียนโค้ด
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236ความฉลาด69การเขียนโค้ด
- grokSpaceXAI: Grok 4.62026-08-1244ความฉลาด77การเขียนโค้ด
- metaMeta: Muse Spark 1.22026-08-0540ความฉลาด72การเขียนโค้ด
เมื่อวันที่ 24 กันยายน มีการโพสต์ตัวเลขสี่ตัวบน X เพื่อเป็นหลักฐานว่า Claude Sonnet 5.5 "กำลังถูกทดสอบแบบลับ ๆ อยู่แล้ว": หน้าต่างบริบท 1M โทเคน, เอาต์พุตสูงสุด 128K โทเคน, 2 ดอลลาร์ต่อโทเคนอินพุตหนึ่งล้านโทเคน และ 10 ดอลลาร์ต่อโทเคนเอาต์พุตหนึ่งล้านโทเคน ตอนนี้ทั้งสี่ตัวอยู่ในรายการราคาของ Anthropic เอง โดยผูกอยู่กับ Claude Sonnet 5 — โมเดลที่เวอร์ชัน 5.5 จะเข้าแทนที่ ซึ่งเปิดให้ใช้ทั่วไปตั้งแต่ 30 มิถุนายน 2026 ราคาพาดหัว 2 / 10 ดอลลาร์เดียวกันนี้ยังเป็นของ GPT-6 Sol ซึ่ง OpenAI เปิดตัวเมื่อวันที่ 22 กันยายน และความทับซ้อนนี้เองที่ทำให้โพสต์ดังกล่าวอ่านได้ว่าเป็นการตอบโต้ OpenAI มากกว่าการรีเฟรชระดับราคาตามปกติ: "สำหรับผมแล้ว นี่อ่านได้ว่าเป็นการตอบโต้โดยตรงต่อ GPT-6-Sol ราคาเดียวกัน และน่าจะมีประสิทธิภาพใกล้เคียงกัน"
ไม่มีสิ่งใดในนั้นทำให้ข้อกล่าวอ้างนี้ผิด มันทำให้ข้อกล่าวอ้างนี้ไม่สามารถถูกหักล้างได้ ซึ่งเป็นปัญหาที่ต่างออกไปและเป็นปัญหาที่มีประโยชน์กว่าที่จะจดบันทึกไว้ การพบเห็นจากการทดสอบแบบลับจะดีได้เพียงเท่ากับหลักฐานที่อยู่เบื้องหลังมันเท่านั้น และหลักฐานที่อยู่เบื้องหลังการพบเห็นครั้งนี้คือสเปกชีตที่แยกไม่ออกจากโมเดลที่ Anthropic ให้บริการมาเป็นเวลาสิบสองสัปดาห์
จริงๆ แล้วโพสต์อะไรไป
แหล่งข้อมูลคือโพสต์ X เพียงโพสต์เดียวจากบัญชี @kimmonismus ลงวันที่ 24 กันยายน 2026 โดยระบุหน้าต่างบริบท เพดานเอาต์พุต และราคาทั้งสอง เปรียบเทียบราคากับ GPT-6 Sol และสรุปว่า Sonnet 5.5 อยู่ระหว่างการทดสอบ ไม่มีภาพหน้าจอ ไม่มีสตริงโมเดล ไม่มีคำตอบจาก API ไม่มีรายการในคอนโซล ไม่มีคำอธิบายพฤติกรรมจากผู้ทดสอบ และไม่มีผู้สังเกตการณ์รายที่สองแนบอยู่กับสิ่งใดในนั้น โพสต์นี้เป็นการกล่าวอ้างที่มีตัวเลขอยู่ในนั้น และตัวเลขเหล่านั้นคือขีดจำกัดสาธารณะของระดับนั้น
นั่นควรค่าแก่การแยกออกจากเรื่องราวก่อนเปิดตัวของ Anthropic ประเภทอื่น เพราะปี 2026 ให้กำเนิดทั้งสองแบบ และทั้งสองดูไม่เหมือนกันเลย ตัวระบุการเข้าถึงก่อนกำหนดในเดือนสิงหาคม claude-marshmallow-eap และ claude-melon-eap เป็นสตริงที่มีอยู่ในคำขอ — น่าเกลียด ไม่หรูหรา และตรวจสอบได้ เรื่องราว Opus 5.2 ที่ดำเนินไปตลอดเดือนกันยายนเป็นรายงานการกำหนดเส้นทาง: นักพัฒนาสังเกตว่าแบ็กเอนด์ที่อยู่เบื้องหลังป้าย "Opus 5" ตอบกลับต่างออกไป และบรรยายพฤติกรรมนั้น ทั้งสองอย่างเป็นหลักฐานที่จับต้องได้ "กำลังถูกทดสอบแบบลับ ๆ อยู่แล้ว" โดยไม่มีหลักฐานประกอบ เป็นเพียงบทสรุปของสิ่งที่ระดับ Sonnet ขายอยู่แล้ว
ยังมีรูปแบบหนึ่งที่น่าสังเกตในตัวแหล่งข่าวเอง บัญชีเดียวกันได้โพสต์บทสรุปรวบรวมเมื่อวันที่ 20 กันยายน ซึ่งเปิดด้วยโมเดลสี่ตัวที่ระบุว่า "กำลังมีการทดสอบแล้ว" — Claude Sonnet 5.2, Claude Opus 5.2, Claude Fable 5.2 และ Gemini 4 Pro ในสี่ชื่อนั้น รายการ Opus และ Fable มีรายงานแยกต่างหากที่ได้รับการยืนยันสอดคล้องกันรองรับอยู่ และรายการ Gemini ก็มีหลักฐานการพบเห็นของตัวเอง รายการ Sonnet มีเพียงตำแหน่งในรายการ สี่วันต่อมา ข้ออ้างเรื่อง Sonnet ได้เติบโตเป็นสเปกชีต และสเปกชีตนั้นก็คือโมเดลที่มีอยู่แล้ว
ตัวเลขทั้งสี่คือตัวเลขของ Claude Sonnet 5
นี่คือส่วนที่ใช้เวลาตรวจสอบแค่สามสิบวินาที และแทบไม่มีใครเคยทำ หน้าภาพรวมโมเดลของ Anthropic ที่อ่านวันนี้ ระบุว่า Claude Sonnet 5 มีหน้าต่างบริบท 1M โทเคน เอาต์พุตสูงสุด 128K และราคา $2 / $10 ต่อล้านโทเคน ลองเอาข้อมูลที่รั่วไหลมาเทียบกับสิ่งนี้:
• หน้าต่างบริบท — 1M โทเค็นที่อ้างไว้สำหรับ Claude Sonnet 5.5; 1M โทเค็นที่เผยแพร่สำหรับ Claude Sonnet 5
• เอาต์พุตสูงสุด — อ้างว่า 128K โทเคน; เผยแพร่ 128K โทเคน
• ราคาอินพุต — $2 ต่อล้านที่อ้างสิทธิ์; $2 ต่อล้านที่เผยแพร่
ราคาเอาต์พุต — 10 ดอลลาร์ต่อล้านที่อ้างสิทธิ์; 10 ดอลลาร์ต่อล้านที่เผยแพร่
• Model ID — ยังไม่มีการเปิดเผยข้อมูลสำหรับ Claude Sonnet 5.5; claude-sonnet-5 สำหรับ Claude Sonnet 5
• คะแนนอิสระ — ไม่มีสำหรับโมเดลที่อ้าง; Artificial Analysis จัดให้ Claude Sonnet 5 อยู่ที่ Intelligence Index 38 ในอันดับที่ 54 จาก 210 โมเดลที่วัด ในการตั้งค่า adaptive-reasoning, max-effort

มีอีกชั้นหนึ่งของประเด็นราคาที่ข้อมูลรั่วไหลตีความกลับด้าน เมื่อ Claude Sonnet 5 เปิดตัว มีการประกาศราคา $2 / $10 เป็นราคาเปิดตัวที่มีผลถึงวันที่ 31 สิงหาคม 2026 โดยมีกำหนดปรับขึ้นเป็น $3 / $15 ในวันที่ 1 กันยายน การปรับขึ้นนั้นไม่ได้เกิดขึ้น หน้าเพจราคาของ Anthropic ตอนนี้มีเชิงอรรถระบุว่า $2 / $10 “เป็นราคามาตรฐานแล้ว” และ “การขึ้นราคาที่เคยกำหนดไว้ก่อนหน้านี้เป็น $3 / $15 ต่อโทเคนอินพุต/เอาต์พุตหนึ่งล้านโทเคนในวันที่ 1 กันยายน 2026 จะไม่เกิดขึ้น” ดังนั้นราคาที่ข้อมูลรั่วไหลนำเสนอว่าเป็นอาวุธในการแข่งขันของโมเดลใหม่ จึงเป็นอัตราถาวรของรุ่นที่มีอยู่เดิม ซึ่งหมายความว่า Sonnet 5.5 ที่เปิดตัวในราคา $2 / $10 จะเปิดตัวโดยไม่มีส่วนลดเลย และเข้าสู่ระดับที่ตั้งราคาแข่งขันกับ GPT-6 Sol อยู่แล้ว
สิ่งเดียวที่ Anthropic ได้พูดจริงๆ
ตัดทุกอย่างจากแหล่งข่าวนิรนามออกไป แล้วจะเหลือเพียงประโยคเดียวจากฝ่ายเจ้าของผลิตภัณฑ์ที่รอดมาได้ เมื่อ Anthropic เปิดตัว Claude Opus 5.5 เมื่อวันที่ 22 กันยายน 2026 บริษัทกล่าวว่า Claude Sonnet 5.5 และ Claude Haiku 5.5 จะตามมา "ในอีกไม่กี่สัปดาห์ข้างหน้า" พร้อมนำมาซึ่งการพัฒนาที่เทียบเคียงได้ในด้านประสิทธิภาพ ความคุ้มค่า และความปลอดภัย ประโยคนั้นคือบันทึกที่ได้รับการยืนยันทั้งหมด มันไม่มีรหัสรุ่น ไม่มีหน้าต่างบริบท ไม่มีราคา ไม่มีเกณฑ์มาตรฐาน และไม่มีวันที่ — และโดยเฉพาะอย่างยิ่ง ไม่ได้กล่าวถึงการทดสอบแบบลับ เส้นทางสีเทา หรือการทดสอบใดๆ ไม่ว่าประเภทใด
ส่วนที่เหลือของพื้นที่สาธารณะของ Anthropic ก็สอดคล้องกับการตีความนั้น ภาพรวมโมเดลยังคงแสดงโมเดลสี่รายการ — Claude Fable 5.1, Claude Opus 5.5, Claude Sonnet 5 และ Claude Haiku 4.5 — โดยไม่มีแถวที่ห้า ไม่มีรายการราคา และไม่มีเครื่องหมาย "เร็ว ๆ นี้" สำหรับรุ่นสืบทอดของ Sonnet หากมีการให้บริการเช็กพอยต์ระดับ Sonnet อยู่ที่ใดที่หนึ่งซึ่งนักพัฒนาสามารถเข้าถึงได้ ตัวระบุจะเป็นสิ่งแรกที่ปรากฏขึ้น เพราะโมเดลที่ให้บริการจะต้องมีชื่อในคำขอ ไม่มีสิ่งใดปรากฏขึ้นเลย
สิ่งหนึ่งที่ประกาศเมื่อเดือนกันยายนได้คลี่คลายก็คือ: มันขัดแย้งกับข่าวรั่วก่อนหน้านี้ที่อ้างว่าสาย Haiku จะถูกปลดระวาง และเจเนอเรชัน 5.5 จะปรับโครงสร้างไลน์อัป Haiku 5.5 กำลังจะมา ตามที่ Anthropic ระบุ ซึ่งหมายความว่าเรื่องการปรับโครงสร้างนั้นผิดในทิศทางที่คนปล่อยข่าวรั่วแทบไม่ค่อยผิดกัน — ระดับราคาถูกยังคงอยู่
การรั่วไหลเมื่อเดือนสิงหาคมบอกว่า 2 ล้านโทเคน แต่อันนี้บอกว่า 1 ล้าน
หกสัปดาห์ก่อนโพสต์วันที่ 24 กันยายน เมื่อวันที่ 9 สิงหาคม บัญชี X อีกรายได้โพสต์เอกสารสเปก "SONNET 5.5 LEAK" พร้อมคำกล่าวอ้างที่กล้าหาญยิ่งขึ้นมาก: หน้าต่างบริบทขนาด 2 ล้านโทเคน ซึ่งมากเป็นสองเท่าของ Sonnet 5, การอนุมานที่เร็วขึ้น, การใช้เครื่องมือเบราว์เซอร์และเทอร์มินัลที่ดีขึ้น, ประสิทธิภาพที่ใกล้เคียงกับ Claude Fable 5, และการเปิดตัว "เดือนหน้า" การรั่วไหลนั้นมาพร้อมกับกราฟิกที่ออกแบบให้ดูเหมือนการ์ดตัวอย่างของ Anthropic มันยังมาพร้อมกับรายละเอียดร้ายแรงที่เหล่านักวิจารณ์ของมันจับประเด็นทันที: ชื่อรหัสที่มันให้ไว้ "Fennec" เป็นชื่อรหัสที่เปิดตัวไปแล้วกับ Claude Sonnet 5 เมื่อวันที่ 30 มิถุนายน ชื่อรหัสไม่สามารถเป็นหลักฐานใหม่ของรุ่นสืบทอดของโมเดลที่ใช้ชื่อนั้นได้
ดังนั้นคลื่นข่าวหลุดสองระลอกจึงขัดแย้งกันในตัวเลขที่ถูกอ้างถึงมากที่สุดเพียงตัวเดียว เดือนสิงหาคมบอกว่า context 2M เดือนกันยายนบอกว่า 1M เป็นไปไม่ได้ที่ทั้งสองจะอธิบายบิลด์เดียวกัน การตีความที่น่าจะเป็นไปได้มากที่สุดคือแบบน่าเบื่อ: โพสต์เดือนกันยายนอธิบายขีดจำกัดที่เผยแพร่ของระดับ Sonnet เพราะนั่นคือสิ่งที่โมเดลระดับ Sonnet ดูเหมือนเมื่อมองจากภายนอก และโพสต์เดือนสิงหาคมเป็นการคาดเดาว่าการรีเฟรชหนึ่งครั้งน่าจะเพิ่มอะไรเป็นสองเท่า สังเกตทิศทางที่ตัวเลขเคลื่อนไป — ลง ไปสู่สิ่งที่มีอยู่แล้ว
แล้วการเปรียบเทียบ GPT-6 Sol น่ะถูกต้องหรือเปล่า
ส่วนใหญ่แล้ว และจุดที่มันพังนั่นแหละคือส่วนที่น่าสนใจ GPT-6 Sol เปิดตัวเมื่อวันที่ 22 กันยายน 2026 ซึ่งเป็นวันเดียวกับ Claude Opus 5.5 และราคาตั้งต้นอยู่ที่ 2 ดอลลาร์ต่ออินพุต 1 ล้านโทเคน และ 10 ดอลลาร์ต่อเอาต์พุต 1 ล้านโทเคน — เท่ากับอัตราของ Sonnet 5 พอดี และตรงกับที่ข้อมูลรั่วไหลอ้างไว้สำหรับ Sonnet 5.5 พอดี มันให้หน้าต่างบริบท 1,050,000 โทเคน พร้อมเพดานเอาต์พุต 128K ซึ่งทั้งคู่ห่างจากตัวเลขของ Claude Sonnet 5 แค่นิดเดียว ส่วนรุ่นน้องที่ถูกกว่า GPT-6 Luna อยู่ที่ $0.10 / $0.50
จุดแตกหักอยู่ที่บริบทขนาดยาว GPT-6 Sol คิดราคาเป็นสองระดับ: 2 / 10 ดอลลาร์จนถึง 272,000 โทเคนอินพุต จากนั้นเป็น 4 / 15 ดอลลาร์เมื่อเกินกว่านั้น Anthropic ไม่ทำแบบนั้นในสาย Sonnet — Claude Sonnet 5 คิดค่าบริการหน้าต่าง 1 ล้านโทเคนเต็มในอัตรามาตรฐาน คำขอ 900K โทเคนจึงมีค่าใช้จ่ายต่อโทเคนเท่ากับคำขอ 9K ดังนั้นการเทียบ Sonnet 5.5 ตัวจริงกับ GPT-6 Sol ตัวจริงจึงเป็นราคาที่เสมอกันสำหรับพรอมป์ทั่วไป และเป็นช่องว่างสองเท่าสำหรับงานเอกสารยาวและงานรีโปขนาดใหญ่ที่ทั้งสองโมเดลถูกขายให้รองรับ "ราคาเดียวกัน" เป็นความจริงในระดับพาดหัว แต่ผิดในงานที่ต้องเลือกระดับราคานั้น
ยังมีข้อแม้ประการที่สองอยู่เบื้องหลังการเปรียบเทียบทั้งหมด Claude Sonnet 5 ใช้โทเคไนเซอร์รุ่นใหม่กว่าของ Anthropic ซึ่งสร้างโทเคนมากกว่าประมาณ 30% สำหรับข้อความเดียวกัน เมื่อเทียบกับรุ่นก่อนหน้า อัตราที่โฆษณาไว้ไม่ใช่บิล บิลคือจำนวนโทเคนต่องาน และนั่นคือตัวเลขที่ไม่มีข้อมูลรั่วไหลใดเคยระบุ
อะไรจะทำให้ Sonnet 5.5 มีความสำคัญ
วางเรื่องที่มันมีอยู่จริงหรือไม่ไว้ก่อน แล้วหันมาถามว่าอะไรจะเปลี่ยนไปสำหรับคนที่จ่ายเงินซื้อโทเคน สี่สิ่งด้วยกัน และไม่มีสักอย่างที่เป็นสเปกชีต
อย่างแรกคือราคาที่ต่ำกว่า $2 / $10 เมื่อการขึ้นราคาในวันที่ 1 กันยายนถูกยกเลิก อัตราของผู้ให้บริการรายเดิมจึงกลายเป็นอัตราถาวรแล้ว — ดังนั้นผู้สืบทอดที่คงอัตราเดิมไว้จึงเป็นเพียงการเปลี่ยนแปลงแบบแนวนอน และข่าวระดับ Sonnet เพียงเรื่องเดียวที่ทำให้เม็ดเงินเคลื่อนไหวคือการลดราคา
ประการที่สองคือบริบทที่เกิน 1M นั่นคือข้อเสนอที่แท้จริงของการรั่วไหลเมื่อเดือนสิงหาคม และมันเป็นช่องว่างขีดความสามารถเพียงหนึ่งเดียวที่การรั่วไหลนั้นระบุได้ ซึ่งเจ้าตลาดยังไม่ครอบคลุม
ข้อที่สามคือจำนวนโทเคนต่องาน การคิดแบบปรับตัวของ Claude Sonnet 5 เปิดใช้งานตามค่าเริ่มต้น และการวิเคราะห์อิสระได้วัดว่ามันสร้างโทเคนเอาต์พุตต่องานมากกว่ารุ่นก่อนหน้าอย่างมีนัยสำคัญ เวอร์ชันที่คงอัตรา $2 / $10 ไว้และหยุดการเพิ่มขึ้นนั้นจะลดค่าใช้จ่ายจริงได้มากกว่าการลดราคาแบบพาดหัวข่าว
ข้อที่สี่คือตัวระบุ สตริงชื่อโมเดล API แถวในเอกสาร รายการในตารางราคา การ์ดโมเดล — อย่างใดอย่างหนึ่งในนั้นก็เพียงพอจะยุติข้อโต้แย้งได้แล้ว และการที่ทั้งสี่อย่างนี้ไม่มีอยู่เลย หลังจากข้อมูลรั่วที่ชัดเจนขนาดนั้น ตัวมันเองกลับเป็นข้อเท็จจริงที่เผยความจริงได้มากที่สุดในเรื่องนี้
สิ่งที่คุณสามารถโทรหาได้ในวันนี้
Claude Sonnet 5 ไม่ใช่ตัวแทนชั่วคราวระหว่างที่เทียร์ต่าง ๆ ยังต้องจัดให้ลงตัว มันคือโมเดลที่ทราฟฟิก Claude API ส่วนใหญ่รันอยู่แล้ว โดยมีหน้าต่าง 1M โทเคน เอาต์พุต 128K และอัตรา $2 / $10 ซึ่งตอนนี้ถือเป็นมาตรฐาน ไม่ใช่ราคาโปรโมชัน

มันอยู่บน OrcaRouter มาตั้งแต่เดือนมิถุนายนในราคา $2 / $10 ของ Anthropic เอง, ส่งผ่านในราคาปลีกของผู้ให้บริการโดยไม่มีการบวกเพิ่มดังนั้นการเปลี่ยนแปลงราคาของผู้ขายในสาย Sonnet จะมีผลที่นี่ในวันเดียวกัน แทนที่จะเป็นรอบบิลถัดไป คีย์เดียวกันนี้เข้าถึง GPT-6 Sol ได้แล้วในราคา $2 / $10 ซึ่งสำคัญกว่าปกติในบทความแบบนี้: การเปรียบเทียบที่ข้อมูลรั่วไหลนี้อาศัยอยู่ คือการเปรียบเทียบที่คุณสามารถรันได้ด้วยตัวเองบนข้อมูลรับรองเดียว แทนที่จะเป็นสองสัญญา

นั่นยังเป็นวิธีที่ประหยัดที่สุดในการตอบคำถามที่การรั่วไหลนี้ก่อขึ้น หาก Sonnet 5.5 ปรากฏขึ้นจริง มันก็จะเข้ามาในแค็ตตาล็อกเหมือนอย่างอื่น และคุณกำหนดเส้นทางทราฟฟิกส่วนหนึ่งไปที่มัน โดยมีระบบเฟลโอเวอร์อัตโนมัติไปยัง Claude Sonnet 5 อยู่เบื้องหลัง — ไม่ต้องบูรณาการครั้งที่สอง ไม่ต้องเจรจาใหม่ และไม่มีเส้นทางโปรดักชันใดที่ต้องพึ่งพาโมเดลที่ยังไม่มีใครวัดประสิทธิภาพอย่างอิสระ การลองใช้ระดับที่ยังไม่ผ่านการพิสูจน์เป็นการตัดสินใจด้านการกำหนดเส้นทาง ไม่ใช่โครงการย้ายระบบ
ดูอะไรดีแทนโพสต์หลุดครั้งถัดไป
สามสัญญาณ เรียงตามลำดับจากสิ่งที่บอกคุณได้มากไปน้อย ตัวระบุเป็นสิ่งที่ชี้ขาด เพราะโมเดลที่ให้บริการจำเป็นต้องมีชื่อในคำขอ และนั่นคือวิธีที่เรื่องราวก่อนการเปิดตัวของ Anthropic ทุกเรื่องที่ตรวจสอบได้ในปี 2026 กลายเป็นเรื่องที่ตรวจสอบได้ การยอมรับจากผู้ขาย — การ์ดโมเดล แถวในเอกสาร บรรทัดราคา หรือโมเดลที่ปรากฏในรายการของ Anthropic เอง — ยุติเรื่องนี้อย่างสิ้นเชิง; ประโยค 'อีกไม่กี่สัปดาห์' หมายความว่าหนึ่งในสิ่งเหล่านั้นเป็นสิ่งที่พึงมีจริงๆ รายงานของผู้ทดสอบที่อธิบายพฤติกรรมมากกว่าข้อกำหนดเป็นสัญญาณที่อ่อนแอที่สุดในสาม และก็ยังมากกว่าสิ่งที่มีอยู่จริงในปัจจุบัน
จนกว่าหนึ่งในนั้นจะเกิดขึ้นจริง สรุปตามตรงก็คือ Anthropic ได้สัญญาว่าจะมี Sonnet รุ่นปรับปรุงใหม่ในอีกไม่กี่สัปดาห์ข้างหน้า และผู้สังเกตการณ์รายหนึ่งได้บรรยายถึงมันโดยใช้ตัวเลขของโมเดลที่มันจะเข้าไปแทนที่ หากสแตกของคุณรัน claude-sonnet-5 อยู่แล้ว ก็ไม่มีอะไรต้องรอ และไม่มีอะไรต้องวางแผนรองรับ หากคุณกำลังชั่งน้ำหนักระหว่าง Claude Sonnet 5 กับ GPT-6 Sol ตัวเลขที่คุณนำมาใช้ตัดสินใจได้คือตัวเลขที่เผยแพร่ไปแล้ว และมันก็เป็นตัวเลขชุดเดียวกับที่ข่าวรั่วนั้นพยายามขายให้คุณในฐานะข่าวใหม่
การเปรียบเทียบในบทความนี้2
ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
