
การรั่วไหลของ "Kettle" ของ Claude Fable 5: รหัสโมเดลภายในที่ซ่อนอยู่ใน Signed Thinking — สิ่งที่เรารู้จนถึงตอนนี้
- z-aiใหม่Z.ai: GLM 5.32026-08-1860ความฉลาด75การเขียนโค้ด
- obsidianใหม่Qwen3.8 27B Uncensored (Aggressive)2026-08-1552ความฉลาด68การเขียนโค้ด
- qwenใหม่Qwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekใหม่DeepSeek: DeepSeek V4 Pro 08132026-08-1253ความฉลาด69การเขียนโค้ด
- grokใหม่SpaceXAI: Grok 4.62026-08-1261ความฉลาด77การเขียนโค้ด
- metaMeta: Muse Spark 1.22026-08-0557ความฉลาด72การเขียนโค้ด
- qwenQwen: Qwen3.8 Max2026-08-0358ความฉลาด72การเขียนโค้ด
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152ความฉลาด69การเขียนโค้ด
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 ต่อ 1 ล้านโทเค็น
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463ความฉลาด78การเขียนโค้ด
- googleGoogle: Gemini 3.6 Flash2026-07-2152ความฉลาด69การเขียนโค้ด
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137ความฉลาด49การเขียนโค้ด
- metaMeta: Muse Spark 1.12026-07-1653ความฉลาด71การเขียนโค้ด
- kimiMoonshotAI: Kimi K32026-07-1560ความฉลาด76การเขียนโค้ด
- openaiOpenAI: GPT-5.6 Luna2026-07-0952ความฉลาด71การเขียนโค้ด
- openaiOpenAI: GPT-5.6 Terra2026-07-0957ความฉลาด77การเขียนโค้ด
- openaiOpenAI: GPT-5.6 Sol2026-07-0961ความฉลาด77การเขียนโค้ด
- grokxAI: Grok 4.52026-07-0856ความฉลาด72การเขียนโค้ด
เมื่อวันที่ 16 สิงหาคม เวลา 23:29:45 น. ตามเวลา PDT นักวิจัยรายหนึ่งบน X ได้โพสต์ข้อกล่าวอ้างที่เปลี่ยนมุมที่ไม่โดดเด่นของ API ของ Anthropic ให้กลายเป็นเรื่องราวแบบ “สิ่งที่เรารู้จนถึงตอนนี้” พวกเขากล่าวว่า ให้ถอดรหัส “ลายเซ็น” ที่เซิร์ฟเวอร์ลงนามซึ่งติดอยู่กับทุกบล็อกการคิดของ Claude แล้วคุณจะพบชื่อหกชื่อ ซึ่งรวมถึงโมเดลที่ตอบคุณจริง ในการตีความของพวกเขา การตอบกลับที่ติดป้ายสาธารณะว่า claude-fable-5 — ซึ่งก็คือ Claude Fable 5 คลาส Mythos ที่ Anthropic ได้เปิดตัวอย่างกว้างขวางตั้งแต่วันที่ 9 มิถุนายน 2026 ในราคา 10/50 ดอลลาร์ต่อล้านโทเคน — เริ่มมีตัวระบุภายในซึ่งไม่ปรากฏที่ใดในเอกสารสาธารณะของ Anthropic: claude-kettle-e2c95a10-v2-prod ไม่มีอะไรเปลี่ยนแปลงเกี่ยวกับป้ายกำกับการตอบกลับ และไม่มีการแสดงให้เห็นว่าสิ่งใดเปลี่ยนแปลงไปทั้งเรื่องการเรียกเก็บเงิน ฟิลด์โมเดลระดับบนสุดของ API หรือการรับประกันสแนปชอตแบบตรึงของ Anthropic สิ่งที่เปลี่ยนแปลงไปคือสตริงที่ซ่อนอยู่ในฟิลด์ซึ่งเอกสารระบุไว้อย่างชัดเจนว่านักพัฒนาไม่ควรแยกวิเคราะห์
นี่คือรายงานการรั่วไหล ไม่ใช่คำตัดสิน ข้อค้นพบนี้มีอายุสี่วันแล้ว มันอาศัยการถอดรหัสของนักวิจัยเพียงคนเดียวที่ยังไม่มีการทำซ้ำอย่างอิสระ และ Anthropic ยังไม่ได้แสดงความคิดเห็นว่า "Kettle" — หรือป้ายกำกับคู่กันอย่าง MYCRO_MODEL_MANATEE — หมายถึงอะไร คำถามที่เป็นประโยชน์ไม่ใช่ "Anthropic สลับ Fable 5 ใช่หรือไม่?" หลักฐานไม่ได้ยืนยันว่าเป็นเช่นนั้น คำถามที่เป็นประโยชน์คือ หากเป็นจริง รหัสโมเดลภายในที่ปรากฏภายใต้รหัสโมเดลสาธารณะจะหมายความว่าอย่างไร และจะไม่หมายความว่าอย่างไร นี่คือสิ่งที่เรารู้จนถึงตอนนี้
สิ่งที่การรั่วไหลพบจริง
สัญญาณคือโพสต์ X เดี่ยวจาก @chetaslua (status 2089783170896179632 โพสต์เมื่อวันที่ 16 สิงหาคม 2026) ซึ่งเขียนในสไตล์ "มาก่อนพร้อมหลักฐาน" ตามปกติของบัญชี กล่าวโดยย่อ:
• บล็อกการคิดของ Claude บรรจุ protobuf ที่ลงนามโดยเซิร์ฟเวอร์ไว้ในฟิลด์ลายเซ็น
นักวิจัยกล่าวว่า ฟิลด์ที่หกของโปรโตบัฟนั้นเก็บตัวระบุของโมเดลที่สร้างการตอบสนองจริง
• เริ่มต้นเวลา 23:29:45 น. ตามเวลา PDT ของวันที่ 16 สิงหาคม ลายเซ็นที่สุ่มตัวอย่าง 2,582 จาก 2,582 ลายเซ็นมีค่าเดียวกันคือ: claude-kettle-e2c95a10-v2-prod
• ป้ายกำกับภายในที่สอง MYCRO_MODEL_MANATEE ก็ปรากฏในข้อมูลเมตาเดียวกันด้วย
ตัวเลข "2,582 จาก 2,582" กำลังทำหน้าที่เชิงวาทศิลป์: มันคือหลักฐานของนักวิจัยว่านี่ไม่ใช่เหตุการณ์ครั้งเดียวหรือการทดสอบแบบ A/B แต่เป็นการสลับเปลี่ยนทั้งหมดของสิ่งที่ตัวระบุชี้ไป สิ่งที่โพสต์ไม่ได้รวมไว้คือวิธีการเบื้องหลังการถอดรหัส — ไม่มีลายเซ็นดิบ ไม่มีสคริปต์ถอดรหัส ไม่มี schema ของ protobuf ที่อนุมานได้ ไม่มี metadata ของการตอบสนองทั้งหมด หลักฐานสาธารณะเป็นเพียงกราฟิกสรุป สิ่งนั้นทำให้การค้นพบนี้ดูน่าเชื่อถือและไม่สามารถตรวจสอบได้ในเวลาเดียวกัน

ทำไมลายเซ็นถึงต้องมี "ฟิลด์ที่หก"
Every thinking block Claude returns carries a signature field. Per Anthropic's thinking documentation, that signature is "an encrypted copy of the full reasoning" that you are supposed to pass back unchanged in multi-turn and tool-use conversations, and the API uses it "to verify that thinking blocks were generated by Claude." On Claude Fable 5 the default behavior makes the signature the only visible trace: with display set to "omitted" — the default on Fable 5, Mythos 5, Opus 5, and Sonnet 5 — the thinking block comes back with an empty thinking field and just the signature populated.
เอกสารประกอบได้เพิ่มประโยคที่มีความสำคัญสำหรับการรั่วไหลใดๆ ที่สร้างขึ้นบนฟิลด์นี้: "ฟิลด์ลายเซ็นเป็นแบบทึบแสง อย่าตีความหรือแยกวิเคราะห์มัน" การแยกวิเคราะห์มันคือสิ่งที่ข้อกล่าวอ้างของ Kettle ทำอย่างแท้จริง นั่นไม่ใช่หลักฐานว่าข้อกล่าวอ้างนั้นผิด — ลายเซ็นจะต้องสามารถอ่านได้โดยเครื่องสำหรับสแตกการให้บริการของ Anthropic เอง — แต่มันหมายความว่าการถอดรหัสถูกดำเนินการขัดกับคำสั่งที่ชัดเจนของผู้ให้บริการ บนโปรโตคอลที่ไม่มีเอกสารกำกับ และการสร้างโปรโตคอลดังกล่าวขึ้นใหม่โดยนักวิจัยยังไม่ได้รับการเผยแพร่ การอนุมานทุกข้อที่สร้างขึ้นบน "ฟิลด์ที่หกหมายถึงโมเดลที่ให้บริการ" จะสืบทอดความไม่แน่นอนนั้นมา
สิ่งที่มันไม่ได้พิสูจน์
เริ่มจากสิ่งที่หลักฐานเป็นจริง: การตอบกลับที่ถูกติดป้ายสาธารณะว่า claude-fable-5 มีตัวระบุภายในที่ไม่เคยมีการรายงานมาก่อน นั่นคือทั้งหมดที่เรามี ตัวระบุเพียงอย่างเดียวไม่สามารถยืนยันได้ว่า Anthropic เปลี่ยนน้ำหนักของ Fable 5, ว่ามีรุ่นต่อที่ทรงพลังกว่า, ว่าการตอบกลับดีขึ้นหรือแย่ลง, หรือว่าคำขอใดถูกส่งไปยังโมเดลที่เล็กกว่า "Kettle" อาจเป็นชื่อการให้บริการภายในสำหรับสแนปชอต Fable 5 ตัวเดียวกัน; มันอาจเป็นชื่อของคอมโพเนนต์เราเตอร์; หรืออาจเป็นตัวจำแนกในชุดระบบความปลอดภัย ชื่อรหัสไม่สามารถแยกแยะความเป็นไปได้เหล่านี้ได้
นโยบายการกำหนดเวอร์ชันของ Anthropic เองอธิบายว่าทำไมการรั่วไหลจึงสอดคล้องกับข้อเท็จจริงที่ว่าไม่มีอะไรเปลี่ยนแปลง จากเอกสาร "Model IDs and versioning" มีข้อความสองข้อความที่อยู่เคียงข้างกัน:
Anthropic ไม่ได้อัปเดตน้ำหนักหรือการกำหนดค่าของรหัสโมเดลที่มีอยู่ เมื่อมีเวอร์ชันอัปเดตแล้ว จะเผยแพร่ภายใต้รหัสโมเดลใหม่
น้ำหนักของโมเดลถูกกำหนดคงที่สำหรับ ID ที่กำหนด แต่โครงสร้างพื้นฐานที่ให้บริการรอบโมเดลสามารถเปลี่ยนแปลงได้ตามเวลา โครงสร้างพื้นฐานนี้รวมถึงส่วนประกอบต่าง ๆ เช่น เราเตอร์คำขอ ตัวจำแนกความปลอดภัย และตรรกะการสุ่มตัวอย่าง

ประโยคที่สองนั้นคือช่องว่างทางแนวคิดทั้งหมดระหว่าง “Kettle เป็นเรื่องอื้อฉาว” กับ “Kettle เป็นวันจันทร์ธรรมดา” เอกสารต่างๆ ยังคาดการณ์ถึงการเบี่ยงเบนทางพฤติกรรมไว้อีกด้วยว่า “ในบางครั้ง การอัปเดตโครงสร้างพื้นฐานอาจทำให้เกิดความแตกต่างเล็กน้อยในพฤติกรรมที่สังเกตได้ แม้ว่าโมเดล ID และน้ำหนักจะไม่เปลี่ยนแปลงก็ตาม” เราเตอร์หรือการปรับใช้เซอร์วิสใหม่ที่ชื่อว่า Kettle จะเข้ากับประโยคนั้นได้พอดี หากการรั่วไหลครั้งนี้จะสร้างความเสียหายอย่างแท้จริง มันจะต้องแสดงให้เห็นถึงโมเดลใหม่ที่อยู่เบื้องหลัง ID เดิมแม้จะขัดกับนโยบาย หรือกลไกที่ละเมิดกฎการมองเห็นด้านล่าง
Fable 5 มีเส้นทางสำรองที่บันทึกไว้อยู่แล้ว
Claude Fable 5 มาพร้อมกลไกการสลับโมเดลที่มีอยู่จริง มีการบันทึกไว้ และตั้งใจให้มองเห็นได้ ตัวจำแนกความปลอดภัยตรวจสอบคำขอและสามารถส่งเส้นทางบางส่วน — Anthropic อ้างถึงความมั่นคงปลอดภัยไซเบอร์เชิงรุก ชีววิทยาแบบใช้คู่ การกลั่นโมเดล และงานพัฒนาชิปขั้นแนวหน้าบางส่วน — ไปยังโมเดล Claude Opus 5 บนพื้นผิวผู้บริโภค การตั้งค่า fallback ควรจะเด่นชัด: มีประกาศ ชื่อโมเดลที่ให้บริการบนคำตอบ และตัวเลือกโมเดลเปลี่ยนเป็น Opus ใน API การตอบสนองจะเปิดเผยโมเดลที่ให้บริการผ่านฟิลด์ model ระดับบนสุดและบล็อกเนื้อหา fallback เฉพาะ
ข้อกล่าวอ้างของ Kettle อธิบายถึงบางสิ่งที่แตกต่าง และความแตกต่างนั้นคือส่วนที่สำคัญ: ตัวระบุภายในที่ปรากฏภายใต้การตอบกลับซึ่งคงไว้ซึ่งป้ายกำกับสาธารณะ Fable 5 โพสต์ของนักวิจัยไม่ได้แสดงประกาศ fallback, ฟิลด์โมเดล API ที่เปลี่ยนแปลง, หรือบล็อก fallback — ถ้าหากมันมีเรื่องราวก็คงเป็น "fallback ที่บันทึกไว้ถูกเรียกใช้" ไม่ใช่ "Anthropic กำลังกำหนดเส้นทางอย่างเงียบ ๆ" หากไม่มีสิ่งนั้น การรั่วไหลไม่ได้แสดงให้เห็นว่าการรับประกันการมองเห็นใด ๆ ถูกละเมิด เพราะมันไม่ได้แสดงให้เห็นว่า Kettle คืออะไร
ทำไมมันถึงสำคัญแม้ไม่มีอะไรเปลี่ยนแปลง
รหัสโมเดลแบบปักหมุด (pinned model IDs) เป็นกลไกแห่งความไว้วางใจ เอกสารของ Anthropic ให้สัญญาว่า "เมื่อคุณใช้รหัสโมเดลในการเรียก API โมเดลที่อยู่เบื้องหลังจะคงที่ตลอดอายุของรหัสนั้น" — นี่คือเหตุผลทั้งหมดที่ทีมงานสามารถ benchmark กับ claude-fable-5 และคาดหวังว่าผลลัพธ์จะยังคงมีความหมายในไตรมาสถัดไป ตัวระบุที่ซ่อนอยู่ใต้รหัสดังกล่าว ไม่ว่าจะเป็นอะไร ก็เป็นเครื่องเตือนว่าการรับประกันครอบคลุมเพียงน้ำหนัก (weights) และการกำหนดค่า (configuration) เท่านั้น ไม่ใช่เส้นทางทั้งหมดจากคำขอถึงโทเค็น หากโมเดลที่แตกต่างกันอย่างแท้จริงเคยถูกใช้งานภายใต้รหัสสาธารณะโดยไม่มีการเปิดเผย การประเมินทุกครั้ง การคาดการณ์ต้นทุนทุกครั้ง และการทดสอบการถดถอยคุณภาพทุกรายการที่ยึดโยงกับรหัสนั้นจะกลายเป็นโมฆะอย่างเงียบ ๆ
มุมมองด้านการเรียกเก็บเงินทำให้เรื่องนี้ชัดเจนยิ่งขึ้น Claude Fable 5 ราคา $10 ต่อล้านโทเค็นอินพุต และ $50 ต่อล้านโทเค็นเอาต์พุต — ซึ่งเป็นอัตราที่เผยแพร่สูงสุดของ Anthropic ถ้าโมเดลที่ให้บริการแตกต่างจาก ID ที่เรียกเก็บเงิน คำถามคืออัตราใดจะถูกนำมาใช้ และใครเป็นผู้ตัดสินใจ การรั่วไหลไม่ได้แสดงหลักฐานว่าเกิดเหตุการณ์นั้นขึ้น จุดสำคัญคือฟิลด์ลายเซ็นคือที่แรกที่คุณควรดูเพื่อหาสัญญาณของมัน
ช่วงเวลาก็ควรค่าแก่การสังเกตเช่นกัน นี่คือสัญญาณที่สามจาก Anthropic ภายในเก้าวัน: เมื่อวันที่ 7 สิงหาคม บริษัทประกาศว่าได้ฝึกตัวจำแนกทางชีววิทยาของ Fable 5 ใหม่ ซึ่งลดการเกิด fallback ที่เกี่ยวกับชีววิทยาลงประมาณ 85% ในการทดสอบภายใน; เมื่อวันที่ 14 สิงหาคม รายงาน Responsible Scaling Policy Risk Report ของบริษัทได้ยอมรับถึง "Model 2" ที่เป็นรุ่นภายในที่ยังไม่ได้เผยแพร่ ซึ่ง Anthropic เรียกว่า "การปรับปรุงที่เห็นได้ชัด" เหนือ Claude Mythos 5 และไม่มีแผนที่จะปล่อยรุ่นนี้ออกมา ทั้งสองเป็นคำแถลงจากบริษัทผู้ให้บริการ แต่เมื่อรวมกันแล้วแสดงให้เห็นว่า Anthropic กำลังเปลี่ยนแปลงระบบต่าง ๆ รอบ Claude Fable 5 อย่างแข็งขัน — ตัวจำแนกเมื่อวันที่ 7 และการยอมรับโมเดลรุ่นถัดไปภายในเมื่อวันที่ 14 — ขณะเดียวกันก็ยังคง ID claude-fable-5 ไว้เท่าเดิม Kettle ก็คงเป็นเรื่องราวในรูปแบบเดียวกัน เพียงแต่ไม่มีการเปิดเผยข้อมูล
ควรทำอย่างไรดี
สำหรับผู้เรียกใช้ API จุดยืนเชิงปฏิบัติคือสิ่งที่น่าเบื่อแต่ถูกต้อง: ตัวระบุหนึ่งตัวไม่ใช่หลักฐานของการสลับ และยังไม่มีอะไรที่นำไปดำเนินการได้จากการรั่วไหลในตอนนี้ สิ่งที่คุณทำได้คือสร้างหลักฐานของคุณเอง บันทึกฟิลด์โมเดลระดับบนสุดและบล็อก fallback ใดๆ ในคำตอบที่คุณได้รับจริง และสังเกตความเปลี่ยนแปลงของโทเค็นและต้นทุนบนเวิร์กโหลดคงที่ หาก fallback ที่ระบุในเอกสารถูกเรียกใช้ มันจะปรากฏชัดในตำแหน่งเหล่านั้นพอดี นั่นคือการทดสอบเดียวที่สำคัญสำหรับเวิร์กโหลดของคุณ และมันไม่ขึ้นอยู่กับว่าใครก็ตามจะถอดรหัสรูปแบบลายเซ็นของ Anthropic
หากคุณใช้ OrcaRouter เพื่อส่งคำขอไปยัง Claude Fable 5 รูปแบบการตอบกลับที่ได้จะเหมือนกับที่ Anthropic ส่งกลับมา และเนื่องจากเราส่งผ่านราคารายการของผู้ให้บริการโดยไม่คิดมาร์กอัป จึงไม่มีราคาชุดที่สองต้องกระทบยอด — ถ้า Anthropic เปลี่ยนอัตราของ Fable 5 เมื่อไหร่ ตัวเลขใหม่จะขึ้นในฝั่งเราทันทีในวันเดียวกัน สำหรับกรณีที่ยังไม่ได้รับการยืนยันแบบนี้ วิธีเสี่ยงต่ำที่จะใช้โมเดลต่อไปโดยไม่ต้องเดิมพันสายการผลิตกับข่าวลือ คือการส่งทราฟฟิกจริงบางส่วนไปยัง Claude Fable 5 พร้อมเฟลโอเวอร์อัตโนมัติไปยังตัวสำรองที่ผ่านการพิสูจน์แล้ว — Claude Opus 5 ราคา $5/$25 ต่อล้านโทเค็น หรือโมเดลระดับ coding ที่ถูกกว่า — เพื่อให้การถดถอยของคุณภาพกลายเป็นเพียงการตัดสินใจด้านการกำหนดเส้นทาง ไม่ใช่เหตุการณ์ขัดข้อง ใช้คีย์เดียวกัน ไม่ต้องมีสัญญาเพิ่มเติม และการเฟลโอเวอร์ก็คือการปรับ routing-DSL ไม่ใช่การเขียนใหม่

สิ่งที่เรากำลังดู
• ไม่ว่า Anthropic จะแสดงความคิดเห็นหรือไม่ ทางออกที่สะอาดที่สุดคือการยอมรับหนึ่งบรรทัดว่า Kettle และ Manatee คืออะไร ความเงียบให้ข้อมูลในตัวมันเอง
• การทำซ้ำโดยอิสระ หากมีผู้เผยแพร่ลายเซ็นดิบ วิธีการถอดรหัส และ schema ของ protobuf ที่อนุมานได้ สิ่งนี้จะเปลี่ยนจากกราฟิกของบุคคลคนหนึ่งไปเป็นข้อกล่าวอ้างที่ตรวจสอบได้ แต่จนกว่าจะถึงตอนนั้น มันก็เป็นเพียงสิ่งที่เรารู้เท่าที่มีในขณะนี้ ไม่ใช่ข้อค้นพบ
พื้นผิวการมองเห็น หากการตอบสนองของ claude-fable-5 เริ่มแสดงประกาศ fallback ฟิลด์โมเดล API ที่เปลี่ยนแปลง หรือบล็อก fallback การตีความแบบ "fallback ที่มีการบันทึก" จะแข็งแกร่งขึ้น หากไม่เป็นเช่นนั้น การตีความแบบ "เส้นทางที่ไม่มีการบันทึก" จะแข็งแกร่งขึ้น
• รหัสโมเดลใหม่ นโยบายการกำหนดเวอร์ชันของ Anthropic ระบุว่าเวอร์ชันใหม่จริงๆ จะเปิดตัวภายใต้รหัสใหม่ ดังนั้นการยืนยันที่ชัดเจนที่สุดว่า Kettle เป็นผู้สืบทอดที่แท้จริงก็คือ Anthropic ปล่อยบางสิ่งออกมา — ไม่ใช่แค่การชี้เส้นทางในตัวเดิม จับตาดู claude-fable-5.1 หรือสิ่งที่คล้ายกัน
• ไม่ว่า "Manatee" จะถูกอธิบายหรือไม่ ป้ายที่สองคือด้ายที่ยังไม่มีใครดึง
คำถามที่พบบ่อย
Anthropic กำลังเปลี่ยนเส้นทาง Claude Fable 5 ไปยังโมเดลอื่นจริงหรือ?
ยังไม่ได้รับการพิสูจน์ การรั่วไหลแสดงให้เห็นว่าการตอบสนองที่ติดป้ายกำกับว่า claude-fable-5 มีตัวระบุภายใน claude-kettle-e2c95a10-v2-prod ในลายเซ็นการคิดที่ลงนาม มันไม่ได้แสดงว่าน้ำหนักมีการเปลี่ยนแปลง มีการปรับใช้รุ่นถัดไป หรือมีคำขอใดถูกปรับลดระดับ "Kettle" อาจเป็นชื่อของการปรับใช้บริการภายในสำหรับสแนปชอต Fable 5 เดียวกันก็ได้
ตัวระบุ Kettle ถูกค้นพบได้อย่างไร?
นักวิจัย @chetaslua กล่าวว่าพวกเขาถอดรหัส protobuf ภายในฟิลด์ลายเซ็นของบล็อกการคิดของ Claude และอ่านตัวระบุโมเดลจากฟิลด์ที่หก เอกสารของ Anthropic เรียกลายเซ็นนี้ว่า "opaque" และบอกนักพัฒนาไม่ให้แยกวิเคราะห์ และวิธีการถอดรหัสของนักวิจัยยังไม่ได้รับการเผยแพร่ ดังนั้นการอ้างสิทธิ์ดังกล่าวจึงยังไม่สามารถทำซ้ำได้โดยอิสระ
สิ่งนี้ละเมิดการรับประกันโมเดลที่ปักหมุดของ Anthropic หรือไม่?
ไม่ทราบ เอกสารการกำหนดเวอร์ชันของ Anthropic ระบุว่าไม่มีการอัปเดตน้ำหนักหรือการกำหนดค่าของรหัสโมเดลที่มีอยู่ และเวอร์ชันใหม่จะเผยแพร่ภายใต้รหัสใหม่ — แต่พวกเขาอนุญาตอย่างชัดเจนให้โครงสร้างพื้นฐานที่ให้บริการโมเดล (ตัวเราเตอร์คำขอ ตัวจำแนกความปลอดภัย ตรรกะการสุ่มตัวอย่าง) เปลี่ยนแปลงได้ ตัวระบุ Kettle อาจเป็นการเปลี่ยนแปลงแบบนั้นพอดี ซึ่งจะไม่ละเมิดการรับประกันดังกล่าว
ฉันจะรู้ได้อย่างไรว่าโมเดลที่ให้บริการฉันเปลี่ยนไป?
จับตาดูฟิลด์ model ระดับบนสุดในการตอบกลับของ API มองหาบล็อกเนื้อหาสำรอง (fallback) และติดตามส่วนต่างของ token และค่าใช้จ่ายในปริมาณงานคงที่ fallback ตามเอกสารของ Anthropic ควรปรากฏให้เห็นในตำแหน่งเหล่านั้น ไม่มีฟิลด์ API สาธารณะใดที่เปิดเผยตัวระบุ Kettle
การอ่านอย่างตรงไปตรงมาก็คือ การรั่วไหลครั้งนี้ได้ระบุชื่อบางสิ่ง แต่ไม่ได้พิสูจน์ว่ามันคืออะไร ตัวระบุ Kettle มีอยู่จริงในความหมายเดียวที่สตริงที่รั่วไหลออกมาจะเป็นได้ นั่นคือ นักวิจัยยืนยันว่ามันปรากฏอยู่ 2,582 ครั้งจากทั้งหมด 2,582 ครั้ง เริ่มต้นในคืนวันที่ 16 สิงหาคม สิ่งที่มันชี้ไป ไม่ว่าจะเป็นโมเดลใหม่ การปรับใช้ที่ถูกเปลี่ยนชื่อ คอมโพเนนต์เราเตอร์ หรือตัวจำแนกประเภท — ยังคงไม่ได้รับการยืนยัน และเอกสารของ Anthropic เองก็มีคำอธิบายที่ธรรมดาสามัญอย่างสิ้นเชิงสำหรับเรื่องทั้งหมดนี้ นั่นคือคุณค่าของบทความนี้ และในขณะเดียวกันก็คือขีดจำกัดของมัน จนกว่าลายเซ็นดิบจะถูกเผยแพร่ หรือ Anthropic จะเปิดเผยว่า Kettle คืออะไร ท่าทีที่ถูกต้องคือการมองมันเป็น "สิ่งที่เรารู้เท่าที่รู้" น่าจับตามอง น่าบันทึกทราฟฟิกของตัวเอง และไม่คุ้มที่จะเปลี่ยนตัวเลือกโมเดลของคุณ — โดยเฉพาะเมื่อเลเยอร์การจัดเส้นทางช่วยให้คุณคงตัวเลือกไว้ได้ทั้งสองทาง
การเปรียบเทียบในบทความนี้1
ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
