
Dots vs Kimi K3: ตัวหนึ่งอ่านทั้งห้องสมุด อีกตัวออกไปค้นหาให้เจอ
- typesafeใหม่TypeSafe: Jev 1.132026-09-24$0.04 / $0.00 ต่อ 1 ล้านโทเค็น · 349 tok/s
- OpenAIใหม่OpenAI: GPT-6 Luna2026-09-2237ความฉลาด
- OpenAIใหม่OpenAI: GPT-6 Sol2026-09-2248ความฉลาด
- Anthropicใหม่Anthropic: Claude Opus 5.52026-09-2258ความฉลาด
- xAIใหม่Grok 4.72026-09-2146ความฉลาด
- Orcaใหม่Orca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 ต่อ 1 ล้านโทเค็น · 210 tok/s
- Orcaใหม่Orca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 ต่อ 1 ล้านโทเค็น · 680 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040ความฉลาด
- OpenAIOpenAI: GPT-6 Astra2026-09-0453ความฉลาด77การเขียนโค้ด
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241ความฉลาด76การเขียนโค้ด
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245ความฉลาด76การเขียนโค้ด
- AnthropicAnthropic: Claude Fable 5.12026-09-0153ความฉลาด82การเขียนโค้ด
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 ต่อ 1 ล้านโทเค็น · 49 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 ต่อ 1 ล้านโทเค็น · 102 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642ความฉลาด72การเขียนโค้ด
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 ต่อ 1 ล้านโทเค็น · 219 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845ความฉลาด75การเขียนโค้ด
- obsidianQwen3.8 27B2026-08-1534ความฉลาด68การเขียนโค้ด
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236ความฉลาด69การเขียนโค้ด
- xAISpaceXAI: Grok 4.62026-08-1244ความฉลาด77การเขียนโค้ด
มีงานเฉพาะแบบหนึ่งที่มีเพียงหนึ่งในสองสิ่งนี้เท่านั้นที่ทำได้ และควรค่าแก่การเอ่ยชื่อก่อนสิ่งอื่นใด Kimi K3 ซึ่งเผยแพร่โดย Moonshot AI เมื่อวันที่ 15 กรกฎาคม 2026 เป็นโมเดลแบบ mixture-of-experts ขนาด 2.8 ล้านล้านพารามิเตอร์ มีหน้าต่างบริบท 1,048,576 โทเคน รับข้อความและรูปภาพแล้วส่งคืนข้อความ ราคา $3.00 ต่อล้านโทเคนอินพุต และ $15.00 ต่อล้านโทเคนเอาต์พุต โดยการอ่านจากแคชอยู่ที่ $0.30 Dots คือเอเจนต์ที่ทำงานตลอดเวลาของบริษัท ประกาศเปิดตัวที่ DevDay เมื่อวันที่ 29 กันยายน 2026 พร้อมคลาวด์คอมพิวเตอร์และเบราว์เซอร์ของตัวเอง ตัวเชื่อมต่อกับแอปมากกว่า 4,000 แอป และมีที่ทางของตัวเองภายใน ChatGPT, Slack และ Teams ทำงานบน GPT-6 Astra และรวมอยู่ในแพ็กเกจ Pro และ Business Premium K3 สามารถบรรจุคลังทั้งหมดไว้ในคำขอเดียวและตอบคำถามเกี่ยวกับคลังนั้นได้ dot หนึ่งตัวสามารถไปดึงเอกสารฉบับถัดไปที่คุณยังไม่ทันคิดถึงได้ การอ่านและการดึงข้อมูลเป็นงานที่ต่างกัน และการเลือกผิดคือความผิดพลาดราคาแพง
หมายเลขที่ Kimi K3 ครอบครองแต่เพียงผู้เดียว
การเรียกคืนบริบทยาวคือการวัดที่แยกการตลาดออกจากความสามารถจริง เพราะการอ้างว่ามีหน้าต่างบริบทขนาดใหญ่เป็นเรื่องง่าย แต่การใช้ให้เกิดประโยชน์นั้นยาก K3 ได้คะแนน 88.7 ในการวัดนี้ — ซึ่งเป็นตัวเลขสูงสุดในบรรดาโมเดลทั้งหมดที่เราแสดงไว้ สูงกว่า GPT-5.6 Sol ที่ 84, MiniMax M3 ที่ 83, และ Gemini 3.1 Pro ที่ 82 นอกจากนี้ยังทำได้ 93.5 ใน GPQA Diamond และ 59.5 ใน SciCode และมี Artificial Analysis Coding Index ที่ 76.2 อยู่ในอันดับที่ 9 จาก 138 โมเดลที่วัด และมี Intelligence Index ที่ 43.6 อยู่ในอันดับที่ 19 จาก 145 ทั้งหมดนั้นเป็นตัวเลขจากบุคคลที่สาม ซึ่งรวบรวมไว้ในแคตตาล็อกของเราพร้อมแนบแหล่งที่มา แทนที่จะคัดลอกมาจากโพสต์เปิดตัว
สิ่งที่คุณได้จากมันคืองานประเภทหนึ่งที่แยกส่วนไม่ได้จริง ๆ: การอ่านฐานโค้ดทั้งหมดก่อนตอบคำถามเกี่ยวกับมัน การเทียบสัญญาย้อนหลังหนึ่งปีกับเทมเพลตใหม่ หรือการทำเซสชันแบบเอเจนต์ที่ยาวนานโดยไม่ให้ส่วนกลางหลุดจากหน่วยความจำ K3 ถูกสร้างขึ้นมาเพื่อสิ่งนั้นโดยเฉพาะ — Moonshot วางตำแหน่งมันไว้สำหรับเอเจนต์การเขียนโปรแกรมและงานความรู้ระยะยาว — และเป็นเรื่องแปลกที่มันปฏิเสธพารามิเตอร์การสุ่มทั้งหมด ไม่มี temperature ไม่มี top_p ไม่มี seed; ความลึกในการให้เหตุผลเป็นปุ่มปรับเดียวที่เรียกว่า reasoning_effortนั่นคือการแลกเปลี่ยนที่จงใจ: ปุ่มน้อยลง แต่ความสม่ำเสมอมากขึ้นตลอดเซสชันยาว

จุดมีไว้เพื่ออะไร อธิบายแบบไม่ใส่การตลาด
ดอตคือผู้ทำงานที่มีปฏิทิน ข้อมูลนำเข้าของมันเป็นเรื่องธรรมดา — ข้อความของคุณ ข้อมูลแอปของคุณ งานที่คุณอธิบายไว้ในหนึ่งประโยค — และผลลัพธ์ของมันคือการเปลี่ยนแปลงที่เกิดขึ้นที่อื่น: ไฟล์ที่ถูกย้าย ตั๋วที่ได้รับการอัปเดต ข้อความที่ร่างไว้และส่งหลังคุณอนุมัติ หน้าที่เปิดขึ้นในเบราว์เซอร์ของมันเอง เอกสารเปิดตัวของ OpenAI อธิบายถึงตัวหนึ่งที่ขับเคลื่อนหลายโปรเจกต์ให้เดินหน้าไปพร้อมกันและเรียนรู้จากข้อเสนอแนะ และการตีความอย่างตรงไปตรงมาคือคุณกำลังซื้อตัวเชื่อมประสาน ไม่ใช่สติปัญญา
เนื้อเยื่อเชื่อมต่อคือส่วนที่แพงในการสร้าง เบราว์เซอร์ที่ทำงานเหมือนของคนจริง ตัวเชื่อมต่อที่ผู้จำหน่ายแอปเป็นผู้ดูแลรักษา มุมมองกิจกรรม ด่านอนุมัติ การแยกตัวออกจากเครื่องของคุณเอง — ทั้งหมดนั้นไม่ใช่เรื่องยากโดยหลักการ และทุกอย่างล้วนน่าเบื่อในทางปฏิบัติ นั่นคือสิ่งที่ค่าสมาชิกจ่ายไป สิ่งที่มันไม่ได้จ่ายไปคือความสามารถในการวัดผล
• ค่าใช้จ่าย — รวมอยู่ใน Pro หรือ Business Premium โดยปริมาณการใช้งานที่อนุญาตยังไม่เปิดเผย (Dots) เทียบกับ $3.00 ต่อล้านอินพุต และ $15.00 ต่อล้านเอาต์พุต การอ่านจากแคช $0.30 (Kimi K3)
• เพดานต่อหนึ่งคำขอ — ไม่มีเอกสารกำกับแม้แต่จุดเดียว เทียบกับบริบท 1,048,576 โทเคน และ 88.7 ที่เป็นมิตรกับมือถือในด้านการเรียกคืนบริบทยาว (Kimi K3)
• อินพุตและเอาต์พุต — ข้อความและข้อมูลจากแอปที่เชื่อมต่อเข้า การเปลี่ยนแปลงภายในซอฟต์แวร์อื่นออก (Dots) เทียบกับข้อความและรูปภาพเข้า ข้อความออก (Kimi K3)
• การควบคุมการสุ่ม — ไม่มีการเผยแพร่ (Dots) เทียบกับไม่มีการตั้งค่า temperature, top_p และ seed โดยความลึกของการใช้เหตุผลถูกกำหนดโดย reasoning_effortเพียงอย่างเดียว (Kimi K3)
• ความเร็วที่คุณควรคาดหวัง — ไม่มีเอกสารระบุไว้แม้แต่นิดเดียว เมื่อเทียบกับค่ามัธยฐานเวลาไปยังโทเคนแรกที่ 8.82 วินาที และโทเคนเอาต์พุตประมาณ 39 โทเคนต่อวินาที จากการวัดเป็นเวลาเจ็ดวันของเราเอง (Kimi K3)
• หลักฐานอิสระ — เดโมจากผู้ขายและคำแถลงขีดความสามารถ ไม่มีเกณฑ์มาตรฐาน (Dots) เทียบกับ AA Coding Index 76.2 อยู่อันดับที่ 9 จาก 138, GPQA Diamond 93.5, การเรียกคืนบริบทยาว 88.7 (Kimi K3)
สิ่งที่ไม่มีใครพูดถึงเกี่ยวกับการซื้อเอเจนต์
การสมัครใช้บริการแบบ Subscription ที่มีโควตาที่ยังไม่เปิดเผยมีคุณสมบัติอย่างหนึ่งที่ Rate Card ไม่มี นั่นคือคุณไม่สามารถแยกความแตกต่างระหว่างงานที่ถูกกับงานที่แพงได้ ทุกงานมีค่าใช้จ่ายเท่ากัน — ไม่มีต้นทุนส่วนเพิ่ม — จนกระทั่งถึงวินาทีที่มันไม่เป็นเช่นนั้น แล้วคำตอบก็มาในรูปของขีดจำกัดแทนที่จะเป็นใบเรียกเก็บเงิน สำหรับทีมที่งานมีลักษณะเป็นการสำรวจ นั่นถือเป็นคุณสมบัติที่ดี แต่สำหรับทีมที่ต้องปันส่วนต้นทุนให้กับโครงการ นั่นคือช่องโหว่ในระบบบัญชี
ยังมีผลกระทบอันดับสองด้วย เมื่อต้นทุนส่วนเพิ่มของการเรียกหนึ่งครั้งมองไม่เห็น คุณจะเลิกถามว่าการเรียกนั้นจำเป็นหรือไม่ และการปรับให้เหมาะสมที่ถูกที่สุดในไปป์ไลน์ใด ๆ — การไม่ส่งคำขอ — ก็จะไม่พร้อมให้คุณใช้ โมเดลแบบคิดค่าบริการตามการใช้งานจะบังคับให้เกิดคำถามนั้นทุกครั้งที่มีใครอ่านตารางราคา

การประกอบพวกมันเข้าด้วยกันโดยไม่แสร้งว่าพวกมันเป็นทางเลือกแทนกัน
รูปแบบที่ได้ผลคือจุดที่คอยสังเกตและโมเดลบริบทยาวที่อ่าน งานเข้ามา — เอกสารในไดรฟ์ที่แชร์ ข้อความในเธรด — แล้วจุดก็ตัดสินว่ามันสำคัญหรือไม่ ถ้าสำคัญ เอกสารจะถูกส่งไปยัง Kimi K3 พร้อมแนบทุกอย่างอื่นที่อาจต้องใช้ไปด้วย ในคำขอเดียว และคำตอบที่ได้กลับมามีพื้นฐานจากต้นฉบับอย่างเต็มที่ แทนที่จะมาจากบทสรุปของต้นฉบับ จุดจัดการการตามงานและงานประสานงานที่น่าเบื่อ ส่วนโมเดลจัดการการอ่าน ในปริมาณที่การวนเรียกครั้งเล็ก ๆ หลายครั้งไม่มีทางรวบรวมได้อย่างถูกต้อง
Kimi K3 ถูก route บน OrcaRouter ในชื่อ kimi/kimi-k3 ในราคาตามที่ Moonshot ประกาศไว้ โดยไม่มีการบวกเพิ่ม อยู่ในแคตตาล็อกเดียวกับโมเดลอื่นอีกกว่า 200 รายการที่ใช้คีย์เดียว พร้อมการ failover อัตโนมัติไปยังผู้ให้บริการต้นทางรายอื่นเมื่อรายหนึ่งมีปัญหา และrouting DSL สำหรับประกอบหลายโมเดลเข้าเป็นการเรียกครั้งเดียว นั่นคือครึ่งหนึ่งของไปป์ไลน์ที่คิดค่าตามการใช้งาน และมีเพียงเท่านั้น: dots ไม่ได้อยู่ในแคตตาล็อก ไม่มี endpoint สำหรับมัน และไม่มีตัวระบุใด ๆ ที่จะใช้ชี้คำขอไปถึงได้ หากเลเยอร์การอ่านคือส่วนที่คุณต้องควบคุม — และสำหรับสิ่งใดก็ตามที่คุณตั้งใจจะรันเป็นเวลาหนึ่งปี โดยปกติแล้วก็เป็นเช่นนั้น — นั่นคือเลเยอร์ที่คุณควรเป็นเจ้าของ
การซื้อใดที่ทำให้เสียเงินเปล่า
การซื้อ dot เพื่ออ่านคลังข้อมูลขนาดใหญ่ถือเป็นการเสียเปล่า เพราะ dot จะดึงข้อมูลและสรุปให้ แทนที่จะเก็บเนื้อหาทั้งหมดไว้ และการสรุปคือจุดที่รายละเอียดที่คุณต้องการตายไปเลย การซื้อ Kimi K3 เพื่อตามโปรเจกต์ข้ามห้าแอปพลิเคชันก็เสียเปล่าด้วยเหตุผลตรงกันข้าม: โมเดลที่ตอบเมื่อถูกเรียกไม่ได้เรียกคุณ
ถ้างานคือการค้นคืนและการจัดการโลจิสติกส์ ให้เช่าคนงาน ถ้างานคือการทำความเข้าใจในระดับขนาดใหญ่ ให้ซื้อมิเตอร์แล้วป้อนทุกอย่างให้มันในคราวเดียว สองสิ่งนี้ทับซ้อนกันน้อยกว่าที่คำว่า “agentic” บอกไว้มาก และจุดที่ทับซ้อนกันก็ไม่ใช่จุดที่อย่างใดอย่างหนึ่งทำได้ดี

การเปรียบเทียบในบทความนี้2
ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
