
Dots vs Grok 4.6: เอเจนต์ที่จองการประชุมของตัวเอง ปะทะกับโมเดลที่ให้คำตอบ
- typesafeใหม่TypeSafe: Jev 1.132026-09-24$0.04 / $0.00 ต่อ 1 ล้านโทเค็น · 349 tok/s
- OpenAIใหม่OpenAI: GPT-6 Luna2026-09-2237ความฉลาด
- OpenAIใหม่OpenAI: GPT-6 Sol2026-09-2248ความฉลาด
- Anthropicใหม่Anthropic: Claude Opus 5.52026-09-2258ความฉลาด
- xAIใหม่Grok 4.72026-09-2146ความฉลาด
- Orcaใหม่Orca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 ต่อ 1 ล้านโทเค็น · 210 tok/s
- Orcaใหม่Orca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 ต่อ 1 ล้านโทเค็น · 680 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040ความฉลาด
- OpenAIOpenAI: GPT-6 Astra2026-09-0453ความฉลาด77การเขียนโค้ด
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241ความฉลาด76การเขียนโค้ด
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245ความฉลาด76การเขียนโค้ด
- AnthropicAnthropic: Claude Fable 5.12026-09-0153ความฉลาด82การเขียนโค้ด
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 ต่อ 1 ล้านโทเค็น · 49 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 ต่อ 1 ล้านโทเค็น · 102 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642ความฉลาด72การเขียนโค้ด
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 ต่อ 1 ล้านโทเค็น · 219 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845ความฉลาด75การเขียนโค้ด
- obsidianQwen3.8 27B2026-08-1534ความฉลาด68การเขียนโค้ด
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236ความฉลาด69การเขียนโค้ด
- xAISpaceXAI: Grok 4.62026-08-1244ความฉลาด77การเขียนโค้ด
ลองเขียนหมายเลขโทรศัพท์ให้ dot ดูสิ แล้วคุณจะทำไม่ได้ และความล้มเหลวนั้นคือสิ่งที่มีประโยชน์ที่สุดเกี่ยวกับการจับคู่นี้ Dots คือเอเจนต์ที่เปิดทำงานตลอดเวลาของบริษัท ประกาศเปิดตัวที่ DevDay เมื่อวันที่ 29 กันยายน 2026: dot แต่ละตัวมีคอมพิวเตอร์บนคลาวด์และเบราว์เซอร์ของตัวเอง เชื่อมต่อกับแอปมากกว่า 4,000 แอป และเข้าถึงได้ภายใน ChatGPT, Slack และ Teams ทำงานบน GPT-6 Astra และรวมอยู่ใน Pro และ Business Premium โดยไม่มีค่าใช้จ่ายแยกต่างหาก Grok 4.6 คือโมเดลระดับแนวหน้าของ SpaceXAI เผยแพร่เมื่อวันที่ 12 สิงหาคม 2026 และมันเป็นสิ่งคนละชนิดโดยสิ้นเชิง: หน้าต่างบริบท 500,000 โทเค็น รับข้อความ รูปภาพ และไฟล์เป็นอินพุตพร้อมเอาต์พุตเป็นข้อความ ปรับระดับความพยายามในการให้เหตุผลได้ เรียกระบบเครื่องมือแบบเนทีฟ และเอาต์พุตแบบมีโครงสร้าง ราคา $2.00 ต่ออินพุตหนึ่งล้านโทเค็น และ $6.00 ต่อเอาต์พุตหนึ่งล้านโทเค็นสำหรับพรอมต์ที่ต่ำกว่า 200,000 โทเค็น และเป็นสองเท่าของราคานั้นเมื่อสูงกว่านั้น หนึ่งในสองสิ่งนี้คือเพื่อนร่วมงานที่มีตารางเวลา อีกสิ่งหนึ่งคือฟังก์ชันที่คุณเรียกใช้
ทั้งสองมีความแข็งแกร่งอย่างแท้จริงในงานเชิงเอเจนต์ ซึ่งนั่นคือสิ่งที่ทำให้ความสับสนเกิดขึ้นได้บ่อย Grok 4.6 ทำคะแนน 88.4 บน Terminal-Bench 2.1 และ 50.7 บนส่วนงาน τ-banking tool-use — ตัวเลขแบบที่ทำให้โมเดลถูกบรรยายว่าเป็น "เอเจนต์" แต่มันไม่ใช่ มันคือเครื่องยนต์การให้เหตุผลที่คุณจะใช้สร้างเอเจนต์ขึ้นมา
แต่ละอย่างจริงๆ แล้วคืออะไร
• อัตลักษณ์ — ผลิตภัณฑ์แบบโฮสต์ที่ไม่มีตัวระบุโมเดลซึ่งคุณสามารถอ้างอิงได้ (Dots) เทียบกับโมเดลที่มีชื่อและกำหนดเส้นทางได้ พร้อมสตริงคงที่ที่คุณสามารถใส่ในไฟล์กำหนดค่า (Grok 4.6)
• ที่ที่การทำงานเกิดขึ้น — บนคอมพิวเตอร์คลาวด์ของ OpenAI ซึ่งมีเบราว์เซอร์ของตัวเอง แยกจากเครื่องของคุณ เว้นแต่คุณจะเชื่อมโยง它們 (Dots) เข้ากับทุกที่ที่คุณเรียกใช้งาน: คอนเทนเนอร์ที่คุณควบคุม, เวิร์กเกอร์คิว, งาน cron (Grok 4.6)
• เข้าถึง — แอป 4,000+ รายการผ่านตัวเชื่อมต่อของ OpenAI (Dots) เทียบกับเครื่องมือใดก็ตามที่คุณเชื่อมต่อเอง เพราะการเรียกใช้เครื่องมือเป็นโปรโตคอล ไม่ใช่ไดเรกทอรี (Grok 4.6)
• ความทรงจำของงาน — ที่ผลิตภัณฑ์พาไปข้ามวัน ข้ามแอป ข้ามเธรดใหม่ (Dots) เทียบกับหน้าต่าง 500,000 โทเคน และสิ่งใดก็ตามที่คุณจัดเก็บไว้เอง (Grok 4.6)
• ต้นทุน — รวมอยู่ในการสมัครสมาชิก ไม่เปิดเผย (Dots) เทียบกับ $2.00 และ $6.00 ต่อล้านโทเค็น เพิ่มเป็นสองเท่าเมื่อเกิน 200,000 โทเค็นอินพุต โดยการอ่านจากแคชอยู่ที่ $0.50 (Grok 4.6)
• หลักฐาน — การสาธิตจากผู้ขายและคำกล่าวอ้างด้านขีดความสามารถ โดยไม่มีเกณฑ์มาตรฐานอิสระ (Dots) เทียบกับ Artificial Analysis Coding Index ที่ 76.8 ซึ่งอยู่อันดับที่ห้าจาก 138 โมเดลที่วัด และ 94.9 ใน GPQA Diamond (Grok 4.6)
ตัวเลขที่ตัดสินคำถามส่วนใหญ่: ค่าเผื่อ
OpenAI เปิดเผยราคาเดียวสำหรับ dots และมันไม่ใช่ราคาในหน่วยใด ๆ ที่คุณสามารถใช้วัดงานได้ dot แรกรวมอยู่ใน Pro หรือ Business Premium; การสนทนากับมันไม่ทำให้ขีดจำกัดการใช้งาน ChatGPT ลดลง; ขีดจำกัดแบบขยายจะมีผลในเดือนแรก นั่นคือโครงสร้างต้นทุนที่เผยแพร่ทั้งหมด ไม่มีตัวเลขวงเงินที่อนุญาต ไม่มีราคาสำหรับ dot ตัวที่สอง ไม่มีอัตราต่องาน ไม่มีราคาสำหรับองค์กรสำหรับ dots เฉพาะทางที่รายงานว่าอยู่ระหว่างการทดสอบภายใน รายงานของ CNBC เกี่ยวกับการกล่าวสุนทรพจน์หลักมีประธานเจ้าหน้าที่การเงิน Sarah Friar กำหนดราคาแพ็กเกจ Pro 500 ที่ 500 ดอลลาร์ต่อเดือนเป็นวงเงินการใช้งานบวกกับโหมด Ultrafast ใหม่ แทนที่จะเป็นอัตราต่อ dot ซึ่งหมายความว่าแผนที่แพงที่สุดในตารางของ OpenAI ยังคงไม่ให้ต้นทุนต่อหน่วยของงานเอเจนต์
Grok 4.6 ทำตรงกันข้ามและเปิดเผยทุกอย่าง รวมถึงส่วนที่เจ็บปวดด้วย เส้นแบ่งระดับที่ 200,000 โทเค็นอินพุตเป็นหน้าผา: คำขอที่ 199,000 โทเค็นถูกคิดเงินในอัตราครึ่งหนึ่งของคำขอที่ 201,000 นั่นไม่ใช่กับดักที่ซ่อนอยู่ แต่เป็นตัวเลขในตารางอัตรา และมันเปลี่ยนวิธีที่คุณออกแบบงานที่ใช้บริบทขนาดยาว คุณแบ่งเป็นชังก์ที่ขอบเขตนั้น หรือไม่ก็ยอมรับระดับที่สองอย่างรู้ตัว

รุ่นต่อมาได้วางจำหน่ายไปแล้วในขณะที่คู่นี้กำลังถูกนำมาเปรียบเทียบกันอยู่
Grok 4.7 เปิดตัวเมื่อวันที่ 21 กันยายน 2026 และตอนนี้เป็นเรือธงของสาย Grok โดยมีบริบท 500,000 โทเคนเท่าเดิม พื้นผิวอินพุตแบบเดิม ราคาพื้นฐานเท่าเดิม และเอาต์พุตสูงสุด 450,000 โทเคนที่มากกว่ามาก Grok 4.6 ยังคงใช้งานได้และยังถูกจัดอยู่ในรายการเป็นโมเดลปัจจุบัน — การเพิ่มเลขเวอร์ชันไม่ใช่การปลดระวาง — แต่ใครก็ตามที่เลือกโมเดล Grok วันนี้ควรเลือกระหว่าง 4.6 กับ 4.7 มากกว่าจะสมมติว่า 4.6 คือระดับแนวหน้า เหตุผลที่ต้องพูดตรง ๆ ก็คือ บทความที่คุณกำลังอ่านอยู่นี้เกี่ยวข้องกับการเปรียบเทียบที่ยังคงใช้ได้แม้ผ่านช่วงเปลี่ยนผ่าน: ไม่ว่าสุดยอดของสาย Grok ในไตรมาสหน้าจะถูกเรียกชื่อว่าอะไร มันก็ยังเป็นโมเดลที่คิดค่าบริการตามปริมาณการใช้งานพร้อมตารางอัตราค่าบริการ และ dot ก็ยังคงเป็นบริการสมัครสมาชิกที่มีโควต้าซึ่งยังไม่เปิดเผย
นั่นก็เป็นเหตุผลเช่นเดียวกันสำหรับการส่งคำเรียกโมเดลของคุณผ่านชั้นนามธรรม แทนที่จะผูกติดกับผู้จำหน่ายแบบฮาร์ดโค้ด เมื่อรุ่นสืบทอดเปิดตัว การเปลี่ยนโมเดลก็กลายเป็นการแก้ไขเพียงบรรทัดเดียว ไม่ใช่การโยกย้ายระบบ

สร้างเอเจนต์ขึ้นมาเองแทนที่จะเช่าใช้
ผลลัพธ์ที่น่าสนใจของการจับคู่นี้ก็คือ Grok 4.6 ทำให้คุณสร้างสิ่งที่ Dots ขายได้ แบบห่วย ๆ ก่อน แล้วค่อย ๆ ดีขึ้น ลูปที่คอยอ่านคิว เรียกโมเดลโดยแนบเครื่องมือเข้าไปด้วย เขียนผลลัพธ์ และลองใหม่เมื่อล้มเหลวไม่ใช่เรื่องยาก สิ่งที่ยากคือส่วนต่าง ๆ ที่ dot ให้คุณฟรี — เบราว์เซอร์ที่ทำงานราวกับเป็นของคนจริง คอนเนกเตอร์ที่เขียนขึ้นโดยผู้ขายแอป โฟลว์การอนุมัติ และบันทึกกิจกรรม สิ่งเหล่านั้นคุ้มค่าที่จะจ่ายค่าสมัครสมาชิกก็เพราะมันน่าเบื่อหน่ายนั่นเอง
จุดที่ฝั่งที่คิดค่าบริการตามการใช้งานได้เปรียบ คือช่วงเวลาที่งานเลิกเป็นแบบทั่วไปแล้ว ช่วงเวลาที่คุณต้องให้การเรียกเดิมไปรันกับผู้ให้บริการรายอื่นในไตรมาสหน้า ให้เล่นซ้ำได้จากล็อก ให้คิดราคาได้ถึงระดับเศษสตางค์ หรือให้สลับไปยังตัวพี่น้องที่ถูกกว่าได้กลางคันเมื่อผู้ให้บริการต้นทางมีปัญหา บน OrcaRouter นั้น Grok 4.6 ถูกให้บริการในชื่อ grok/grok-4.6 ในราคาตามประกาศของ SpaceXAI โดยบวกเพิ่ม 0% — เป็นอัตราของผู้ให้บริการเองที่ส่งผ่านมาตรง ๆ ดังนั้นเมื่อผู้ให้บริการลดราคา ค่าใช้จ่ายของคุณก็จะปรับลงในวันเดียวกัน — อยู่ในแคตตาล็อกเดียวกับโมเดลอื่นอีกกว่า 200 รายการภายใต้คีย์เดียว พร้อมระบบสลับสำรองอัตโนมัติและ DSL สำหรับกำหนดเส้นทางเพื่อประกอบหลายโมเดลให้เป็นการเรียกครั้งเดียว ไม่มีอะไรเทียบเท่าสำหรับ dot เลย: ไม่มี endpoint ไม่มีตัวระบุ ไม่มีอะไรให้สลับสำรองจาก
การทดสอบที่ต้องนำไปใช้
ลองถามดูว่าถ้าไม่มีใครดูมัน งานนี้จะยังมีอยู่ไหม ถ้าคำตอบคือใช่ — มันต้องเกิดขึ้นตามกำหนดเวลา ผ่านเครื่องมือหลายอย่าง โดยไม่มีใครเปิดหน้าต่างแชต — ดอตคือผลิตภัณฑ์ที่ถูกออกแบบมาสำหรับสิ่งนั้น และโมเดลแบบคิดตามการใช้งานเป็นองค์ประกอบหนึ่งภายในสิ่งที่คุณสร้าง ไม่ว่าคุณจะสร้างอะไร ถ้าคำตอบคือไม่ ถ้ามีใครกำลังรอผลลัพธ์อยู่ และผลลัพธ์มีรูปแบบกับกำหนดส่ง แล้วโมเดลแบบคิดตามการใช้งานคือสิ่งที่ควรซื้อ และเอเจนต์คือทางอ้อมที่แพง
ความผิดพลาดที่ควรหลีกเลี่ยงคือการซื้อ dot เพื่อให้ได้คำตอบที่ดีขึ้น dot ไม่ใช่โมเดลที่ฉลาดกว่า แต่เป็นเพียงสายจูงที่ยาวขึ้นที่ผูกกับโมเดลตัวหนึ่ง และความผิดพลาดประการที่สองคือการจ่ายค่าสมาชิกเพื่อให้ได้ความสามารถที่ตารางราคาขายให้คุณอยู่แล้วแบบคิดเป็นรายโทเคน โดยเห็นตัวเลขคำนวณได้ล่วงหน้า

การเปรียบเทียบในบทความนี้2
ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
