
GPT-6 Sol Pro vs DeepSeek V4 Pro: เหมาจ่าย ปะทะ ตารางเวลา
- openaiใหม่OpenAI: GPT-6 Luna2026-09-2237ความฉลาด
- openaiใหม่OpenAI: GPT-6 Sol2026-09-2248ความฉลาด
- anthropicใหม่Anthropic: Claude Opus 5.52026-09-2258ความฉลาด
- grokใหม่Grok 4.72026-09-2146ความฉลาด
- Orcaใหม่Orca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 ต่อ 1 ล้านโทเค็น
- orcaใหม่Orca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 ต่อ 1 ล้านโทเค็น
- deepseekใหม่DeepSeek: DeepSeek V4.1 Flash2026-09-1040ความฉลาด
- openaiOpenAI: GPT-6 Astra2026-09-0453ความฉลาด77การเขียนโค้ด
- googleGoogle: Gemini 3.8 Flash2026-09-0241ความฉลาด76การเขียนโค้ด
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245ความฉลาด76การเขียนโค้ด
- anthropicAnthropic: Claude Fable 5.12026-09-0153ความฉลาด82การเขียนโค้ด
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 ต่อ 1 ล้านโทเค็น
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642ความฉลาด72การเขียนโค้ด
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 ต่อ 1 ล้านโทเค็น
- z-aiZ.ai: GLM 5.32026-08-1845ความฉลาด75การเขียนโค้ด
- obsidianQwen3.8 27B2026-08-1534ความฉลาด68การเขียนโค้ด
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236ความฉลาด69การเขียนโค้ด
- grokSpaceXAI: Grok 4.62026-08-1244ความฉลาด77การเขียนโค้ด
- metaMeta: Muse Spark 1.22026-08-0540ความฉลาด72การเขียนโค้ด
- qwenQwen: Qwen3.8 Max2026-08-0345ความฉลาด76การเขียนโค้ด
GPT-6 Sol Pro และ DeepSeek V4 Pro เป็นสองวิธีที่เชื่อถือได้และถูกที่สุดในการรันงานด้านการให้เหตุผลระดับจริงจังผ่าน API ในตอนนี้ และทั้งสองถูกกำหนดราคาด้วยหลักการที่แตกต่างกันโดยสิ้นเชิง GPT-6 Sol — โมเดลของผู้ให้บริการที่คอนฟิกูเรชัน gpt-6-sol-pro เรียกใช้งาน ซึ่งเปิดให้ใช้ทั่วไปตั้งแต่ 22 กันยายน 2026 — มีค่าใช้จ่าย 2.00 ดอลลาร์ต่อโทเคนอินพุตหนึ่งล้านโทเคน และ 10.00 ดอลลาร์ต่อโทเคนเอาต์พุตหนึ่งล้านโทเคน ในทุกชั่วโมงของทุกวัน DeepSeek V4 Pro เรือธงแบบเปิดน้ำหนัก (open-weights) ซึ่งเช็กพอยต์ 0813 เปิดให้ใช้ทั่วไปเมื่อ 13 สิงหาคม 2026 มีราคา 0.66 ดอลลาร์และ 1.98 ดอลลาร์สำหรับช่วงเวลาส่วนใหญ่ของสัปดาห์ และเป็นสองเท่าของราคานั้นพอดีในช่วงเวลาสั้น ๆ สองช่วงในเช้าวันธรรมดา การเปรียบเทียบใด ๆ ที่อ้างอิงอัตราเดียว ก็คือการอ้างอิงราคาเพียงครึ่งเดียว
กำหนดการคือเรื่องราวทั้งหมด ทุกสิ่งอื่นเกี่ยวกับการจับคู่นี้ — คะแนนดัชนี หน้าต่างบริบท ข้อกำหนดใบอนุญาต — ล้วนเป็นผลสืบเนื่องมาจากข้อเท็จจริงที่ว่า หนึ่งในผู้ขายสองรายนี้ได้ตัดสินใจว่าราคาตามรายการของตนเป็นฟังก์ชันของเวลา
แต่ละบรรทัดราคาคืออะไรกันแน่
เรตการ์ดของ GPT-6 Sol มีเพียงแถวเดียว อินพุต $2.00, อินพุตแบบแคช $0.20, การเขียนแคช $2.50, เอาต์พุต $10.00 ต่อล้านโทเค็น โดยมีการปรับราคาใหม่สำหรับบริบทขนาดยาวเมื่ออินพุตเกินเกณฑ์หนึ่ง ซึ่งจะใช้กับทั้งคำขอเมื่อข้ามเกณฑ์นั้นไปแล้ว ไม่มีมิติด้านเวลา และไม่มีช่วงโปรโมชัน OpenAI ปรับลดราคาโมเดลรุ่นก่อนหน้าเหลือตัวเลขเหล่านี้เมื่อวันที่ 22 กันยายน และระบุว่าเป็นราคาถาวร
อัตราค่าบริการของ DeepSeek แสดงเป็นตาราง ตามที่อ่านได้จากหน้าค่าบริการของผู้ให้บริการเอง:
• อินพุตนอกช่วงเวลาพีค — $0.66 ต่อล้านโทเค็น กรณีแคชมิส; $0.022 ต่อล้านโทเค็น กรณีแคชฮิต
• เอาต์พุตนอกช่วงเวลาเร่งด่วน — $1.98 ต่อล้านโทเคน
อินพุตช่วงพีค — $1.32 ต่อล้านโทเค็น, แคชมิส; $0.044 ต่อล้านโทเค็น, แคชฮิต
• เอาต์พุตสูงสุด — $3.96 ต่อล้านโทเค็น
• ช่วงเวลาที่มีปริมาณสูงสุด — 01:00–04:00 และ 06:00–10:00 UTC วันจันทร์ถึงวันศุกร์ ยกเว้นวันหยุดสาธารณะของจีน
• ทุกอย่างอื่น — นอกช่วงเวลาพีค รวมถึงวันสุดสัปดาห์ทั้งหมด ซึ่งเป็นกฎที่มีผลบังคับใช้เมื่อเที่ยงคืนตามเวลาปักกิ่งของวันที่ 23 สิงหาคม 2026
เจ็ดชั่วโมงของช่วงพีคจากหนึ่งสัปดาห์ที่มี 168 ชั่วโมง ห้าวันจากเจ็ดวัน คิดเป็นประมาณ 21% ของปฏิทินในอัตราที่สูงกว่า และ 79% ในอัตราที่ต่ำกว่า ดังนั้น สรุปตัวเลขเดียวที่ซื่อตรงของ DeepSeek V4 Pro จึงไม่ใช่ $0.66 และไม่ใช่ $1.32 — แต่อยู่ที่ใดที่หนึ่งในระหว่างนั้น และจะอยู่ที่เท่าไรนั้นขึ้นอยู่กับรูปแบบทราฟฟิกของคุณ ไม่ใช่ความเอื้อเฟื้อของผู้ให้บริการ
การปรับราคาใหม่ที่ตารางนี้เป็นผลมาจาก
ควรรู้ว่าโครงสร้างนี้ใหม่แค่ไหน เพราะหน้าเปรียบเทียบเกือบทุกหน้ายังอ้างถึงตัวเลขที่มันเข้าแทนที่อยู่ เมื่อวันที่ 22 พฤษภาคม 2026 DeepSeek ได้เปลี่ยนส่วนลดแบบจำกัดเวลาสำหรับ V4 Pro ให้เป็นราคาถาวร — ลดลงประมาณ 75% เหลืออินพุตประมาณ $0.435 และเอาต์พุต $0.87 ต่อล้านโทเค็น
เมื่อวันที่ 17 สิงหาคม 2026 เวลาเที่ยงคืนตามเวลาปักกิ่ง สิ่งนั้นก็ถูกกลับทิศและยิ่งกว่านั้น ระบบ peak/off-peak เปิดใช้งานจริง โดยมีอัตราเพิ่มขึ้นเฉลี่ยในแถวที่ได้รับผลกระทบประมาณ 3.5 เท่า และสูงสุด 12 เท่า — โดยอัตรา 12 เท่านั้นตกที่อัตราอินพุตแบบ cache hit พอดี ซึ่งเพิ่มจาก ¥0.025 เป็น ¥0.30 ต่อล้านโทเคนในช่วง peak อินพุตแบบ cache miss เพิ่มขึ้นประมาณ 200% และเอาต์พุตประมาณ 350% หกวันต่อมา ได้มีการเพิ่มข้อยกเว้นสำหรับวันหยุดสุดสัปดาห์ ซึ่งช่วยดึงบางส่วนกลับคืนมาให้กับใครก็ตามที่สามารถย้ายงานแบบแบตช์ได้
ผลที่ตามมามีสองประการ ประการแรก หน้าเว็บใดก็ตามที่บอกคุณว่า DeepSeek V4 Pro เป็นโมเดลราคาต่ำกว่าหนึ่งดอลลาร์ กำลังอ้างอิงตารางราคาที่ถูกแทนที่ไปแล้วสองครั้ง ประการที่สอง รูปแบบของการเพิ่มขึ้นเป็นสัญญาณเกี่ยวกับสิ่งที่ DeepSeek กำลังปรับให้เหมาะสม: การเพิ่มขึ้นตามสัดส่วนที่มากที่สุดอยู่ที่แคชฮิต ซึ่งเป็นอัตราที่สำคัญที่สุดต่อเวิร์กโหลดนั้นโดยเฉพาะ — ลูปของเอเจนต์ที่ยาวนานซึ่งส่งคำนำหน้าที่เสถียรซ้ำ ๆ — ที่ทำให้โมเดลนี้น่าสนใจตั้งแต่แรก

หมายเลขดัชนีที่ทุกคนอ้างอิงกันอยู่นั้นถูกยกเลิกใช้แล้ว
Artificial Analysis เป็นชุดทดสอบที่เป็นกลางสำหรับการเปรียบเทียบนี้ และได้ปรับเวอร์ชัน Intelligence Index หลายครั้งตลอดปี 2026 บนกระดานปัจจุบัน GPT-6 Sol ได้คะแนน 48 ที่ความพยายามสูงสุด ด้วยค่าใช้จ่าย $1.06 ต่อหนึ่งงานดัชนี ส่วน DeepSeek V4 Pro บนเช็กพอยต์ 0813 ที่ความพยายามสูงสุด ได้คะแนน 36 ด้วยค่าใช้จ่าย $0.67 ต่อหนึ่งงานดัชนี
ตัวเลขที่แพร่หลายสำหรับ DeepSeek คือ 53 ตัวเลขนั้นเป็นของจริงและเคยถูกเผยแพร่ — ในฉบับแก้ไขก่อนหน้าของดัชนี ก่อนการปรับเวอร์ชันใหม่ที่ทำให้คะแนนของโมเดลส่วนใหญ่เปลี่ยนไป การนำ 53 ที่มาจากบทความก่อน v4.3 มาเทียบกับ 48 ในปัจจุบัน คือการเทียบการวัดที่เลิกใช้แล้วกับที่ยังใช้อยู่ และมันก่อให้เกิดข้อผิดพลาดที่พบบ่อยที่สุดในการจับคู่นี้: การอ้างว่าโมเดลทั้งสองห่างกันไม่ถึงหนึ่งคะแนน บนดัชนีปัจจุบัน ทั้งสองห่างกันสิบสองคะแนน และช่องว่างราคาต่องานที่ทำสำเร็จไม่ใช่ 3× อย่างที่อัตราที่ประกาศไว้บอก แต่ใกล้เคียง 1.6× มากกว่า เพราะ DeepSeek ใช้โทเค็นมากกว่าในการไปถึงคำตอบ
จุดข้อมูลอิสระอีกสองรายการสมควรอยู่เคียงข้างข้อมูลเหล่านั้น โดยทั้งคู่มีป้ายกำกับที่ตรงตามสิ่งที่มันเป็น Vals AI ซึ่งรันฮาร์เนสแบบแยกเดี่ยว จัดให้ DeepSeek V4 Pro อยู่ที่ 96.40% บน SWE-bench Verified ด้วยราคา $0.103 ต่อการทดสอบ — เป็นอันดับสองในบอร์ดนั้นรองจาก Claude Opus 5 ที่ 97.00% และมีราคาต่อการทดสอบที่ถูกกว่าอย่างมาก บอร์ด coding-agent ของ Artificial Analysis แสดง 14% บน Terminal-Bench 4.0 เทียบกับ 44% ของ GPT-6 Sol ตัวเลขแรกบอกว่า DeepSeek แข่งขันได้ในงานเขียนโค้ดหนึ่งงานที่แคบและนิยามไว้ชัดเจน ตัวเลขที่สองบอกว่ามันแข่งขันไม่ได้ในงานเทอร์มินัลแบบเอเจนต์ ทั้งสองเป็นจริง และพวกมันวัดสิ่งที่แตกต่างกัน
ในกรณีที่สองรุ่นมีความแตกต่างกันในเชิงโครงสร้าง ไม่ใช่เพียงแค่ราคาที่แตกต่างกัน
• สัญญาอนุญาต — GPT-6 Sol เป็น API แบบปิดที่ไม่มีเวต; DeepSeek V4 Pro อยู่ภายใต้สัญญาอนุญาต MIT โดยมีเช็คพอยต์สาธารณะบน Hugging Face รวมถึงตัวแปรพื้นฐานสำหรับการฝึกก่อนต่อเนื่อง
• เอาต์พุตสูงสุด — GPT-6 Sol 128,000 โทเค็น เทียบกับ DeepSeek V4 Pro 384,000 โทเค็น สามเท่าของเพดานที่อัตราเอาต์พุตเพียงหนึ่งในห้า
• หน้าต่างบริบท — GPT-6 Sol 1,050,000 โทเคน เทียบกับ DeepSeek V4 Pro 1,048,576 โทเคน แทบไม่แตกต่างกันในทางปฏิบัติ
• รูปแบบข้อมูล — ทั้งข้อความขาเข้าและขาออก; ทั้งคู่ไม่รองรับรูปภาพผ่าน API
• การกำหนดราคาบริบทยาว — GPT-6 Sol จะกำหนดราคาคำขอทั้งหมดใหม่เมื่อคำขอเกินขีดจำกัดอินพุตของมัน; ตารางพีค/ออฟพีคของ DeepSeek V4 Pro เป็นโครงสร้างราคาเดียวที่มันมี
• ขนาด — DeepSeek V4 Pro เป็นโมเดลแบบ mixture-of-experts ที่มีพารามิเตอร์ 1.6 ล้านล้านตัว โดยมีพารามิเตอร์ที่ใช้งานจริง 49 พันล้านตัวต่อโทเคน; OpenAI ไม่ได้เปิดเผยตัวเลขที่เทียบเคียงได้สำหรับ GPT-6 Sol
ขอหมายเหตุหนึ่งเรื่องเกี่ยวกับจำนวนพารามิเตอร์นั้น เพราะเรื่องนี้เป็นแหล่งที่ทำให้สับสนบ่อยครั้ง: ตัวเลข 1.7 ล้านล้านที่ปรากฏในบางรายการคือขนาดแพ็กเกจของ Hugging Face ซึ่งรวมโมดูล DSpark สำหรับการถอดรหัสแบบคาดเดา (speculative decoding) ที่เป็นออปชันไว้ด้วย ไม่ใช่โมเดลเป้าหมายที่มีขนาดใหญ่กว่า สถาปัตยกรรมที่เผยแพร่มีขนาดรวม 1.6T การนำป้ายที่ปัดเศษแล้วมาลบกันเพื่ออนุมานขนาดของโมดูลฉบับร่างไม่ถือเป็นการคำนวณที่ถูกต้อง และการตีความตัวเลขที่มากกว่าให้เป็นหลักฐานว่าโมเดลขยายใหญ่ขึ้นก็ไม่ถือเช่นกัน

การถอนตัวที่เป็นข้อโต้แย้งที่แท้จริงสำหรับน้ำหนักแบบเปิด
เมื่อวันที่ 9 กันยายน 2026 DeepSeek ประกาศว่าจะทยอยยกเลิก V4 Pro และตั้งแต่วันที่ 14 กันยายน เวลา 04:00 UTC เป็นต้นไป ทุกคำขอที่ส่งไปยังสตริงโมเดล deepseek-v4-pro จะถูกส่งต่อไปยัง DeepSeek V4.1 Flash และคิดค่าบริการในอัตราของ Flash โดยจะเป็นเช่นนี้ต่อไปจนกว่าโมเดล V4.1 Pro จะเปิดตัว สตริงโมเดลนี้ยังคงตอบกลับอยู่ แต่โมเดลที่อยู่เบื้องหลังจะไม่ใช่ตัวที่ใคร ๆ เคยวัดประสิทธิภาพไว้
นักพัฒนาคัดค้าน และการเปลี่ยนเส้นทางถูกยกเลิก บันทึกการเปลี่ยนแปลงของ DeepSeek ระบุในตอนนี้ว่าบริการ API ของ V4 Pro จะดำเนินต่อไปหลังวันที่ 14 กันยายน โดยการเรียกเก็บเงินไม่เปลี่ยนแปลง และตารางราคายังคงแสดง deepseek-v4-pro เป็นแถวที่ใช้งานอยู่ พร้อมอัตราของตัวเองและไม่มีแท็กเลิกให้บริการ หน้าประกาศฉบับก่อนหน้ายังคงมีข้อความเกี่ยวกับการเปลี่ยนเส้นทาง ดังนั้นเอกสารทั้งสองจึงขัดแย้งกัน — และหน้าตารางราคาที่ใช้งานจริงคือหน้าที่อธิบายว่าแท้จริงแล้วเกิดอะไรขึ้นเมื่อคุณเรียกใช้งาน
เหตุการณ์ครั้งนั้นคือข้อโต้แย้งที่แข็งแกร่งที่สุดในการเปรียบเทียบทั้งหมดนี้ และไม่ใช่ข้อโต้แย้งเรื่องราคา โมเดลแบบปิดสามารถถูกกำหนดราคาใหม่ เปลี่ยนเส้นทาง หรือปลดระวางตามกำหนดเวลาของผู้ขาย และทางออกเดียวคือการย้ายระบบ โมเดลที่มีน้ำหนักแบบ MIT อยู่ในคลังสาธารณะสามารถให้บริการจากโครงสร้างพื้นฐานของคุณเองได้ ซึ่งหมายความว่าเช็กพอยต์ที่คุณประเมินไว้ก็คือเช็กพอยต์ที่คุณให้บริการต่อไป ไม่ว่าแผนงานของผู้ขายจะระบุว่าอย่างไรในอีกหกสัปดาห์ถัดมา DeepSeek ได้แสดงให้เห็นความเสี่ยงและมอบวิธีบรรเทาความเสี่ยงนั้นในระยะเวลาสองสัปดาห์เดียวกัน
ข้อถ่วงดุลที่ตรงไปตรงมาก็คือ การโฮสต์โมเดลขนาด 1.6 ล้านล้านพารามิเตอร์ด้วยตนเองไม่ใช่การตัดสินใจที่ทีมส่วนใหญ่ทำกันอย่างไม่คิดให้รอบคอบ มันเป็นทางเลือกจริงที่มีต้นทุนคงที่จริง ไม่ใช่การป้องกันความเสี่ยงที่ได้มาฟรี
ที่ที่ชั้นการกำหนดเส้นทางเปลี่ยนการคำนวณ
DeepSeek V4 Pro อยู่ในOrcaRouterแค็ตตาล็อกแล้ว ทั้งเช็กพอยต์ปัจจุบันและสตริงชื่อโมเดลฐานต่างก็ใช้งานได้ — deepseek/deepseek-v4-pro-0813 และ deepseek/deepseek-v4-pro — ในอัตราตามรายการช่วงออฟพีก โดยมีตัวคูณช่วงพีกที่ใช้ตามตารางเวลา UTC เดียวกัน หน้าต่างบริบทขนาด 1,048,576 โทเคน เพดานเอาต์พุต 384,000 โทเคน และค่า p50 ของเวลาที่ใช้ถึงโทเคนแรกอยู่ที่ 3.56 วินาที จากการวัดบนหน้าโมเดลของเราเอง ราคาตามรายการของผู้ให้บริการถูกส่งผ่านโดยไม่มีมาร์กอัปเพิ่มเติม ซึ่งในกรณีนี้หมายความว่าเส้นแบ่งช่วงพีก/ออฟพีกจะไปตกอยู่บนใบแจ้งหนี้ของคุณในจังหวะเดียวกับที่ตกอยู่บนของ DeepSeek
GPT-6 Sol ไม่ใช่หนึ่งในเส้นทางของเรา ดังนั้นไม่มีข้อความใดในที่นี้ที่เป็นการกล่าวอ้างเกี่ยวกับราคาของมันผ่านเรา

ตารางเวลาคือสิ่งที่ทำให้การมีปลายทางเพียงจุดเดียวในที่นี้คุ้มค่าที่จะทำ งานที่สามารถเลื่อนเวลาได้มีค่ามากเป็นสองเท่าของงานที่เลื่อนไม่ได้ และการเลื่อนเวลานั้นก็คือการตัดสินใจด้านการกำหนดเส้นทาง ไม่ใช่การโยกย้าย — คีย์เดียวกัน โครงสร้างคำขอเดียวกัน ต่างกันแค่ชั่วโมงหรือโมเดลที่อยู่เบื้องหลัง การจับคู่ DeepSeek V4 Pro กับ DeepSeek V4.1 Flash บนปลายทางเดียวคือเวอร์ชันที่คมกว่า: โมเดล Flash ถูกกว่า 4.4 เท่าสำหรับอินพุต และถูกกว่า 3.3 เท่าสำหรับเอาต์พุต เมื่อเทียบกับอัตราช่วงนอกเวลาพีคของ V4 Pro บนหน้าต่างบริบทเดียวกันและหน้าต่างพีคเดียวกัน ซึ่งทำให้มันเป็นปลายทางตามธรรมชาติสำหรับทราฟฟิกที่ไม่จำเป็นต้องใช้โมเดลขนาดใหญ่เลย การสลับไปใช้ระบบสำรองอัตโนมัติ มีความสำคัญด้วยเหตุผลเดิมเสมอ — ชั้นราคาถูกที่ไปป์ไลน์ของคุณสร้างขึ้นมาบนนั้นไม่ควรเป็นจุดล้มเหลวจุดเดียว
กฎการตัดสินใจ
• งานแบบเป็นชุดและงานออฟไลน์ที่สามารถจัดตารางเวลาได้ — DeepSeek V4 Pro และจัดตารางเวลาให้ เก้าสิบห้าเปอร์เซ็นต์ของปฏิทินในราคา $0.66 และ $1.98 โดยวันหยุดสุดสัปดาห์เป็นช่วงนอกพีคทั้งหมด เป็นอัตราที่น่าเชื่อถือและถูกที่สุดบนบอร์ดนี้ โดยถูกกว่าถึงสามเท่าในส่วนอินพุตและห้าเท่าในส่วนเอาต์พุต
• ทราฟฟิกเชิงโต้ตอบที่ไวต่อความหน่วง (latency) ซึ่งเข้ามาในช่วงเวลาพีค — GPT-6 Sol ราคาคงที่ที่ $2.00 และ $10.00 แพงกว่าอัตราช่วงนอกพีคของ DeepSeek และถูกกว่าการไม่มีอะไรเลย แต่ก็สามารถรู้ล่วงหน้าได้ และในสองชั่วโมงต่อวัน มันเป็นตัวที่ถูกกว่าระหว่างสองตัวนี้ในแง่ของ output
• ลูปของเอเจนต์ที่มีพรีฟิกซ์ขนาดใหญ่และคงที่ — ให้คำนวณเลขการเข้าแคชก่อนตัดสินใจเลือก อินพุตแบบเข้าแคชของ DeepSeek อยู่ที่ $0.022 นอกช่วงพีค ซึ่งคิดเป็นหนึ่งในเก้าของ $0.20 ของ GPT-6 Sol แต่มันก็เป็นรายการที่ DeepSeek ปรับขึ้นสิบสองเท่าในช่วงพีคเช่นกัน ข้อได้เปรียบนี้เป็นของจริง และมันขึ้นอยู่กับเวลานาฬิกา
• สิ่งใดก็ตามที่อยู่ภายใต้การกำกับดูแล หรือสิ่งใดก็ตามที่คุณไม่อาจเสี่ยงให้ถูกเปลี่ยนเส้นทางได้ — DeepSeek V4 Pro ที่โฮสต์เองจากเช็กพอยต์ MIT การถอนตัวเมื่อเดือนกันยายนเป็นกรณีศึกษา และเป็นเหตุผลที่ดีกว่าการเปรียบเทียบราคาต่อโทเคนใด ๆ สำหรับการยอมรับต้นทุนคงที่
• อะไรก็ตามที่ต้องการจุดสูงสุดของช่วงความสามารถแบบเอเจนติก — GPT-6 Sol สิบสองคะแนนดัชนีและสามสิบคะแนนของ Terminal-Bench ไม่ใช่ความต่างเพียงเล็กน้อยจากการปัดเศษ และตัวเลขที่ DeepSeek รายงานเองในฐานะผู้ขายก็ไม่ได้ปิดช่องว่างเหล่านั้น
อัตราคงที่และตารางเวลาเป็นรูปแบบการคิดราคาที่ตรงไปตรงมาทั้งคู่ พวกมันเพียงตอบคำถามที่ต่างกัน: แบบหนึ่งบอกว่าคุณต้องจ่ายเท่าไรต่อโทเคน อีกแบบบอกว่าคุณต้องจ่ายเท่าไรต่อโทเคนเมื่อคุณจำเป็นต้องใช้มัน
การเปรียบเทียบในบทความนี้3
ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
