
Gemini 4 Argon: Google ประกาศอะไร และชื่อนี้ผูกอยู่กับอะไร
- openaiใหม่OpenAI: GPT-6.1 Sol2026-09-2952ความฉลาด
- anthropicใหม่Anthropic: Claude Sonnet 5.52026-09-2856ความฉลาด
- typesafeใหม่TypeSafe: Jev 1.132026-09-24$0.04 / $0.00 ต่อ 1 ล้านโทเค็น · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238ความฉลาด
- OpenAIOpenAI: GPT-6 Sol2026-09-2248ความฉลาด
- AnthropicAnthropic: Claude Opus 5.52026-09-2258ความฉลาด
- xAIGrok 4.72026-09-2146ความฉลาด
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 ต่อ 1 ล้านโทเค็น · 64 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 ต่อ 1 ล้านโทเค็น · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040ความฉลาด
- OpenAIOpenAI: GPT-6 Astra2026-09-0453ความฉลาด77การเขียนโค้ด
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241ความฉลาด76การเขียนโค้ด
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245ความฉลาด76การเขียนโค้ด
- AnthropicAnthropic: Claude Fable 5.12026-09-0153ความฉลาด82การเขียนโค้ด
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 ต่อ 1 ล้านโทเค็น · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 ต่อ 1 ล้านโทเค็น · 360 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642ความฉลาด72การเขียนโค้ด
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 ต่อ 1 ล้านโทเค็น · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845ความฉลาด75การเขียนโค้ด
- obsidianQwen3.8 27B2026-08-1534ความฉลาด68การเขียนโค้ด
Gemini 4 Argon เป็น Gemini 4 รุ่นเดียวที่มีอยู่ ประโยคนี้ฟังดูธรรมดาไปจนกว่าคุณจะคำนวณราคามันออกมา และการคำนวณราคามันออกมาก็คือจุดประสงค์ของหน้านี้ Googleประกาศเปิดตัว Gemini 4 Argon เมื่อวันที่ 30 กันยายน 2026 ในโพสต์ของ DeepMind ที่ให้เครดิตแก่ Koray Kavukcuoglu มันเป็นชื่อโมเดลจริงบนหน้าของผู้พัฒนาเองโดยตรง ถูกวัดโดย Artificial Analysis ด้วยค่า Intelligence Index ที่ 52.56 ในเวอร์ชัน v4.3.2 และอยู่ห่างจาก GPT-6 Astra ที่ 52.67 และ Claude Fable 5.1 ที่ 53.35 ไม่ถึงครึ่งคะแนน — ขณะที่ต่ำกว่า Claude Opus 5.5 ที่ 57.62 และ Claude Sonnet 5.5 ที่ 56.00 อยู่ห้าคะแนน และห่างจาก GPT-6.1 Sol ที่ 51.83 ไม่ถึงหนึ่งคะแนน สิ่งที่มันไม่มีคือสิ่งที่คู่แข่งทุกตัวมี นั่นคือ model identifier ที่คุณใส่ลงในคำขอได้
ดังนั้นคำตอบสั้นๆ ที่ตรงไปตรงมาสำหรับ “Gemini 4 Argon คืออะไร” ก็คือ มันเป็นโมเดลที่ Google ประกาศและทดสอบประสิทธิภาพแล้ว แต่ยังไม่เปิดให้เรียกใช้งานได้ ชื่อนี้ผูกอยู่กับการเปิดตัวแบบจำกัดสิทธิ์มากกว่าที่จะเป็นผลิตภัณฑ์ และ “Gemini 4” เพียงลำพังก็ไม่ได้ผูกอยู่กับสิ่งใดเลย ทั้งสองส่วนของประโยคนั้นสามารถตรวจสอบได้จากเทอร์มินัล ซึ่งเป็นเหตุผลว่าทำไมหน้านี้จึงตรวจสอบสิ่งเหล่านั้นแทนที่จะกล่าวอ้าง
ชื่อนี้เป็นของจริง แต่สินค้าไม่ใช่
เริ่มจากสิ่งที่การตรวจสอบเอนทิตีคืนค่ามาจริง ๆ ณ วันที่ 8 ตุลาคม 2026 หน้าเพจตระกูลโมเดลของ Google ที่ deepmind.google/models/gemini/แสดง Gemini 4 Argon เป็นการ์ดหลัก ภายใต้แท็กไลน์ “ยุคถัดไปของสติปัญญาระดับแนวหน้าของเรา” พร้อมข้อความความสามารถที่ระบุถึงวิศวกรรมซอฟต์แวร์ งานความรู้ระดับองค์กรในสายกฎหมายและการเงิน และความมั่นคงปลอดภัยไซเบอร์เชิงรับ โพสต์ประกาศอยู่ที่เส้นทาง blog.google/innovation-and-ai/models-and-research/gemini-models/ มีหน้าเพจตระกูลโมเดล มีตารางเกณฑ์มาตรฐานจากผู้จำหน่าย 19 แถว มีไฟล์ PDF ระเบียบวิธีการประเมิน 5 หน้า นั่นคือร่องรอยเอกสารจำนวนมาก และมากกว่าที่ข้อมูลรั่วไหลจะได้รับ
ตอนนี้จงระบุสิ่งที่ขาดหายไปจากมัน เพราะรายการสิ่งที่ขาดหายไปคือบทความ
• ID โมเดล — รายการโมเดลของ Gemini API ไม่มีการปรากฏคำว่า “argon” เลยแม้แต่ครั้งเดียว และไม่มีการปรากฏคำว่า “gemini-4” เลยเช่นกัน ตัวระบุใหม่ล่าสุดที่เอกสารของ Google รับรู้คือตระกูล 3.8
• ปลายทางหรือราคาที่คุณสามารถถูกเรียกเก็บเงินได้ — อัตรา $2 สำหรับอินพุต / $10 สำหรับเอาต์พุตต่อล้านโทเคนในประกาศเป็นอัตราเริ่มต้นสำหรับการเปิดตัวที่ยังไม่เข้าถึงลูกค้าที่จ่ายเงิน
• การ์ดโมเดลหรือการ์ดระบบ — ดัชนีการ์ดโมเดลของ DeepMind ไม่มีแถว Argon และพาธการ์ดโมเดลของตระกูลนี้ส่งคืน 404
• หน้าต่างบริบท — Google เปิดเผยขีดจำกัดเอาต์พุตไว้ที่ 1 ล้านโทเคน เพิ่มขึ้นจากเพดานเดิม 64K และไม่ได้เปิดเผยฝั่งอินพุตของคู่นั้น Artificial Analysis บันทึกไว้ที่ 1M สำหรับโมเดลที่วัด
• วันที่พร้อมใช้งานทั่วไป — ประกาศดังกล่าวอธิบายถึงการทยอยเปิดตัวเป็นระยะ โดยไม่มีกำหนดวันที่สำหรับระยะใด ๆ หลังจากระยะแรก
จำนวนพารามิเตอร์ ซึ่ง Google ยังไม่เปิดเผยสำหรับ Gemini รุ่นใดเลย
การทยอยเปิดตัวที่ Google อธิบายนั้นดำเนินไปในสามระยะที่ไม่ได้ระบุระยะเวลา ระยะแรก กลุ่มนักป้องกันไซเบอร์ที่ถูกระบุชื่อผ่าน Fairwind Program ระยะที่สอง ลูกค้า API แบบเสียค่าใช้จ่ายและผู้สมัครสมาชิก Google AI Ultra ระยะที่สาม นักพัฒนา องค์กรธุรกิจ และผู้บริโภค มีเพียงระยะแรกเท่านั้นที่เปิดใช้งานจริงในความหมายใด ๆ ที่ผู้อ่านสามารถตรวจสอบได้ และ Google ไม่ได้ระบุวันที่สำหรับระยะที่สองและสาม นั่นไม่ใช่หมายเหตุเล็กน้อย มันคือความแตกต่างระหว่างโมเดลกับตัวนับถอยหลัง

สิ่งที่ตารางของ Google เองอ้าง และใครเป็นคนวัดมันจริง ๆ
หน้าเพจตระกูลผลิตภัณฑ์ของ Google มีตาราง benchmark แบบสี่คอลัมน์ ประกอบด้วย Gemini 4 Argon, GPT-6 Astra, Claude Fable 5.1 และ Claude Opus 5.5 ตารางนี้น่าอ่าน และน่าอ่านโดยคำนึงถึงที่มาที่ไปของข้อมูลด้วย เพราะ Google เปิดเผยที่มาที่ไปนั้นไว้ใน PDF ระเบียบวิธีวิจัย และการเปิดเผยนี้เองที่เปลี่ยนว่าน้ำหนักของตารางนี้จะแบกรับได้มากน้อยเพียงใด
ข้อกล่าวอ้างที่ระบุว่าเป็นของ Google: Argon นำบน Vals Index ที่ 68.9 เทียบกับ 67.0 ของ Opus 5.5 และ 65.8 ของ Fable 5.1; บน AutomationBench ที่ 51.3 เทียบกับ 42.5, 31.4 และ 41.4; บน Vals Finance Agent v2 ที่ 65.4; บน Harvey’s Legal Agent Benchmark ที่ 19.6 เทียบกับ 3.8, 6.7 และ 5.4 — ช่องว่างสี่ถึงห้าเท่า; บน DeepSWE v1.1 ที่ 77.9 เทียบกับ 74.2, 67.4 และ 74.1; บน Vibe Code Bench ที่ 91.9 ซึ่งเป็นส่วนต่าง 1.6 จุด; บน LABBench 2 ที่ 88.8 เทียบกับ 73.1, 68.6 และ 85.4; บน RiemannBench ที่ 76.0; บนทั้งสองแถวของ GraphWalks, 99.7 ที่ ≤128k และ 84.2 ที่ 256k–1M; บน Agent’s Last Exam ที่ 39.5; บน Terminal-Bench Science 0.1 ที่ 57.6; บน Chartography ที่ 71.6; และบน LVBench ที่ 91.7 ในฐานะสุดยอดของเทคโนโลยี
และมันแพ้บนเพจของ Google เอง: FrontierSWE v2 ได้ 55.0 เทียบกับ 65.5 ของ Astra และ 62.3 ของ Opus 5.5; Terminal-bench 4.0 ได้ 57.4 เทียบกับ 66.4 ของ Opus 5.5; PostTrainBench ได้ 45.3 เทียบกับ 49.3 ของ Opus 5.5; และ OSWorld-2.0 ได้ 69.2 เทียบกับ 72.6 ของ Astra ส่วน CWE-bench v1 เสมอกันที่ 68.0 กับ Astra
บรรทัดที่มาของข้อมูลสำคัญกว่ารายการใด ๆ เพียงรายการเดียว ระเบียบวิธีของ Google ระบุว่าผลลัพธ์เป็น pass@1, แบบพยายามครั้งเดียว, ที่การตั้งค่าการคิดสูงสุด และ — ที่สำคัญ — ว่าตัวเลขที่ไม่ใช่ Gemini ในตารางนั้นคือ ตัวเลขที่ผู้ให้บริการรายงานเอง โดย GPT-6 Astra, Claude Fable 5.1 และ Claude Opus 5.5 ใช้ค่าที่การคิดสูงสุดเมื่อมีให้ใช้ ตารางของผู้ขายที่มีคอลัมน์คู่แข่งเป็นข่าวประชาสัมพันธ์ของคู่แข่งเองนั้นเป็นเอกสารที่มีประโยชน์ แต่ไม่ใช่การเปรียบเทียบแบบควบคุม ทุกแถวเหล่านั้นเป็นข้อมูลที่ Google รายงาน และบางแถวก็เป็น Google ที่รายงานสิ่งที่ผู้อื่นรายงานอีกที จึงควรตีความทั้งส่วนต่างของคะแนน ไม่ใช่แค่ค่าตัวเลขเท่านั้น
หนึ่งโมเดล ตัวเลขดัชนีสามตัว และเหตุใดพวกมันทั้งหมดจึงถูกต้อง
สถานะของ Argon น่าสนใจกว่าตัวเลขเพียงตัวเดียว เพราะตัวเลขนั้นเคลื่อนไปตามจุดที่คุณอ่านมัน และการเคลื่อนไหวนั้นไม่ใช่ข้อผิดพลาด
Artificial Analysis วัดค่า Gemini 4 Argon (High) ได้ 52.56 ในเวอร์ชัน v4.3.2 ของ Intelligence Index ดัชนีเดียวกันให้ Claude Opus 5.5 อยู่ที่ 57.62, Claude Sonnet 5.5 ที่ 56.00, Claude Fable 5.1 ที่ 53.35, GPT-6 Astra ที่ 52.67, GPT-6.1 Sol ที่ 51.83 และ Gemini 3.8 Flash ที่ 40.93 ในการจัดอันดับที่แสดงบนลีดเดอร์บอร์ด โมเดลประมาณสิบอันดับแรกเบียดกันอยู่ในช่วงประมาณ 6 คะแนนดัชนี และ Argon อยู่ในกลุ่มที่เบียดเสียดนั้น ไม่ได้อยู่ต่ำกว่านั้น
แล้วผู้อ่านจะเห็นตัวเลขตัวที่สอง — 53 — ในการแสดงผลแบบปัดเศษของกระดานจัดอันดับ และตัวที่สามหากเปรียบเทียบกับการตั้งค่าอื่นของโมเดลพี่น้อง แล้วสรุปว่าแหล่งข้อมูลใดแหล่งหนึ่งผิด ไม่มีแหล่งใดผิดเลย ค่า 53 ที่ปัดเศษแล้วคือการวัดเดียวกันกับ 52.56 สิ่งที่แตกต่างกันระหว่างการตั้งค่าคือ ความพยายามในการคิด: Artificial Analysis วัดแต่ละโมเดลที่ระดับความพยายามหลายระดับ และโมเดลเดียวกันที่ระดับความพยายามที่สูงขึ้นอาจต่างกันหลายจุด นั่นคือเหตุผลที่กระดานจัดอันดับแสดง Opus 5.5 แยกกันสี่ครั้ง ที่ 58, 56, 54 และ 51 Argon ปรากฏเพียงครั้งเดียว ที่ความพยายามสูง เพราะนั่นคือการตั้งค่าเดียวที่ Google ได้ทำให้สามารถวัดได้ หาก Google ปล่อยระดับ Argon ที่การคิดสูงสุด แถวนั้นจะขยับ และสิ่งที่ซื่อสัตย์ที่จะพูดเกี่ยวกับเรื่องนี้ในวันนี้ก็คือมันยังไม่ขยับ
ยังมีตัวเลขอิสระอีกสามค่าของ Argon ที่น่าจดจำ ทั้งหมดมาจาก Artificial Analysis และทั้งหมดวัดบน(High)คอนฟิกูเรชัน ความเร็วเอาต์พุตอยู่ที่มัธยฐาน 60.69 โทเคนต่อวินาที เวลาถึงโทเคนคำตอบแรกอยู่ที่มัธยฐาน 2.92 วินาที ค่าใช้จ่ายต่องาน Intelligence Index — คะแนนดัชนีที่ปรับเทียบกับปริมาณโทเคนที่ต้องใช้เพื่อให้ได้คะแนนนั้น — อยู่ที่ $1.99 ตัวเลขสุดท้ายนั้นคือสิ่งที่ควรยึดไว้ เพราะนั่นคือจุดที่สถานะของ Argon เริ่มอึดอัด: Opus 5.5 ได้คะแนนสูงกว่าห้าคะแนนและมีค่าใช้จ่าย $5.98 ต่องาน Index ดังนั้น Argon จึงถูกกว่าถึงสามเท่าต่อหนึ่งหน่วยของความสามารถที่วัดได้ แต่ GPT-6.1 Sol ได้คะแนนต่ำกว่าครึ่งคะแนนและมีค่าใช้จ่าย $0.72 ซึ่งคิดเป็นประมาณหนึ่งในสามของตัวเลขของ Argon Argon ไม่ใช่ตัวเลือกที่คุ้มค่าในกลุ่มดัชนีของตัวเอง มันคือตรงกลางของกลุ่มนั้น
ยังมีค่าที่อ่านได้อย่างเป็นอิสระอีกสองค่าที่ผู้อ่านอย่างรอบคอบไม่ควรสับสนระหว่างกัน Artificial Analysis บันทึกตัวเลข AutomationBench ของ Argon ว่าเป็นคะแนนบางส่วนที่ 0.7751 บนสเกล 0–1 ขณะที่ตารางของ Google รายงาน 51.3 จาก 100 บนกระดาน AutomationBench สองค่านี้ไม่ใช่ตัวชี้วัดเดียวกัน และการนำมาเรียงเคียงข้างกันก็เป็นรูปแบบการเปรียบเทียบที่ก่อให้เกิดตัวเลขที่กุขึ้นมา ข้อควรระวังเดียวกันนี้ใช้กับการจัดกลุ่มงานความรู้ในตารางของผู้ขาย: “ความเป็นผู้นำด้านงานความรู้” เป็นบทสรุปของ Google เกี่ยวกับตารางของ Google เอง
หน้าที่ “Gemini 4” ที่คุณกำลังมองหาจริงๆ คือหน้าไหน
นี่คือความสับสนที่ชื่อนี้ก่อขึ้น และมันคุ้มค่าที่จะสะสางให้จบในที่เดียว เพราะบล็อกนี้ได้เขียนเกี่ยวกับสิ่งต่าง ๆ ที่เรียกว่า “Gemini 4” ไปแล้วถึงห้าอย่าง และสิ่งเหล่านั้นไม่ใช่รูปแบบต่าง ๆ ของบทความเดียว
• ถ้าคุณต้องการ วันเปิดตัวและไทม์ไลน์การทยอยเปิดตัว — ว่า Argon ถูกประกาศเมื่อใด การทยอยเปิดตัวเป็นอย่างไร และบอร์ดอารีนาทำอะไรกับมัน — นั่นคือบทความเรื่องวันเปิดตัว ซึ่งเป็นชิ้นงานที่เป็นเจ้าของไทม์ไลน์และค่าที่อ่านได้จาก Text Arena และ Code Arena
• หากคุณต้องการ “Gemini 4 Argon เป็นระดับชั้นหรือเป็นโมเดล” และมี Gemini 4 Ultra อยู่จริงหรือไม่ — บทความว่าด้วยการจัดวางตำแหน่งระดับชั้น ซึ่งอ่านลำดับขั้นจากเส้นทางต่าง ๆ ของ Google เอง และอธิบายว่าเหตุใดเส้นทางของ Ultra จึงนำไปสู่หน้าสมัครสมาชิก
• ถ้าคุณต้องการ คำถามเรื่องการตั้งชื่อนั้นเอง การโต้แย้งที่ว่าในบรรดา “Gemini 4” และ “Gemini 4 Argon” นั้น มีเพียงหนึ่งเดียวที่เป็นโมเดล และอีกหนึ่งเป็นคำนำหน้ารุ่นที่ไม่มี model ID ไม่มี endpoint และไม่มีราคา — นั่นคือการประลองแบบตัวต่อตัวของสองชื่อจาก Google
• หากคุณต้องการผลลัพธ์อันดับสามของ FrontierSWE v2 และข้อสังเกตเรื่องการวิจารณ์ตนเองที่มาพร้อมกับผลลัพธ์นั้น นั่นคือชิ้นงานการประเมิน FrontierSWE
• หากคุณต้องการให้ Argon เทียบกับคู่แข่งรายใดรายหนึ่งในเชิงตัวเลข บนเว็บไซต์มีหน้าสำหรับเปรียบเทียบทั้งหมดสิบสามหน้า ซึ่งครอบคลุมกลุ่ม frontier และนั่นคือจุดที่เหมาะที่สุดสำหรับการอ่านเปรียบเทียบสองรุ่น
สิ่งที่ไม่มีหน้าใดเป็น และสิ่งที่หน้านี้เป็น คือเสาหลัก: จุดเดียวที่บอกว่าเอนทิตี้นั้นคืออะไร ตัวเลขแต่ละตัวที่แนบอยู่กับมันหมายถึงอะไรและไม่หมายถึงอะไร และวันนี้คุณทำอะไรกับมันได้จริง ๆ หน้าเพจที่เกี่ยวข้อง “Gemini 4 vs Gemini 4 Argon” ได้เสนอข้อโต้แย้งเรื่องการตั้งชื่อไว้อย่างครบถ้วนแล้ว และหน้านี้จะไม่กล่าวซ้ำ ทุกอย่างด้านล่างนี้เป็นของใหม่

ความกดดันที่ยังไม่ได้บอกอะไรกับเราเลย
สัญญาณที่ทรงพลังที่สุดสองอย่างในเรื่องราวของ Argon ชี้ไปที่การเปิดตัวเวอร์ชันสำหรับนักพัฒนาที่ใกล้จะถึง และไม่มีสิ่งใดในสองสิ่งนั้นเป็นหลักฐานว่าการเปิดตัวเวอร์ชันสำหรับนักพัฒนาได้เกิดขึ้นแล้ว
ข้อแรกคือ API ของ Google เองก็เดินหน้าต่อไปโดยไม่มี Argon รายการใหม่ล่าสุดในบันทึกการเปลี่ยนแปลงของ Gemini API คือ 6 ตุลาคม 2026 — Gemini Nano Banana 2.1 เปิดให้ใช้งานทั่วไป ภายใต้ตัวระบุ gemini-nano-banana-2.1 พูดอีกอย่างคือ ในแปดวันนับตั้งแต่ Argon ถูกประกาศ Google ได้เลือกรูปแบบการตั้งชื่อสำหรับโมเดล Gemini ที่ใช้งานจริงในโปรดักชัน และปล่อยตัวระบุ GA สำหรับโมเดลอื่นออกมา และสำหรับ gemini-4 เนมสเปซยังว่างเปล่า โมเดลที่การเปิดตัวเป็นของจริงย่อมทิ้งร่องรอยไว้ในบันทึกการเปลี่ยนแปลง ส่วนโมเดลนี้ไม่ได้ทิ้งร่องรอยใด ๆ ไว้
ประการที่สองคือการวางกรอบด้านความมั่นคงแห่งชาติ Google ระบุว่าตน “มีส่วนร่วมอย่างแข็งขันในกระบวนการโดยสมัครใจของรัฐบาลสหรัฐฯ สำหรับการเข้าถึงโมเดลก่อนการเปิดตัว” และขั้นตอนการเปิดตัวระยะแรกคือกลุ่มผู้ป้องกันไซเบอร์ที่ระบุชื่อไว้ ซึ่งสอดคล้องกับการเปิดตัวแบบเป็นขั้นตอนที่กลุ่มผู้มีความสามารถระดับแนวหน้าได้รับโมเดลก่อนที่ API สาธารณะจะได้รับ และก็สอดคล้องพอๆ กันกับกรณีที่โมเดลยังไม่พร้อมสำหรับการใช้งานทั่วไป ไม่มีอะไรในกรอบนี้ที่บอกคุณได้ว่าอันไหนเป็นอันไหน ใครก็ตามที่บอกว่ามันบอกได้ก็กำลังเดาไปเรื่อยๆ และ Google ก็ยังไม่ได้กำหนดวันที่สำหรับขั้นตอน API เพื่อให้ได้ข้อสรุป
สิ่งที่คุณสามารถเรียกได้ในวันนี้ และสิ่งที่คุณเรียกไม่ได้
นี่คือส่วนของหน้าที่ล้าสมัยเร็วที่สุด จึงต้องมีวันที่กำกับไว้ ณ วันที่ 8 ตุลาคม 2026 API โมเดลของ OrcaRouter ส่งคืน HTTP 404 สำหรับgoogle/gemini-4-argon ซึ่งไม่ได้อยู่ในเส้นทางของเรา เช่นเดียวกับgoogle/gemini-4 ก็ไม่มีเช่นกันgoogle/gemini-4-argon-high ก็ไม่มีเช่นกันgoogle/gemini-4-pro — ไม่มีตัวระบุใดในเหล่านี้ที่ใช้งานได้ เพราะไม่มีตัวใดเลยที่มีอยู่จริงในฐานะโมเดลที่เรียกใช้ได้ที่ใด
วันนี้มีอะไรบ้างในเส้นทางของเรา จากผู้จำหน่ายรายเดียวกัน และแต่ละรายการมีค่าใช้จ่ายเท่าไรตามราคาตามรายการของผู้ให้บริการ:
• google/gemini-3.8-flash — เปิดตัวเมื่อ 2026-09-02 มีหน้าต่างบริบทขนาด 1,048,576 โทเคน และเอาต์พุตสูงสุด 65,536 โทเคน ในราคา $0.75 ต่ออินพุต และ $3.75 ต่อเอาต์พุตต่อล้านโทเคน นี่คือโมเดลที่ Argon จะถูกนำไปเปรียบเทียบในที่สุดโดยคนที่มีบัตรเครดิต และมันเป็นสิ่งที่ใกล้เคียงที่สุดกับภาระงานในลักษณะเดียวกับ Argon ที่คุณสามารถรันได้ในบ่ายนี้
• google/gemini-3.6-flash — เปิดตัวเมื่อ 2026-07-21 ในราคา $0.75 และ $3.75
• google/gemini-3.5-flash — เผยแพร่เมื่อ 2026-05-23 ในราคา $1.50 และ $9.00
• google/gemini-3.5-flash-lite — เปิดตัวเมื่อ 2026-07-21 ในราคา $0.30 และ $2.50
• google/gemini-3.1-flash-lite — ที่ราคา $0.25 และ $1.50
• google/gemini-3.1-pro-preview — เปิดตัวเมื่อ 2026-02-19 ในราคา $2.00 และ $12.00 นี่คือ Gemini ในสล็อต Pro เพียงตัวเดียวที่คุณเรียกใช้ได้ และยังล้าหลังรายการใหม่ล่าสุดในสาย Flash อยู่ถึงสามรุ่นครึ่ง
ทั้งหมดนั้นรันบนคีย์เดียวกับโมเดลระดับแนวหน้าของ Claude และ OpenAI ในแถบดัชนีเดียวกัน — Claude Opus 5.5, Claude Sonnet 5.5, Claude Fable 5.1, GPT-6 Astra และ GPT-6.1 Sol ต่างอยู่บนเส้นทางเดียวกัน — ซึ่งหมายความว่าสิ่งที่น่าสนใจเกี่ยวกับตำแหน่งของ Argon สามารถทดสอบได้โดยไม่ต้องมี Argon ถ้าคุณอยากรู้ว่าคะแนนดัชนีราว 52 คะแนนของงานความรู้ให้ความรู้สึกอย่างไรในราคาหนึ่งในห้า คุณวัดได้วันนี้เทียบกับ google/gemini-3.8-flash ที่ 40.93 และถ้าคุณต้องการจุดสูงสุดของแถบนี้ คุณก็วัด Claude Opus 5.5 ที่ 57.62 ได้ในวันเดียวกัน ในบัญชีเดียวกัน โดยไม่ต้องมีสัญญาที่สองและไม่ต้องแก้โค้ดเลย นั่นคือรูปร่างในทางปฏิบัติของบทความทั้งหมดนี้: API เดียวสำหรับ 200+ โมเดล, มาร์กอัป 0% จากราคาตั้งต้นของผู้ให้บริการที่ส่งผ่านมาถึงคุณ ดังนั้นเมื่อผู้ขายลดราคา คุณก็ได้ราคานั้นในวันเดียวกับที่ประกาศ และการ failover อัตโนมัติข้ามผู้ให้บริการ สำหรับวันที่โมเดลที่คุณพึ่งพาอยู่หยุดตอบสนอง เราอธิบายเรื่องนี้ตรงนี้เพราะมันเป็นจริงกับ Gemini 3.8 Flash ที่คุณเรียกใช้ได้ ไม่ใช่เพราะมันบอกอะไรเกี่ยวกับ Argon Argon ไม่ได้อยู่ในกลุ่มนั้น
หากคุณต้องการ Argon เอง ทางเลือกของคุณในวันนี้คือกลุ่มนักป้องกันไซเบอร์ Fairwind กับการรอ API ของ Google เองก็ไม่ได้ให้บริการมัน และเราก็ไม่ได้ให้บริการเช่นกัน และไม่มีเส้นทางของบุคคลที่สามใดจะให้บริการโมเดลที่ไม่มีตัวระบุให้อ้างอิงถึงได้
คำถามที่ยังเปิดอยู่ และสิ่งที่แน่ชัดว่าจะปิดคำถามเหล่านั้นได้
มีสี่เรื่องที่ยังไม่ได้ข้อยุติ และแต่ละเรื่องมีตัวกระตุ้นที่เฉพาะเจาะจงและตรวจสอบได้ การทำให้รายการนั้นสั้นเข้าไว้คือประเด็นสำคัญ — หน้าแบบนี้จะมีประโยชน์ก็ต่อเมื่อมันยังถูกพิสูจน์ว่าผิดได้
• Argon จะได้รับตัวระบุ Gemini API หรือไม่? จับตาดูรายการโมเดล API สำหรับ gemini-4ID ที่มีคำนำหน้า ในทันทีที่มีอันหนึ่งปรากฏขึ้น คำถามเรื่องราคาจะกลายเป็นเรื่องจริงจัง และอัตราเริ่มต้นที่ $2 / $10 จะกลายเป็นตัวเลขที่คุณจะถูกเรียกเก็บเงินตาม แทนที่จะเป็นเพียงตัวเลขในบล็อกโพสต์ นอกจากนี้ ให้จับตาดูว่าอัตราเริ่มต้นยังคงอยู่จนถึงขั้น API หรือไม่ และไม่ว่าจะปรับขึ้นเป็น $4 / $20 หรือเป็นอย่างอื่น
• การตั้งค่าที่วัดได้เปลี่ยนแปลงหรือไม่? Argon ถูกวัดที่ระดับการคิดหนึ่งระดับและได้คะแนน 52.56 หาก Google เปิดเผยการตั้งค่าที่ใช้ความพยายามสูงขึ้น แถวนั้นก็จะเปลี่ยนไป คู่แข่งที่มันกำลังไล่ตามล้วนถูกระบุไว้ที่สองถึงสองระดับความพยายาม ดังนั้นการที่ Argon ถูกระบุเพียงครั้งเดียวจึงเป็นข้อเท็จจริงเกี่ยวกับความพร้อมใช้งาน ไม่ใช่เกี่ยวกับเพดานของโมเดล
• ข้อกล่าวอ้างด้านกฎหมายและการเงินจะยังยืนได้หรือไม่เมื่อมีการรันโดยอิสระ? Harvey’s Legal Agent Benchmark ที่ 19.6 เมื่อเทียบกับ 3.8 ของคู่แข่ง และ Vals Finance Agent v2 ที่ 65.4 ซึ่งนำเป็นจ่าฝูง เป็นส่วนต่างเชิงสัมพัทธ์ที่ใหญ่ที่สุดสองรายการในตารางของ Google ทั้งสองยังเป็นสองแถวที่มีแนวโน้มมากที่สุดที่จะถูกนำไปรันซ้ำโดยผู้ที่ไม่ได้ทำงานให้ Google ส่วนต่างสี่ถึงห้าเท่าในเบนช์มาร์กเฉพาะโดเมนอาจเป็นได้ทั้งประโยคที่สำคัญที่สุดในประกาศ หรือเป็นความแตกต่างของฮาร์เนส และวิธีที่จะรู้ได้คือจับตาดูการรันครั้งที่สอง
• มีรุ่นพี่น้องไหม โพสต์ประกาศของ Argon ไม่ได้ระบุชื่อตระกูล ไม่ได้พรีวิว Pro และไม่ได้พรีวิว Ultra เส้นทางที่สองของ gemini-4-*, คอลัมน์ที่สอง หรือรายการในการ์ดโมเดล แต่ละอย่างจะพลิกการตีความนั้นภายในวันเดียว บทความเรื่องการจัดตำแหน่งระดับระบุรายการหักล้างไว้ครบถ้วน
สรุป
Gemini 4 Argon เป็นโมเดลระดับแนวหน้าตัวจริงที่มีตารางผลการวัดมาตรฐานตัวจริง และมีคะแนนดัชนีตัวจริงที่ 52.56 จาก Artificial Analysis — และมันไม่ใช่ผลิตภัณฑ์ ในความหมายเฉพาะเจาะจงว่าไม่มีตัวระบุโมเดล ไม่มีเอนด์พอยต์ ไม่มีการ์ดโมเดล ไม่มีหน้าต่างบริบท และไม่มีวันเปิดให้ใช้ทั่วไปสำหรับมัน และทั้งเอกสารของ Google เองและบริการวัดผลจากบุคคลที่สามต่างเห็นตรงกันว่ามีผู้ให้บริการเพียงรายเดียวเท่านั้นที่โฮสต์มัน "Gemini 4" ในชื่อของมันเป็นป้ายกำกับรุ่น ส่วน "Argon" คือส่วนที่มีโมเดลผูกอยู่ด้วย ถ้าคุณกำลังเลือกสิ่งที่จะสร้างต่อในเดือนนี้ การตัดสินใจนั้นไม่เกี่ยวข้องกับ Argon แต่เกี่ยวข้องกับ Gemini 3.8 Flash ที่คุณเรียกใช้ได้วันนี้ในราคา $0.75 / $3.75 และโมเดลระดับแนวหน้าในช่วงคะแนนดัชนีเดียวกันที่ใช้คีย์เดียวกัน กลับมาอ่านหน้านี้อีกครั้งเมื่อมีตัวระบุ gemini-4 ปรากฏในรายการ API จนถึงตอนนั้น ทุกอย่างเกี่ยวกับ Argon เป็นเพียงคำกล่าวอ้างที่ Google กล่าวถึงโมเดลที่ไม่มีใครนอกกลุ่มแรกสามารถเข้าถึงได้

การเปรียบเทียบในบทความนี้3
ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
