
การกำหนดราคา GPT-6 Astra: ทำไมราคาที่แตกต่างกันสามราคาจึงถูกต้องทั้งหมด และงานหนึ่งงานมีค่าใช้จ่ายจริงเท่าใด
- orcaใหม่Orca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 ต่อ 1 ล้านโทเค็น
- deepseekใหม่DeepSeek: DeepSeek V4.1 Flash2026-09-1040ความฉลาด
- openaiใหม่OpenAI: GPT-6 Astra2026-09-0453ความฉลาด77การเขียนโค้ด
- googleGoogle: Gemini 3.8 Flash2026-09-0241ความฉลาด76การเขียนโค้ด
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245ความฉลาด76การเขียนโค้ด
- anthropicAnthropic: Claude Fable 5.12026-09-0153ความฉลาด82การเขียนโค้ด
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 ต่อ 1 ล้านโทเค็น
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642ความฉลาด72การเขียนโค้ด
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 ต่อ 1 ล้านโทเค็น
- z-aiZ.ai: GLM 5.32026-08-1845ความฉลาด75การเขียนโค้ด
- obsidianQwen3.8 27B2026-08-1534ความฉลาด68การเขียนโค้ด
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236ความฉลาด69การเขียนโค้ด
- grokSpaceXAI: Grok 4.62026-08-1244ความฉลาด77การเขียนโค้ด
- metaMeta: Muse Spark 1.22026-08-0540ความฉลาด72การเขียนโค้ด
- qwenQwen: Qwen3.8 Max2026-08-0345ความฉลาด76การเขียนโค้ด
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135ความฉลาด69การเขียนโค้ด
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 ต่อ 1 ล้านโทเค็น
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451ความฉลาด78การเขียนโค้ด
สรุปประเด็นสำคัญก่อนเลย: GPT-6 Astraมีราคาอยู่ที่ 10.00 ดอลลาร์ต่ออินพุตหนึ่งล้านโทเค็น 1.00 ดอลลาร์ต่ออินพุตแคชหนึ่งล้านโทเค็น และ 50.00 ดอลลาร์ต่อเอาต์พุตหนึ่งล้านโทเค็นในระดับมาตรฐานของ OpenAI นั่นคือราคาตามประกาศของ OpenAI เอง อ่านได้จากหน้าราคาของ OpenAI เองเมื่อวันที่ 16 กันยายน 2026 — และวันที่นี้สำคัญ เพราะโมเดลนี้เคยถูกกำหนดราคาไว้ต่างกันในแต่ละช่วงเวลา และผู้อ่านก็ยังคงพบตัวเลขอื่น ๆ เหล่านั้นอยู่เรื่อย ๆ GPT-6 Astraเองเปิดตัวเมื่อวันที่ 3 กันยายน 2026 ซึ่งเป็นสิบสามวันก่อนหน้านี้ บทความนี้ไม่ใช่บทความเปิดตัวและไม่ใช่บทความประกาศ แต่เป็นหน้าอ้างอิงสำหรับโมเดลที่พร้อมให้บริการทั่วไปในขณะนี้ และในสัปดาห์นี้ก็ถูกนำไปใช้งานทั่วไปแล้ว GPT-5.6 Solปรากฏอยู่ด้านล่างในฐานะเส้นฐานราคาที่ Astra ถูกขายอยู่เหนือกว่า ไม่ได้เป็นเนื้อหาหลัก
เหตุผลที่ตารางราคาต้องกินพื้นที่ทั้งหน้าเป็นเพราะตัวเลขที่แพร่หลายอยู่นั้นไม่ตรงกัน ลองค้นหาราคาของโมเดลนี้ดู คุณจะพบ $10/$50 จาก OpenAI, อัตราแบบแบตช์ที่ $5/$25, Azure เสนอราคาทั้ง $10/$50 และ $11/$55 และมีอย่างน้อยหนึ่งเอนด์พอยต์ที่ระบุราคาไว้ที่ $20/$100 ไม่มีอันไหนพิมพ์ผิด และไม่มีอันไหนเป็นราคาป้ายที่ถูกเปลี่ยนแบบเงียบ ๆ พวกมันเป็นระดับบริการที่ต่างกันและตัวแทนจำหน่ายที่ต่างกัน และการแยกแยะความต่างเหล่านี้คือความต่างระหว่างงบประมาณกับการเดา
ตารางอัตราค่าบริการ ที่ทุกบรรทัดติดป้ายกำกับและระบุวันที่
ทุกอย่างในส่วนนี้อ่านมาจากเอกสารราคา API และเอกสารโมเดลของ OpenAI เอง เมื่อวันที่ 16 กันยายน 2026 หากตัวเลขใดมาจากแหล่งอื่น ประโยคที่มีตัวเลขนั้นจะระบุไว้
• มาตรฐาน คำขอที่มีโทเค็นอินพุตไม่เกิน 272,000 — $10.00 ต่อ 1M อินพุต, $1.00 ต่อ 1M อินพุตแคช, $12.50 ต่อ 1M การเขียนแคช, $50.00 ต่อ 1M เอาต์พุต (ตารางราคาของ OpenAI เอง อ่านเมื่อ 2026-09-16)
• บรรทัดการเขียนแคชนั้นมีอยู่จริง และผู้คนมักมองข้ามมันไป — ครั้งแรกที่คุณส่งพรีฟิกซ์ มันคือการเขียนในราคา $12.50 ต่อ 1M ไม่ใช่การอ่านในราคา $1.00 การเขียนแคชถูกคิดค่าบริการที่ 1.25 เท่าของอัตราอินพุตมาตรฐาน
• มาตรฐาน คำขอที่ใช้อินพุตเกิน 272,000 โทเค็น — $20.00 ต่ออินพุต, $2.00 ต่ออินพุตแคช, $25.00 ต่อการเขียนแคช, $75.00 ต่อเอาต์พุต ต่อ 1 ล้านโทเค็น ทั้งคำขอจะถูกคิดราคาใหม่ทั้งหมด ไม่ใช่แค่โทเค็นที่เกินเส้นแบ่ง (ตารางราคาของ OpenAI เอง อ่านเมื่อ 2026-09-16)
• Batch และ Flex — ครึ่งหนึ่งของราคามาตรฐาน: อินพุต $5.00, อินพุตแคช $0.50, การเขียนแคช $6.25, เอาต์พุต $25.00 ต่อ 1M (ตารางราคาของ OpenAI เอง อ่านเมื่อ 2026-09-16) เมื่ออินพุตเกิน 272K อัตราแบบ batch คือ $10.00 / $1.00 / $12.50 / $37.50
• โหมดเร็ว — คิดราคาแบบสองระดับ: อินพุต $20.00, อินพุตแคช $2.00, การเขียนแคช $25.00, เอาต์พุต $100.00 ต่อ 1M (ตารางราคาของ OpenAI เอง ตรวจสอบเมื่อ 2026-09-16)
• สเปกโมเดลที่กำหนดค่าใช้จ่าย — หน้าต่างบริบท 1,050,000 โทเคน, อินพุตสูงสุด 922,000, เอาต์พุตสูงสุด 128,000, จุดตัดข้อมูลความรู้ 2026-04-30, รองรับโทเคนการให้เหตุผล ใช่, ค่าความพยายามในการให้เหตุผล low / medium / high / xhigh / max (เอกสารโมเดลของ OpenAI เอง อ่านเมื่อ 2026-09-16)
ถ้าคุณต้องการเวอร์ชันประโยคเดียว: ในระดับมาตรฐาน คำขอที่ใช้โทเคนอินพุตต่ำกว่า 272K จะมีค่าใช้จ่าย $10 ต่อล้านโทเคนอินพุต และ $50 ต่อล้านโทเคนเอาต์พุต การอ่านจากแคชคิดเป็นหนึ่งในสิบของอัตราอินพุต และทุกอย่างอื่นในบทความนี้เป็นอย่างใดอย่างหนึ่งระหว่างส่วนลดสำหรับการยอมรับการประมวลผลที่ช้ากว่า กับค่าธรรมเนียมเพิ่มสำหรับการข้ามเกณฑ์
ทำไมคุณจะเห็นตัวเลขที่แตกต่างออกไป และตัวไหนคือตัวไหน
ห้าสิ่งที่แตกต่างกันทำให้เกิดราคาเสนอที่ไม่ใช่ $10/$50 สี่ข้อเราสามารถโยงไปยังเอกสารได้ ส่วนอีกข้อหนึ่งเราโยงไม่ได้ และเราจะบอกตามนั้นแทนที่จะเดา
$5/$25 คือราคาระดับล็อต และเป็นราคาของ OpenAI เอง นี่ไม่ใช่ส่วนลดจากตัวแทนจำหน่ายหรืออัตราองค์กรที่ต่อรองกันได้ หน้าราคาของ OpenAI ระบุว่าการประมวลผลแบบกลุ่ม (batch) คิดราคาเพียงครึ่งหนึ่งของอัตราปกติ และแถว batch ของ Astra ระบุว่า input $5.00 และ output $25.00 หากแหล่งข้อมูลใดบอกคุณว่า $5/$25 ราวกับว่าเป็นโมเดลอื่น มันคือโมเดลเดียวกัน น้ำหนักเดียวกัน เพียงแต่อยู่ในคิวที่ช้ากว่า Batch คือคำตอบที่ถูกต้องสำหรับการรันประเมินผลข้ามคืน และเป็นคำตอบที่ผิดสำหรับสิ่งใดก็ตามที่ต้องโต้ตอบแบบทันที
$11/$55 คือการบวกเพิ่ม 10% จากราคาตามรายการพอดี และ OpenAI ระบุว่ามีการบวกเพิ่ม 10% สำหรับเอนด์พอยต์แบบ residency หน้าเพจราคาของ OpenAI ระบุว่าเอนด์พอยต์แบบ residency จะถูกคิดราคาบวกเพิ่ม 10% สำหรับโมเดลที่เปิดตัวในหรือหลังวันที่ 5 มีนาคม 2026 GPT-6 Astra เปิดตัวเมื่อวันที่ 3 กันยายน 2026 จึงเข้าเกณฑ์ คูณราคาตามรายการด้วย 1.1 แล้วจะได้ $11.00 และ $55.00 ตรงถึงหลักเซนต์ นั่นเป็นคำอธิบายที่หนักแน่นว่าทำไมใบเสนอราคาแบบ Azure ที่สูงกว่านั้นจึงเกิดขึ้น — เอนด์พอยต์ที่ผูกกับ residency ซึ่งผ่านการบวกเพิ่มที่มีการบันทึกไว้ แทนที่ผู้ขายต่อจะปั้นส่วนต่างกำไรขึ้นมาเอง เราควรระบุขอบเขตของข้อกล่าวอ้างนั้นให้แม่นยำ: การบวกเพิ่มนี้ OpenAI เป็นผู้บันทึกไว้ และการคำนวณก็ตรงกันพอดี แต่รายการ Azure ที่เราเห็นโดยเฉพาะนั้นไม่ได้ระบุด้วยตัวเองว่าเป็นเอนด์พอยต์แบบ residency ให้ถือเป็นคำอธิบายที่เป็นไปได้ ไม่ใช่คำอธิบายที่ยืนยันแล้ว
$20/$100 คืออัตราค่าใช้จ่ายของโหมด Fast สำหรับโมเดลนี้ของ OpenAI นี่คือรายการที่ดูเหมือนเป็นตัวเลขปลอมมากที่สุด และเป็นตัวเลขปลอมน้อยที่สุด โหมด Fast จะเพิ่มเป็นสองเท่าในทุกบรรทัด และแถว Fast มาตรฐานของ Astra คืออินพุต $20.00 และเอาต์พุต $100.00 ต่อ 1M เอนด์พอยต์ที่เสนอราคา $20/$100 กำลังเสนอระดับบริการที่แตกต่างออกไป — การประมวลผลแบบให้ความสำคัญ — ไม่ใช่ราคาตามรายการที่แตกต่าง และไม่ใช่โมเดลที่แตกต่าง หากคุณเห็นตัวเลขนั้นข้างชื่อ Astra คำถามที่ควรถามคือระดับการประมวลผลใด ไม่ใช่ผู้ให้บริการรายใด
ราคาที่ต่ำกว่าราคาตั้งไว้มีอยู่จริง และมันคือกำไรส่วนต่างของคนอื่น เกตเวย์และผู้ค้าปลีกรายอื่นโฆษณา Astra ในราคาต่ำกว่าราคาตั้งไว้ เกตเวย์หนึ่งเปิดเผยต่อสาธารณะว่าต่ำกว่าอัตราของ OpenAI ประมาณ 20% นั่นเป็นการตัดสินใจเชิงพาณิชย์ของผู้ประกอบการรายนั้น ไม่ใช่การเปลี่ยนแปลงราคาของ OpenAI และย่อมมาพร้อมกับข้อกำหนดด้านการจัดการข้อมูลและความน่าเชื่อถือที่ผู้ประกอบการรายนั้นใช้อยู่ เราไม่ intends ที่จะเอ่ยชื่อพวกเขา หรือนับส่วนลดของพวกเขาเป็นหลักฐานเกี่ยวกับราคาของโมเดลนี้ เพราะมันเป็นหลักฐานเกี่ยวกับธุรกิจของพวกเขา ไม่ใช่เกี่ยวกับเรทการ์ดของ OpenAI
สิ่งที่เราไม่สามารถตรวจสอบได้ เราเห็นรายการจากเราเตอร์ระบุโมเดลเป็น gpt-6-astra โดยมีระดับ batch ที่ $5/$25 และ alias แบบเคลื่อนที่ในรูปแบบ ~openai/gpt-astra-latest ตัวเลข batch ตรงกับหน้าเว็บของ OpenAI เอง alias นี้เป็นโครงสร้างที่เกตเวย์สร้างขึ้น: เอกสารโมเดลของ OpenAI ระบุรายการเพียงรายการเดียวภายใต้ snapshots และนั่นคือ gpt-6-astra เปล่า ๆ โดยไม่มีรูปแบบที่ระบุวันที่และไม่มี alias -latest อย่าใส่ alias ของเกตเวย์ลงใน config ราวกับว่าผู้ให้บริการเผยแพร่มัน อีกประเด็นหนึ่ง เราไม่พบเอกสารของ OpenAI สำหรับ "Astra Pro", "Astra-Medium" หรือระดับที่คล้ายกันซึ่งคิดราคาแยกต่างหาก คำว่า "Pro" ปรากฏอยู่ในการตั้งชื่อแผนของ ChatGPT ไม่ใช่ในตารางราคา API และรายการจากเราเตอร์ก็ไม่ใช่เอกสารของผู้ให้บริการ หากคุณต้องการให้ยืนยันระดับใด ให้ยืนยันบนหน้าเว็บของ OpenAI เอง

Astra อยู่ข้างๆ ส่วนที่เหลือของเรตการ์ด OpenAI
ราคาจะมีความหมายก็ต่อเมื่ออยู่ข้างทางเลือกอื่นๆ บนการ์ดเดียวกันเท่านั้น อัตราเหล่านี้ล้วนเป็นอัตรามาตรฐานของ OpenAI เอง ทั้งหมดอ่าน ณ วันที่ 16 กันยายน 2026 ทั้งหมดคิดต่อหนึ่งล้านโทเคน ทั้งหมดที่อินพุต 272K หรือต่ำกว่า
• GPT-6 Astra — อินพุต $10.00 / แคช $1.00 / เขียน $12.50 / เอาต์พุต $50.00
• GPT-5.6 Sol — อินพุต $4.00 / แคช $0.40 / เขียน $5.00 / เอาต์พุต $20.00
• GPT-5.6 Terra — อินพุต $2.00 / แคช $0.20 / เขียน $2.50 / เอาต์พุต $12.00
• GPT-5.6 Luna — อินพุต $0.20 / แคช $0.02 / เขียน $0.25 / เอาต์พุต $1.20
• เวอร์ชันบริบทยาว — Astra $20.00 / $2.00 / $25.00 / $75.00; Sol $8.00 / $0.80 / $10.00 / $30.00; Terra $4.00 / $0.40 / $5.00 / $18.00; Luna $0.40 / $0.04 / $0.50 / $1.80
ภายใต้ตารางนั้นมีโปรโมชันที่กำลังจัดอยู่ และมันเป็นตัวกำหนดตัวคูณที่ทุกคนถกเถียงกัน หน้าเพจราคาของ OpenAI ระบุว่า ราคาโปรโมชันของ GPT-5.6 Sol ใช้ได้อย่างน้อยจนถึงวันที่ 21 พฤศจิกายน 2026 เมื่อเทียบกับอัตราโปรโมชันที่เปิดใช้อยู่ในวันนี้ Astra มีราคาเป็น 2.5 เท่าของ Sol ในทุกบรรทัด — 2.5 เท่าสำหรับอินพุต 2.5 เท่าสำหรับอินพุตแบบแคช และ 2.5 เท่าสำหรับเอาต์พุต หากเทียบกับอัตราที่ไม่ใช่โปรโมชันของ Sol ซึ่งอยู่ที่อินพุต $5.00 และเอาต์พุต $30.00 แล้ว Astra จะเป็น 2 เท่าสำหรับอินพุต และประมาณ 1.67 เท่าสำหรับเอาต์พุต ตัวคูณทั้งสองนี้ถูกต้องตามหลักคณิตศาสตร์ และทั้งสองอธิบายโมเดลสองตัวเดียวกันในวันเดียวกัน ความแตกต่างอยู่ที่ว่าจะใช้อัตราของ Sol อัตราใดเป็นตัวหารทั้งหมด และคำตอบที่ตรงไปตรงมาต่อคำถามที่ว่า "Astra เป็น 2.5 เท่าของ Sol หรือไม่?" ก็คือ ใช่ จนถึงวันที่ 21 พฤศจิกายน 2026 หรือจนกว่า OpenAI จะยุติโปรโมชัน แล้วแต่จะเกิดก่อน
เราย้ำประเด็นนี้อย่างละเอียด เพราะมันเป็นข้อผิดพลาดที่พบบ่อยที่สุดในการรายงานเกี่ยวกับโมเดลนี้ รวมถึงในบล็อกนี้ด้วย ตัวคูณต่อโทเคนที่เลือกอัตรา Sol เพียงอัตราเดียวอย่างเงียบ ๆ โดยไม่ระบุว่าเป็นอัตราใด ไม่ใช่ข้อเท็จจริงเกี่ยวกับ Astra แต่เป็นข้อเท็จจริงเกี่ยวกับเวลาที่ประโยคนั้นถูกเขียนขึ้น

ต้นทุนต่องาน ไม่ใช่ต้นทุนต่อโทเคน
กรอบความคิดของ OpenAI เองก็คือ การเปรียบเทียบราคาต่อโทเคนสำหรับโมเดลนี้เป็นการเปรียบเทียบที่ผิด เพราะ Astra ถูกออกแบบมาให้ทำงานระยะยาวได้สำเร็จโดยใช้โทเคนน้อยลงและลองใหม่น้อยลง ข้อกล่าวอ้างนั้นคุ้มค่าที่จะจริงจังพอที่จะลองคำนวณดู แทนที่จะพูดซ้ำ ดังนั้นนี่คือตัวอย่างที่คำนวณให้ดู โดยระบุสมมติฐานไว้ล่วงหน้า เพื่อให้คุณปรับเปลี่ยนให้เข้ากับปริมาณงานของคุณเองได้
ภาระงาน: การรันเอเจนต์ 200 ครั้ง ซึ่งมีลักษณะเหมือนการย้ายข้อมูลข้ามคืน แต่ละครั้งมีโทเค็นอินพุต 10,000 โทเค็น โดย 8,000 เป็นการอ่านจากแคช และ 2,000 เป็นโทเค็นใหม่ และสร้างโทเค็นเอาต์พุต 500 โทเค็น ตลอดการรันนี้คิดเป็นโทเค็นอินพุตใหม่ 400,000 โทเค็น โทเค็นอินพุตที่แคชไว้ 1,600,000 โทเค็น และโทเค็นเอาต์พุต 100,000 โทเค็น บวกกับการเขียนแคช 10,000 โทเค็นหนึ่งครั้งเพื่อตั้งต้นคำนำหน้า ระดับมาตรฐาน ต่ำกว่า 272K ต่อคำขอ จึงไม่มีค่าธรรมเนียมเพิ่มสำหรับบริบทแบบยาว
• GPT-6 Astra — ใหม่ 0.4M x $10.00 = $4.00; แคช 1.6M x $1.00 = $1.60; เขียน 0.01M x $12.50 = $0.13; เอาต์พุต 0.1M x $50.00 = $5.00 รวม $10.73
• GPT-5.6 Sol ในอัตราโปรโมชัน — ใหม่ $1.60; แคช $0.64; เขียน $0.05; เอาต์พุต $2.00 รวม $4.29
• GPT-5.6 Sol ที่อัตราที่ไม่ใช่ราคาโปรโมชัน — ใหม่ $2.00; แคช $0.80; เขียน $0.06; เอาต์พุต $3.00 รวม $5.86
• GPT-5.6 Terra — ใหม่ $0.80; แคช $0.32; เขียน $0.03; เอาต์พุต $1.20. รวม $2.35.
• GPT-5.6 Luna — ใหม่ $0.08; แคช $0.03; เขียน $0.00; เอาต์พุต $0.12 รวม $0.23
เมื่อเทียบที่จำนวนโทเคนเท่ากัน Astra จึงมีค่าใช้จ่ายประมาณ 46 เท่าของ Luna และ 4.6 เท่าของ Terra ไม่มีใครซื้อ Luna มาทำงานระดับ Astra และเชิงอรรถนั้นคือเหตุผลทั้งหมดที่ทำให้การเปรียบเทียบต้นทุนต่อโทเคนระหว่างสองโมเดลนั้นเป็นเพียงการแสดง ส่วนการเปรียบเทียบกับ Sol ต่างหากที่ตัดสินอะไรบางอย่างได้ ดังนั้นนี่แหละคือตัวเลขที่สำคัญ
จุดคุ้มทุนอยู่ที่ 40% เพราะ Astra มีค่าใช้จ่ายเป็น 2.5 เท่าของ Sol พอดีในทุกรายการ ณ ราคาโปรโมชันของ Sol Astra จึงใช้โทเคนของ Sol ได้มากถึง 40% สำหรับงานเดียวกัน และยังได้บิลเท่ากัน — และนั่นเป็นจริงสำหรับส่วนผสมใด ๆ ของอินพุตใหม่ อินพุตแคช และเอาต์พุต เพราะอัตราส่วนนั้นคงที่ ถ้า Astra ใช้โทเคนหนึ่งในสามของ Sol จะถูกกว่า ถ้าใช้ครึ่งหนึ่ง จะแพงกว่า เมื่อเทียบกับอัตราที่ไม่ใช่โปรโมชันของ Sol จุดคุ้มทุนจะผ่อนลงมาอยู่ที่ประมาณ 55% ในส่วนผสมที่เน้นแคชแบบนี้ เพราะตัวคูณเอาต์พุตของ Astra ลดลงเหลือ 1.67 เท่า ขณะที่ตัวคูณอินพุตลดลงเหลือ 2 เท่า
ตัวเลขเดียวนั้นคือตัวเลขที่มีประโยชน์ และเป็นจุดที่คำกล่าวอ้างของผู้ขายกับการวัดผลอิสระไม่สอดคล้องกันอีกต่อไป OpenAI รายงานว่า Terminal-Bench 4.0 อยู่ที่ 57.9% สำหรับ Astra เทียบกับ 37.3% สำหรับ GPT-5.6 Sol โดยมีต้นทุน API โดยประมาณต่องานต่ำลงประมาณ 9% — เป็นข้อมูลที่ผู้ขายรายงานเอง Artificial Analysis ในการประเมินอิสระที่เผยแพร่เมื่อวันที่ 9 กันยายน 2026 ได้วัดว่า Astra ใช้โทเค็นต่องานประมาณหนึ่งในสามของ Sol บน Coding Agent Index ของตน และยังพบว่า Astra มีค่าใช้จ่าย $7.09 ต่องานที่ความพยายามสูงสุด — มากกว่า Sol (max) ประมาณ 15% — สำหรับคะแนนที่สูงกว่า 7 จุด ใน Intelligence Index ของตน การประเมินเดียวกันระบุว่า Astra มีค่าใช้จ่ายระหว่าง $0.82 ถึง $3.26 ต่องานในทุกระดับความพยายาม ซึ่งแพงกว่า Sol ที่ความพยายามสูงสุดประมาณ 60%
ทั้งสองอย่างนั้นเป็นจริงพร้อมกันได้ และช่องว่างระหว่างสองสิ่งนี้คือพาดหัวที่ตรงไปตรงมา การประหยัดโทเค็นเป็นของจริงและมาก — หนึ่งในสามเป็นตัวเลขแบบที่ผ่านจุดคุ้มทุน 40% พอดี — แต่การประหยัดที่วัดจากโทเค็นเอาต์พุตไม่ได้ลดบรรทัดค่าอ่านแคชและอินพุตใหม่ซึ่งครองเซสชันเอเจนต์แบบยาว การที่ Astra จะถูกกว่าต่อเมื่อเทียบกับ Sol หรือไม่นั้นขึ้นอยู่กับส่วนผสมการใช้งานของคุณ และทิศทางก็สลับไปมาระหว่างงานแต่ละแบบ ใครที่บอกคุณว่ามันถูกกว่าอย่างเดียว หรือแพงกว่า 2.5 เท่าอย่างเดียว กำลังยกค่าใช้จ่ายเพียงบรรทัดเดียวของบิลมาพูดเหมือนเป็นยอดรวมทั้งหมด
อะไรกันแน่ที่ทำให้บิลของรุ่นนี้สูงขึ้น
มีสามสิ่งที่โดดเด่น และทั้งสามสิ่งนี้ล้วนเฉพาะเจาะจงต่อวิธีที่ Astra ถูกออกแบบมาให้ใช้งาน
โทเคนการคิดวิเคราะห์คือโทเคนเอาต์พุต โดยคิดค่าบริการที่ 50.00 ดอลลาร์ต่อล้านโทเคน เท่ากับเอาต์พุตที่มองเห็นได้ หน้าโมเดลของ OpenAI ระบุค่าเอฟฟอร์ตที่รองรับไว้เป็น low, medium, high, xhigh และ max และไม่มีตัวเลือกปิดใช้งาน — ค่าต่ำสุดยังสูงกว่าที่เคยเป็นในโมเดลรุ่นเก่า จากการวัดด้วย Intelligence Index ซึ่งเป็นตัววัดอิสระ ช่วงต่างระหว่างเอฟฟอร์ตระดับ low กับ max อยู่ที่ 0.82 ถึง 3.26 ดอลลาร์ต่องาน หรือคิดเป็นสี่เท่าเมื่องานเดียวกัน ระดับเอฟฟอร์ตเป็นคันโยกด้านต้นทุนตัวใหญ่ที่สุดเพียงตัวเดียวที่คุณควบคุมได้ และคุ้มค่าที่จะตั้งค่าเป็นรายการเรียกแต่ละครั้งแทนที่จะตั้งแบบครอบทั้งระบบ
การลองใหม่จะทวีคูณทุกสิ่งทุกอย่าง เอเจนต์ที่ล้มเหลวแล้วรันใหม่ต้องจ่ายสำหรับคำนำหน้าทั้งหมดซ้ำอีกครั้ง นี่คือกลไกที่อยู่เบื้องหลังข้ออ้างเรื่องการลองใหม่ที่น้อยลงของ OpenAI และยังเป็นเหตุผลว่าทำไมการคำนวณต่อโทเค็นจึงทำให้เข้าใจผิดได้ทั้งสองทาง: โมเดลที่มีต้นทุนต่อโทเค็น 2.5 เท่าแต่ทำงานเสร็จในรอบเดียวอาจเอาชนะโมเดลที่ถูกกว่าซึ่งต้องใช้ถึงสามรอบ หากคุณกำลังประเมิน Astra เทียบกับสิ่งใดก็ตาม ให้วัดเป็นงานที่ทำเสร็จต่อดอลลาร์ ไม่ใช่โทเค็นต่อดอลลาร์
บริบทแบบยาวเป็นโหมดที่ออกแบบไว้ และมีการคิดค่าธรรมเนียมเพิ่ม หน้าต่างบริบทคือ 1,050,000 โทเค็น เมื่อเกิน 272,000 โทเค็นอินพุตในคำขอเดียว ทั้งคำขอจะถูกคิดราคาใหม่ที่ $20.00 ต่อล้านสำหรับอินพุต และ $75.00 ต่อล้านสำหรับเอาต์พุต — ไม่ใช่แค่ส่วนที่เกินเท่านั้น คำขอที่ 280,000 โทเค็นมีค่าใช้จ่ายประมาณสองเท่าของคำขอที่ 270,000 โทเค็น แม้อินพุตจะมากกว่าเพียงประมาณ 4% บนโมเดลที่สร้างขึ้นสำหรับงานระยะยาว นี่เป็นวิธีที่ง่ายที่สุดเพียงวิธีเดียวที่จะทำงบบานปลายโดยไม่รู้ตัว และเป็นเหตุผลว่าทำไมการแบ่งงานระยะยาวออกเป็นคำขอที่ต่ำกว่า 272K จึงมักถูกกว่าการส่งทั้งหมด แม้ว่าโมเดลจะสามารถรับทั้งหมดในครั้งเดียวได้
ตัวถ่วงดุลคือแคช และนี่คือจุดที่เซสชันเอเจนต์ยาว ๆ ประหยัดเงินได้จริง การอ่านจากแคชราคา $1.00 เทียบกับ $10.00 สำหรับข้อมูลสดใหม่ ลดลง 90% และเซสชันยาวจะส่งคำนำหน้าเดิมซ้ำหลายสิบครั้ง การเขียนแคช $12.50 จ่ายเพียงครั้งเดียว จากตัวอย่างที่คำนวณไว้ข้างต้น หากทุกการเรียกต้องส่งคำนำหน้า 8,000 โทเคนซ้ำโดยไม่ใช้แคช บิลของ Astra จะเพิ่มจาก $10.73 เป็นประมาณ $25.00 — แคชทำงานให้งบประมาณได้มากกว่าบรรทัดอื่นใดเพียงบรรทัดเดียว
บันทึกเกี่ยวกับพหุคูณ
หลายหน้าบนบล็อกนี้ รวมถึง GPT-6 Astra กับ GPT-5.6 Sol: ราคา 2.5 เท่าคุ้มค่าหรือไม่? และ อุปสงค์ GPT-6 Astra ทำให้หยุดรับสมัครสมาชิก ChatGPT Pro ใหม่ราคา $200 ระบุว่า Astra ตั้งราคาไว้ที่ 2.5 เท่าของราคาต่อโทเค็นของ GPT-5.6 Sol ตัวเลขดังกล่าวคำนวณจากอัตราโปรโมชันของ Sol ที่ 4.00 ดอลลาร์สำหรับอินพุต และ 20.00 ดอลลาร์สำหรับเอาต์พุต ซึ่งเป็นอัตราที่หน้าค่าบริการของ OpenAI แสดงอยู่ในปัจจุบัน และระบุว่าเป็นราคาโปรโมชัน ใช้ได้อย่างน้อยจนถึงวันที่ 21 พฤศจิกายน 2026
ดังนั้นตัวคูณนี้ยังคงเป็นจริงอยู่ — แต่ตอนนี้มันมีวันหมดอายุที่หน้าก่อน ๆ ไม่ได้ระบุไว้ เมื่อเทียบกับอัตราที่ไม่ใช่โปรโมชันของ Sol ที่ $5.00 สำหรับอินพุต และ $30.00 สำหรับเอาต์พุต Astra อยู่ที่ 2x สำหรับอินพุต และประมาณ 1.67x สำหรับเอาต์พุต ไม่ใช่ 2.5x หน้าที่ระบุว่า 2.5x ควรอ่านว่าเป็นเรื่องของช่วงโปรโมชัน ทิศทางของการเปรียบเทียบไม่เปลี่ยน แต่ขนาดของช่องว่างจะลดลงหนึ่งในห้าถึงหนึ่งในสามทันทีที่โปรโมชันสิ้นสุด ใครก็ตามที่วางงบประมาณเลยวันที่ 21 พฤศจิกายน 2026 ไป ควรใช้ $5.00 และ $30.00 เป็นตัวหารของ Sol และ 2x / 1.67x เป็นตัวคูณของ Astra เราไม่ได้ย้ำข้อโต้แย้งในหน้าเหล่านั้น — เหตุผลด้าน benchmark และความน่าเชื่อถือตรงนั้นยืนได้ด้วยตัวเอง — เพียงแค่แก้ไขตัวหารที่ใช้คำนวณเปรียบเทียบเท่านั้น
คำถาม “ฟรี” ที่ได้รับคำตอบอย่างไม่หลบเลี่ยง
ไม่มีแพ็กเกจฟรีสำหรับโมเดลนี้ และไม่มีช่องทาง API ฟรีสำหรับมัน ผู้ใช้ ChatGPT แบบ Free และ Go ไม่ได้รับ GPT-6 Astra เลย ผู้ใช้ Plus ได้รับมันผ่าน ChatGPT Work และ Codex เท่านั้น ไม่ใช่ในแชตปกติ API คิดค่าบริการตั้งแต่โทเคนแรกในราคา $10.00 ต่ออินพุตหนึ่งล้านโทเคน และวิธีที่ถูกต้องตามกฎหมายและถูกที่สุดในการลดตัวเลขนั้นคือระดับ batch ที่ $5.00 ต่อหนึ่งล้าน ซึ่งแลกมาด้วยความหน่วงแทนความสามารถ ใครก็ตามที่โฆษณาการเข้าถึง API ของ GPT-6 Astra ฟรี กำลังขายต่อบางสิ่งบางอย่าง — ปกติคือพูลเครดิตทดลองบนเกตเวย์ของบุคคลที่สามซึ่งมีข้อกำหนดด้านข้อมูลของตัวเอง นั่นไม่จำเป็นต้องเป็นดีลที่ไม่ดี แต่ก็ไม่ฟรี และไม่ใช่ OpenAI
สิ่งที่ควรรู้ หากคุณกำลังวางแผนความจุโดยอิงกับแพ็กเกจสมัครสมาชิกแทนที่จะเป็น API: เมื่อวันที่ 10 กันยายน 2026 OpenAI ได้ระงับการสมัครใหม่และการอัปเกรดไปยังแพ็กเกจ ChatGPT Pro ราคา $200 โดยให้เหตุผลว่ามีความต้องการ Astra แพ็กเกจราคา $100, Plus, Go, API และบัญชี Business และ Enterprise ยังเปิดให้ใช้งานต่อไป ผู้บริโภคถูกจำกัดโควตา ส่วนการเข้าถึงผ่าน API และ Enterprise ไม่ถูกจำกัด หากแผนของคุณพึ่งพาโควตาการใช้งานของแพ็กเกจสมัครสมาชิกสำหรับผู้บริโภค นั่นคือความเสี่ยงที่ต้องนำไปสร้างแบบจำลอง
การจัดเส้นทางให้มัน และสิ่งที่เราเตอร์ไม่ได้แก้ไข
Astra เป็นหนึ่งในโมเดลที่พร้อมใช้งานผ่าน OrcaRouter ภายใต้ openai/gpt-6-astra ในราคาเดียวกันกับที่ผู้ขายเรียกเก็บ คืออินพุต $10.00 และเอาต์พุต $50.00 โดยมีอัตราขั้นบันไดสำหรับเกิน 272K ตามที่แสดงบนหน้าโมเดลของเรา เราส่งต่อราคาตามรายการของผู้ให้บริการโดยบวกเพิ่ม 0% ซึ่งสำคัญกับโมเดลนี้มากกว่ากับโมเดลส่วนใหญ่: ตัวเลขในบทความนี้ขยับไปแล้วครั้งหนึ่งภายในช่วงอายุของโมเดล และราคาแบบส่งต่อจะขยับในวันที่ผู้ขายขยับ ไม่ใช่เมื่อมีใครจำได้ว่าต้องอัปเดตตาราง

เหตุผลที่ตรงไปตรงมาสำหรับการทำ routing ในที่นี้ไม่ใช่เรื่องราคา เพราะไม่มีส่วนลดที่จะขายให้คุณ — แต่เป็นเพราะการคำนวณต้นทุนข้างต้นนั้นขึ้นอยู่กับปริมาณงาน และคุณจะไม่รู้ว่าคุณจะอยู่ฝั่งไหนของจุดคุ้มทุน 40% จนกว่าคุณจะลองรันมัน การวาง Astra ไว้หลัง endpoint เดียวร่วมกับ Sol, Terra และ Luna หมายความว่าคุณสามารถวัดงานที่เสร็จสมบูรณ์ต่อดอลลาร์บนทราฟฟิกของคุณเอง และสลับโมเดลได้โดยไม่ต้องมีสัญญาที่สองหรือแก้โค้ด routing DSL ช่วยให้คุณประกอบการเรียกข้ามหลายโมเดล แทนที่จะผูกเส้นทางโปรดักชันไว้กับโมเดลเดียว และการ failover อัตโนมัติครอบคลุมกรณีที่โมเดลนี้ได้แสดงให้เห็นแล้วสองครั้ง — ว่าความต้องการใช้งานมันสามารถเกินขีดความสามารถได้
ข้อแลกเปลี่ยนเหล่านี้เป็นของจริงไม่แพ้กัน และควรค่าแก่การเรียกชื่อมันออกมา เราเตอร์คือจุดแวะหนึ่งในเส้นทางของคำขอ และบนโมเดลที่จุดขายคือการทำงานอัตโนมัติระยะยาว จุดแวะนั้นก็เป็นอีกหนึ่งสิ่งในโดเมนความล้มเหลว หากคุณมีความอดทนต่อเรื่องนี้เป็นศูนย์ ให้ติดต่อผู้ให้บริการโดยตรง หลายสิ่งในบทความนี้มีอยู่เฉพาะในความสัมพันธ์แบบตรงเท่านั้น: ตัวเลือก Zero Data Retention ที่ OpenAI มอบให้ลูกค้า API ที่มีคุณสมบัติบนเอนด์พอยต์ที่รองรับนั้น ขึ้นอยู่กับการอนุมัติของ OpenAI และการเปิดใช้งานสำหรับองค์กร — ซึ่งปิดเป็นค่าเริ่มต้นเมื่อเปิดตัว และผู้ดูแลระบบเป็นผู้เปิดภายใต้อัตราค่าบริการที่ใช้บังคับ — เป็นข้อตกลงระหว่างคุณกับ OpenAI ไม่ใช่สิ่งที่เราเตอร์จะให้ได้ OpenAI ยังระบุไว้ในเอกสารด้วยว่าโหมด Fast สำหรับโมเดลนี้ใช้ไม่ได้กับการเก็บข้อมูลในเขต EU ดังนั้นหากคุณต้องการทั้งการเก็บข้อมูลในพื้นที่และความเร็ว ข้อจำกัดนั้นจะติดไปกับโมเดล ไม่ใช่เส้นทาง และการมาร์กอัป 0% ของเราเตอร์ก็ไม่ใช่ส่วนลด: เราไม่ได้ถูกกว่าการใช้บริการโดยตรง แต่ราคาเท่ากันโดยมีการผสานรวมที่ต้องดูแลน้อยกว่า
ดูอะไรดี
หนึ่งวันที่และหนึ่งตัวเลข วันที่คือ 21 พฤศจิกายน 2026 ซึ่งเป็นเวลาที่ราคาโปรโมชันของ Sol ไม่ได้รับการรับประกันอีกต่อไป หากโปรโมชันนั้นหมดอายุ ตัวคูณของ Astra เมื่อเทียบกับ Sol จะลดลงจาก 2.5x เหลือ 2x สำหรับอินพุต และ 1.67x สำหรับเอาต์พุต และการเปรียบเทียบต้นทุนต่องานทุกชิ้นที่เผยแพร่กันอยู่จะกลายเป็นผลดีต่อ Astra เพิ่มขึ้นหนึ่งในห้าถึงหนึ่งในสาม โดยที่ไม่มีอะไรเกี่ยวกับ Astra เปลี่ยนแปลงเลยแม้แต่อย่างเดียว ตัวเลขนั้นคือจุดคุ้มทุนของคุณเอง: ลองรันงานระยะยาวที่เป็นตัวแทนหนึ่งงานบนทั้งสองโมเดล นับงานที่ทำเสร็จและจำนวนดอลลาร์รวม แล้วคุณจะได้คำตอบที่มีประโยชน์ยิ่งกว่าสิ่งใดที่เคยเผยแพร่ รวมถึงหน้านี้
การวาง Astra ไว้เบื้องหลังเอนด์พอยต์เดียวเคียงข้าง Sol, Terra และ Lunaหมายความว่าคุณจะสามารถวัดจำนวนงานที่เสร็จสมบูรณ์ต่อหนึ่งดอลลาร์บนทราฟฟิกของคุณเอง และสลับโมเดลได้โดยไม่ต้องมีสัญญาฉบับที่สองหรือแก้ไขโค้ด
การเปรียบเทียบในบทความนี้1
ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
