
Harga GPT-6 Astra: Mengapa Tiga Harga yang Berbeda Semuanya Benar, dan Berapa Biaya Sebenarnya untuk Sebuah Tugas
- orcaBARUOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 juta token
- deepseekBARUDeepSeek: DeepSeek V4.1 Flash2026-09-1040Kecerdasan
- openaiBARUOpenAI: GPT-6 Astra2026-09-0453Kecerdasan77Koding
- googleGoogle: Gemini 3.8 Flash2026-09-0241Kecerdasan76Koding
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Kecerdasan76Koding
- anthropicAnthropic: Claude Fable 5.12026-09-0153Kecerdasan82Koding
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 juta token
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Kecerdasan72Koding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 juta token
- z-aiZ.ai: GLM 5.32026-08-1845Kecerdasan75Koding
- obsidianQwen3.8 27B2026-08-1534Kecerdasan68Koding
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Kecerdasan69Koding
- grokSpaceXAI: Grok 4.62026-08-1244Kecerdasan77Koding
- metaMeta: Muse Spark 1.22026-08-0540Kecerdasan72Koding
- qwenQwen: Qwen3.8 Max2026-08-0345Kecerdasan76Koding
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Kecerdasan69Koding
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1 juta token
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451Kecerdasan78Koding
Intinya dulu: GPT-6 Astra berbiaya $10.00 per juta token input, $1.00 per juta input yang di-cache, dan $50.00 per juta token output pada tier standar OpenAI. Itu adalah harga daftar OpenAI sendiri, yang dibaca dari halaman harga OpenAI sendiri pada 16 September 2026 — dan tanggalnya penting, karena model ini pernah diberi harga yang berbeda pada berbagai titik waktu dan pembaca terus menemukan angka-angka lain itu. GPT-6 Astra sendiri dirilis pada 3 September 2026, tiga belas hari sebelum halaman ini. Ini bukan artikel peluncuran dan bukan artikel pengumuman; ini adalah halaman referensi untuk model yang kini tersedia secara umum dan, sejak minggu ini, diterapkan secara umum. GPT-5.6 Sol muncul di bawah sebagai tolok ukur harga yang di atasnya Astra dijual, bukan sebagai subjeknya.
Alasan kartu tarif membutuhkan satu halaman penuh adalah karena angka-angka yang beredar tidak saling sepakat. Cari harga model ini dan Anda akan menemukan $10/$50 dari OpenAI, tarif batch $5/$25, penawaran Azure pada $10/$50 dan $11/$55, serta setidaknya satu endpoint yang tercantum pada $20/$100. Tidak satu pun dari angka-angka itu salah ketik dan tidak satu pun merupakan harga daftar yang diubah diam-diam. Semuanya adalah tingkat layanan yang berbeda dan penjual yang berbeda, dan kemampuan membedakannya adalah perbedaan antara anggaran dan tebakan.
Kartu tarif, dengan setiap baris diberi label dan tanggal
Semua yang ada di bagian ini dibaca dari dokumentasi harga API dan model milik OpenAI sendiri pada 16 September 2026. Bila suatu angka berasal dari pihak lain, kalimat yang memuatnya akan menyebutkannya.
• Standar, permintaan pada atau di bawah 272.000 token masukan — $10.00 per 1 juta input, $1.00 per 1 juta input cache, $12.50 per 1 juta penulisan cache, $50.00 per 1 juta output (tabel harga OpenAI sendiri, dibaca 2026-09-16).
• Baris penulisan cache itu nyata dan orang-orang melewatkannya — saat pertama kali Anda mengirim prefiks, itu adalah penulisan sebesar $12,50 per 1 juta, bukan pembacaan sebesar $1,00. Penulisan cache ditagih sebesar 1,25x tarif input standar.
• Standar, permintaan di atas 272.000 token input — $20,00 input, $2,00 input yang di-cache, $25,00 penulisan cache, $75,00 output per 1 juta. Seluruh permintaan dihitung ulang harganya, bukan hanya token yang melewati ambang batas (tabel harga milik OpenAI, dibaca 2026-09-16).
• Batch and Flex — setengah dari standar: input $5.00, input cache $0.50, penulisan cache $6.25, output $25.00 per 1 juta (tabel harga OpenAI sendiri, dibaca pada 2026-09-16). Untuk input di atas 272K, tarif batch adalah $10.00 / $1.00 / $12.50 / $37.50.
• Mode cepat — dua kali standar: $20.00 input, $2.00 input cache, $25.00 penulisan cache, $100.00 output per 1 juta (tabel harga OpenAI sendiri, dibaca 2026-09-16).
• Spesifikasi model yang menentukan biaya — jendela konteks 1.050.000 token, input maksimum 922.000, output maksimum 128.000, batas pengetahuan 2026-04-30, dukungan token penalaran ya, nilai upaya penalaran rendah / sedang / tinggi / xhigh / maks (dokumentasi model OpenAI sendiri, dibaca 2026-09-16).
Jika Anda ingin versi satu kalimatnya: pada tier standar, permintaan yang tetap di bawah 272K token masukan dikenai biaya $10 per juta untuk masukan dan $50 per juta untuk keluaran, pembacaan yang di-cache sepersepuluh dari tarif masukan, dan semua hal lain di artikel ini entah merupakan diskon karena menerima pemrosesan yang lebih lambat atau biaya tambahan karena melewati ambang batas.
Mengapa Anda akan melihat angka yang berbeda, dan mana yang mana
Lima hal berbeda menghasilkan penawaran yang bukan $10/$50. Empat di antaranya dapat kami kaitkan dengan dokumentasi; satu tidak dapat, dan kami akan mengatakannya alih-alih menebak.
$5/$25 adalah tingkat batch, dan itu adalah harga OpenAI sendiri. Ini bukan diskon reseller atau tarif perusahaan yang dinegosiasikan. Halaman harga OpenAI mencantumkan pemrosesan batch pada setengah tarif standar, dan baris batch Astra mencantumkan $5.00 input dan $25.00 output. Jika suatu sumber mengutip $5/$25 seolah-olah itu model yang berbeda, itu adalah model yang sama, bobot yang sama, pada antrean yang lebih lambat. Batch adalah jawaban yang tepat untuk proses evaluasi semalaman dan jawaban yang salah untuk apa pun yang interaktif.
$11/$55 tepat merupakan kenaikan 10% atas harga daftar, dan OpenAI mendokumentasikan kenaikan 10% untuk endpoint residensi. Halaman harga OpenAI menyatakan bahwa endpoint residensi dikenakan kenaikan 10% untuk model yang dirilis pada atau setelah 5 Maret 2026. GPT-6 Astra dirilis pada 3 September 2026, sehingga model itu memenuhi syarat. Kalikan harga daftar dengan 1,1 dan Anda mendapatkan $11,00 dan $55,00 hingga ke sen. Itu adalah penjelasan yang kuat tentang dari mana penawaran yang lebih tinggi ala Azure berasal — endpoint yang terikat residensi yang meneruskan kenaikan yang terdokumentasi, bukan reseller yang mengarang margin. Kita harus tepat mengenai batas klaim tersebut: kenaikan itu didokumentasikan oleh OpenAI, dan aritmetikanya cocok persis, tetapi listing Azure spesifik yang kami lihat tidak dengan sendirinya menyatakan bahwa itu adalah endpoint residensi. Anggap ini sebagai penjelasan yang mungkin, bukan yang terkonfirmasi.
$20/$100 adalah tarif mode Fast OpenAI untuk model ini. Inilah angka yang paling tampak palsu sekaligus paling tidak palsu. Mode Fast menggandakan setiap baris, dan baris Fast standar Astra adalah $20.00 untuk input dan $100.00 untuk output per 1 juta. Endpoint yang menyebut $20/$100 sedang menyebut tingkat layanan yang berbeda — pemrosesan prioritas — bukan harga daftar yang berbeda dan bukan model yang berbeda. Jika Anda melihat angka itu di samping nama Astra, pertanyaan yang perlu diajukan adalah tingkat pemrosesan yang mana, bukan vendor yang mana.
Harga di bawah daftar harga memang ada, dan itu adalah margin pihak lain. Gateway dan penjual ulang pihak ketiga mengiklankan Astra di bawah harga daftar. Satu gateway secara terbuka mencantumkan sekitar 20% di bawah tarif OpenAI. Itu adalah keputusan komersial operator tersebut, bukan perubahan harga oleh OpenAI — dan itu disertai ketentuan penanganan data dan keandalan apa pun yang diterapkan operator tersebut. Kami tidak akan menyebut nama mereka atau menganggap diskon mereka sebagai bukti tentang harga model ini, karena itu adalah bukti tentang bisnis mereka, bukan tentang daftar tarif OpenAI.
Apa yang tidak dapat kami verifikasi. Kami melihat daftar router mencantumkan model sebagai gpt-6-astra dengan tier batch bertarif $5/$25 dan alias bergerak berbentuk ~openai/gpt-astra-latest. Angka batch tersebut cocok dengan halaman OpenAI sendiri. Alias itu adalah konstruksi gateway: dokumentasi model OpenAI mencantumkan tepat satu entri di bawah snapshots dan itu adalah gpt-6-astra polos, tanpa bentuk bertanggal dan tanpa alias -latest. Jangan masukkan alias gateway ke dalam konfigurasi seolah-olah vendor menerbitkannya. Secara terpisah, kami tidak menemukan dokumentasi OpenAI untuk tier "Astra Pro", "Astra-Medium", atau tier serupa yang diberi harga secara terpisah. "Pro" muncul dalam penamaan paket ChatGPT, bukan di kartu tarif API, dan daftar router bukanlah dokumentasi vendor. Jika Anda perlu memastikan tier, pastikan di halaman OpenAI sendiri.

Astra di samping bagian lainnya dari kartu tarif OpenAI
Harga hanya bermakna bila dibandingkan dengan alternatif lain di kartu yang sama. Ini semua adalah tarif standar OpenAI sendiri, semuanya dibaca pada 16 September 2026, semuanya per juta token, semuanya pada input 272K atau kurang.
• GPT-6 Astra — $10.00 masukan / $1.00 di-cache / $12.50 penulisan / $50.00 keluaran.
• GPT-5.6 Sol — $4.00 masukan / $0.40 di-cache / $5.00 penulisan / $20.00 keluaran.
• GPT-5.6 Terra — $2.00 masukan / $0.20 di-cache / $2.50 penulisan / $12.00 keluaran.
• GPT-5.6 Luna — $0.20 masukan / $0.02 di-cache / $0.25 penulisan / $1.20 keluaran.
• Versi konteks panjang — Astra $20.00 / $2.00 / $25.00 / $75.00; Sol $8.00 / $0.80 / $10.00 / $30.00; Terra $4.00 / $0.40 / $5.00 / $18.00; Luna $0.40 / $0.04 / $0.50 / $1.80.
Ada promosi yang berjalan di balik tabel itu, dan promosi itulah yang menentukan kelipatan yang diperdebatkan semua orang. Halaman harga OpenAI mencatat bahwa harga promo GPT-5.6 Sol tersedia setidaknya hingga 21 November 2026. Jika dibandingkan dengan tarif promo yang berlaku hari ini, Astra adalah 2,5x Sol pada setiap baris — 2,5x untuk input, 2,5x untuk cached input, 2,5x untuk output. Jika dibandingkan dengan tarif non-promo Sol sebesar $5,00 untuk input dan $30,00 untuk output, Astra adalah 2x untuk input dan sekitar 1,67x untuk output. Kedua kelipatan itu benar secara aritmetika dan keduanya menggambarkan dua model yang sama pada hari yang sama. Perbedaannya sepenuhnya terletak pada tarif Sol mana yang Anda pakai sebagai penyebut, dan jawaban jujur atas pertanyaan "apakah Astra 2,5x Sol?" adalah: ya, hingga 21 November 2026, atau sampai kapan pun OpenAI mengakhiri promosi tersebut, mana yang lebih dulu terjadi.
Kami mengemukakan poin ini secara panjang lebar karena ini adalah kesalahan paling umum dalam peliputan model ini, termasuk di blog ini. Kelipatan per token yang diam-diam memilih satu kurs Sol dan tidak menyebutkannya bukanlah fakta tentang Astra. Itu adalah fakta tentang kapan kalimat itu ditulis.

Biaya per tugas, bukan biaya per token
Cara OpenAI sendiri membingkai ini adalah bahwa membandingkan harga token untuk model ini adalah perbandingan yang keliru, karena Astra dirancang untuk menyelesaikan pekerjaan berjangka panjang dengan lebih sedikit token dan lebih sedikit percobaan ulang. Klaim itu layak ditanggapi cukup serius untuk melakukan perhitungan, bukan sekadar mengulanginya. Jadi, berikut adalah contoh perhitungan dengan asumsi yang dinyatakan di awal, sehingga Anda dapat mengubahnya agar sesuai dengan beban kerja Anda sendiri.
Beban kerja: sebuah agent run dengan 200 panggilan, bentuknya seperti migrasi semalam. Setiap panggilan membawa 10.000 token masukan, dengan 8.000 di antaranya berupa pembacaan cache dan 2.000 token baru, serta menghasilkan 500 token keluaran. Sepanjang run tersebut, totalnya adalah 400.000 token masukan baru, 1.600.000 token masukan yang di-cache, dan 100.000 token keluaran, ditambah satu penulisan cache 10.000 token untuk mengisi prefiks. Standard tier, di bawah 272K per permintaan, sehingga tidak ada biaya tambahan long-context yang berlaku.
• GPT-6 Astra — baru 0.4M x $10.00 = $4.00; di-cache 1.6M x $1.00 = $1.60; penulisan 0.01M x $12.50 = $0.13; keluaran 0.1M x $50.00 = $5.00. Total $10.73.
• GPT-5.6 Sol dengan tarif promonya — baru $1.60; cache $0.64; tulis $0.05; output $2.00. Total $4.29.
• GPT-5.6 Sol pada tarif non-promosinya — baru $2.00; cache $0.80; tulis $0.06; keluaran $3.00. Total $5.86.
• GPT-5.6 Terra — baru $0.80; cache $0.32; tulis $0.03; keluaran $1.20. Total $2.35.
• GPT-5.6 Luna — baru $0.08; di-cache $0.03; tulis $0.00; keluaran $0.12. Total $0.23.
Pada jumlah token yang identik, Astra sekitar 46x Luna dan 4,6x Terra. Tidak ada yang membeli Luna untuk mengerjakan pekerjaan seukuran Astra, dan catatan kaki itulah alasan utama perbandingan biaya per token antara kedua model tersebut hanya sandiwara. Perbandingan dengan Sol-lah yang menentukan sesuatu, jadi inilah angka yang penting.
Titik impasnya adalah 40%. Karena Astra tepat 2,5x Sol pada setiap baris dengan tarif promosi Sol, Astra dapat menghabiskan hingga 40% token Sol untuk tugas yang sama dan tetap berakhir pada tagihan yang sama — dan itu berlaku untuk campuran input baru, input cache, dan output apa pun, karena rasionya seragam. Jika Astra menggunakan sepertiga token Sol, biayanya jadi lebih murah; jika menggunakan setengahnya, biayanya lebih mahal. Dibandingkan tarif nonpromosi Sol, titik impasnya melonggar menjadi sekitar 55% pada campuran yang berat cache ini, karena kelipatan output Astra turun menjadi 1,67x sementara kelipatan inputnya turun menjadi 2x.
Angka tunggal itulah yang berguna, dan di situlah klaim vendor dan pengukuran independen berhenti sepakat. OpenAI melaporkan Terminal-Bench 4.0 sebesar 57,9% untuk Astra dibandingkan 37,3% untuk GPT-5.6 Sol, dengan perkiraan biaya API per tugas sekitar 9% lebih rendah — menurut laporan vendor. Artificial Analysis, dalam evaluasi independen yang diterbitkan 9 September 2026, mengukur Astra menggunakan sekitar sepertiga token Sol per tugas pada Coding Agent Index-nya, dan tetap mendapati Astra di angka $7,09 per tugas pada upaya maksimal — sekitar 15% lebih mahal daripada Sol (maks) — untuk skor 7 poin lebih tinggi. Pada Intelligence Index-nya, evaluasi yang sama menempatkan Astra antara $0,82 dan $3,26 per tugas di berbagai tingkat upaya, sekitar 60% lebih mahal daripada Sol pada upaya maksimal.
Keduanya bisa sama-sama benar, dan selisih di antara keduanya adalah inti persoalan yang jujur. Penghematan token itu nyata dan besar — sepertiga adalah persis angka yang melewati titik impas 40% — tetapi penghematan yang diukur pada token keluaran tidak mengecilkan baris cache-read dan input baru yang mendominasi sesi agen yang panjang. Apakah Astra lebih murah per tugas daripada Sol bergantung pada bauran Anda, dan arahnya bisa berbalik antar beban kerja. Siapa pun yang mengatakan bahwa ini sekadar lebih murah, atau sekadar 2,5 kali lebih mahal, sedang mengutip satu baris tagihan seolah-olah itu totalnya.
Apa sebenarnya yang menentukan besarnya tagihan pada model ini
Tiga hal mendominasi, dan ketiganya spesifik pada bagaimana Astra dimaksudkan untuk digunakan.
Token penalaran adalah token keluaran. Token tersebut ditagih $50.00 per juta, sama seperti keluaran yang terlihat. Halaman model OpenAI mencantumkan nilai effort yang didukung sebagai low, medium, high, xhigh, dan max, dan tidak ada pengaturan untuk menonaktifkannya — batas bawahnya lebih tinggi daripada pada model yang lebih lama. Pada pengukuran Intelligence Index yang independen, selisih antara effort low dan max adalah $0.82 hingga $3.26 per tugas, faktor empat untuk pekerjaan yang identik. Tingkat effort adalah tuas biaya tunggal terbesar yang Anda kendalikan, dan sebaiknya diatur per panggilan daripada secara global.
Percobaan ulang melipatgandakan segalanya. Agen yang gagal dan menjalankan ulang akan membayar seluruh prefiks itu lagi. Inilah mekanisme di balik klaim OpenAI tentang lebih sedikit percobaan ulang, dan inilah juga alasan aritmetika per token menyesatkan di kedua arah: model yang berbiaya 2,5x per token tetapi selesai dalam satu kali proses dapat mengalahkan model yang lebih murah yang membutuhkan tiga kali. Jika Anda mengevaluasi Astra terhadap apa pun, ukurlah tugas yang diselesaikan per dolar, bukan token per dolar.
Konteks panjang adalah mode yang dirancang untuk digunakan, dan dikenakan biaya tambahan. Jendelanya adalah 1,050,000 token. Lewati 272,000 token masukan dalam satu permintaan, dan seluruh permintaan akan dihargai ulang pada $20.00 untuk masukan dan $75.00 untuk keluaran per juta — bukan hanya bagian yang melebihinya. Permintaan dengan 280,000 token berbiaya sekitar dua kali lipat permintaan dengan 270,000 token untuk masukan yang hanya sekitar 4% lebih banyak. Pada model yang dibangun untuk pekerjaan berhorizon panjang, ini adalah cara termudah untuk menghamburkan anggaran tanpa menyadarinya, dan itulah sebabnya memecah tugas berhorizon panjang menjadi permintaan di bawah 272K biasanya lebih murah daripada mengirimkannya secara utuh, meskipun model tersebut mampu menerimanya secara utuh.
Penyeimbangnya adalah caching, dan di sinilah sesi agen yang panjang benar-benar menghemat biaya. Pembacaan cache $1,00 dibandingkan $10,00 untuk yang tanpa cache, pengurangan 90%, dan sesi panjang mengirim ulang prefiks yang sama puluhan kali. Penulisan cache $12,50 dibayar sekali. Pada contoh yang telah dihitung di atas, jika setiap panggilan harus mengirim ulang prefiks 8.000 token-nya tanpa cache, tagihan Astra akan naik dari $10,73 menjadi sekitar $25,00 — cache melakukan lebih banyak pekerjaan untuk anggaran daripada pos tunggal lainnya.
Catatan tentang kelipatan
Beberapa halaman di blog ini, termasuk GPT-6 Astra vs GPT-5.6 Sol: apakah harga 2,5x lipat sepadan? dan Permintaan GPT-6 Astra Menjeda Pendaftaran Baru ChatGPT Pro $200, menyatakan bahwa Astra terdaftar pada 2,5x harga token GPT-5.6 Sol. Angka itu dihitung berdasarkan tarif promosi Sol sebesar $4.00 input dan $20.00 output, yang merupakan tarif yang tercantum di halaman harga OpenAI saat ini dan digambarkan sebagai tarif promosi, tersedia setidaknya hingga 21 November 2026.
Jadi kelipatan itu tidak berhenti menjadi benar — ia kini memiliki tanggal kedaluwarsa yang tidak dimiliki halaman-halaman sebelumnya. Dibandingkan dengan tarif non-promosi Sol sebesar $5.00 untuk input dan $30.00 untuk output, Astra adalah 2x pada input dan sekitar 1.67x pada output, bukan 2.5x. Halaman-halaman yang menyebut 2.5x harus dibaca sebagai merujuk pada periode promosi; arah perbandingannya tidak berubah, tetapi besarnya selisih menyusut sebesar seperlima hingga sepertiga begitu promosi berakhir. Siapa pun yang menyusun anggaran setelah 21 November 2026 harus menggunakan $5.00 dan $30.00 sebagai penyebut Sol dan 2x / 1.67x sebagai kelipatan Astra. Kami tidak mengulang kembali argumen di halaman-halaman itu — penalaran tolok ukur dan keandalan di sana berdiri sendiri — hanya mengoreksi penyebut yang menjadi dasar perhitungannya.
Pertanyaan "gratis", dijawab tanpa berkelit
Tidak ada tier gratis untuk model ini, dan tidak ada jalur API gratis untuk mengaksesnya. Pengguna ChatGPT Free dan Go sama sekali tidak mendapatkan GPT-6 Astra. Pelanggan Plus hanya mendapatkannya melalui ChatGPT Work dan Codex, bukan di chat biasa. API ditagih sejak token pertama sebesar $10,00 per juta input, dan cara sah termurah untuk menurunkan angka itu adalah tier batch sebesar $5,00 per juta, yang mengorbankan latensi, bukan kemampuan. Siapa pun yang mengiklankan akses API GPT-6 Astra gratis sedang menjual kembali sesuatu — biasanya kumpulan kredit uji coba di gateway pihak ketiga dengan ketentuan datanya sendiri. Itu belum tentu penawaran buruk, tetapi itu tidak gratis, dan itu bukan OpenAI.
Perlu diketahui jika Anda melakukan perencanaan kapasitas seputar langganan, bukan API: pada 10 September 2026, OpenAI menghentikan sementara pendaftaran baru dan peningkatan ke tier ChatGPT Pro seharga $200, dengan alasan permintaan untuk Astra. Tier $100, Plus, Go, API, serta akun Business dan Enterprise tetap terbuka. Konsumen dijatah; akses API dan enterprise tidak. Jika rencana Anda bergantung pada jatah penggunaan langganan konsumen, itulah risiko yang perlu dimodelkan.
Merutekannya, dan apa yang tidak diperbaiki oleh router
Astra adalah salah satu model yang tersedia melalui OrcaRouter di bawah openai/gpt-6-astra, dengan biaya input $10,00 dan output $50,00 yang sama seperti yang dikenakan vendor, dengan tingkatan di atas 272K yang ditampilkan di halaman model kami. Kami meneruskan harga daftar penyedia dengan markup 0%, yang lebih penting pada model ini daripada pada kebanyakan model: angka-angka dalam artikel ini sudah berubah sekali dalam masa hidup model ini, dan harga pass-through berubah pada hari vendor mengubahnya, bukan saat seseorang ingat untuk memperbarui tabel.

Alasan jujur untuk perutean di sini bukanlah harga, karena tidak ada diskon yang bisa kami tawarkan kepada Anda — alasannya adalah perhitungan biaya di atas bergantung pada beban kerja dan Anda tidak akan tahu Anda mendarat di sisi mana dari titik impas 40% sampai Anda menjalankannya. Menempatkan Astra di belakang satu endpoint bersama Sol, Terra, dan Luna berarti Anda dapat mengukur tugas yang diselesaikan per dolar pada trafik Anda sendiri dan mengganti model tanpa kontrak kedua atau perubahan kode. routing DSL memungkinkan Anda menyusun panggilan di beberapa model alih-alih mengikat satu jalur produksi ke satu model, dan failover otomatis menangani kasus yang sudah ditunjukkan model ini dua kali — bahwa permintaan terhadapnya dapat melampaui kapasitas.
Trade-off-nya sama-sama nyata dan layak disebut. Router adalah satu hop dalam jalur permintaan, dan pada model yang nilai jualnya adalah kerja otonom jangka panjang, hop itu menjadi satu hal lagi dalam domain kegagalan; jika toleransi Anda untuk itu nol, hubungi vendor secara langsung. Beberapa hal dalam artikel ini hanya ada pada hubungan langsung: opsi Zero Data Retention yang ditawarkan OpenAI kepada pelanggan API yang memenuhi syarat pada endpoint yang didukung bergantung pada persetujuan OpenAI, dan pengaktifan enterprise — yang secara default nonaktif saat peluncuran dan diaktifkan oleh administrator berdasarkan rate card yang berlaku — adalah perjanjian antara Anda dan OpenAI, bukan sesuatu yang dapat diberikan router. OpenAI juga mendokumentasikan bahwa Fast mode untuk model ini tidak tersedia dengan residensi data UE, jadi jika Anda membutuhkan residensi dan kecepatan sekaligus, batasan itu mengikuti modelnya, bukan rutenya. Dan markup 0% dari router bukanlah diskon: kami tidak lebih murah daripada menggunakan jalur langsung, kami sama harganya dengan lebih sedikit integrasi yang harus dipelihara.
Apa yang harus ditonton
Satu tanggal dan satu angka. Tanggalnya adalah 21 November 2026, saat harga promosi Sol tidak lagi dijamin — jika promo itu berakhir, kelipatan Astra terhadap Sol turun dari 2,5x menjadi 2x pada input dan 1,67x pada output, dan setiap perbandingan biaya per tugas yang beredar menjadi lebih menguntungkan bagi Astra sebesar seperlima hingga sepertiga tanpa satu pun hal tentang Astra berubah. Angkanya adalah titik impas Anda sendiri: jalankan satu tugas representatif berhorizon panjang pada kedua model, hitung tugas yang diselesaikan dan total dolar, dan Anda akan mendapatkan jawaban yang lebih berguna daripada apa pun yang dipublikasikan, termasuk halaman ini.
Menempatkan Astra di belakang satu endpoint bersama Sol, Terra dan Luna berarti Anda dapat mengukur tugas yang diselesaikan per dolar pada trafik Anda sendiri dan mengganti model tanpa kontrak kedua atau perubahan kode.
Dibandingkan dalam artikel ini1
Terdeteksi dari artikel ini · Benchmark: Artificial Analysis · diperbarui setiap hari
