
Claude Haiku 5.5 vs GPT-6 Luna Pro: Sebuah Model Melawan Sebuah Mode
- openaiBARUOpenAI: GPT-6.1 Sol2026-09-2952Kecerdasan
- anthropicBARUAnthropic: Claude Sonnet 5.52026-09-2856Kecerdasan
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1 juta token · 111 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Kecerdasan
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Kecerdasan
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Kecerdasan
- xAIGrok 4.72026-09-2146Kecerdasan
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 per 1 juta token · 55 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 juta token · 347 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Kecerdasan
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Kecerdasan77Koding
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Kecerdasan76Koding
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Kecerdasan76Koding
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Kecerdasan82Koding
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1 juta token · 60 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 juta token · 377 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Kecerdasan72Koding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 juta token · 231 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Kecerdasan75Koding
- obsidianQwen3.8 27B2026-08-1534Kecerdasan68Koding
Satu sisi perbandingan ini adalah model, dan sisi lainnya adalah pengaturan. Claude Haiku 5.5 mulai tersedia secara umum pada 7 Oktober 2026 dengan harga $0,10 per juta token input dan $0,50 per juta token output, di Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry, dan Claude Platform on AWS. GPT-6 Luna Pro sama sekali bukan model: cara untuk mencapainya adalah dengan memanggil GPT-6 Luna — sudah aktif sejak 22 September 2026 dengan harga $0,10 dan $0,50 yang sama — dengan reasoning.mode diatur ke pro alih-alih standard. Tidak ada gpt-6-luna-pro identifier di halaman model OpenAI. Jadi cara jujur membingkai perbandingan ini bukanlah "model mana yang menang" melainkan "mana cara yang lebih baik untuk membelanjakan sepuluh sen per juta token input": model kecil dengan pengatur upaya, atau model yang lebih besar yang dijalankan dalam mode yang melakukan lebih banyak kerja dan menagih Anda untuk token yang tidak ditunjukkannya. Untuk pekerjaan singkat bervolume tinggi, jawabannya biasanya yang pertama. Untuk pekerjaan sulit yang sesekali muncul, jawabannya bisa yang kedua — dan angka yang menentukan itu, OpenAI belum menerbitkannya.
Apa itu "pro", secara mekanis
Panduan penalaran OpenAI menyatakan bahwa model GPT-5.6 dan GPT-6 mendukung dua mode di Responses API, standard (default) dan pro, yang dipilih melalui reasoning.mode. Mode adalah kontrol yang berbeda dari reasoning.effort: mode menentukan seberapa banyak pekerjaan yang dilakukan model sebelum memberikan jawaban, sedangkan effort menentukan seberapa banyak penalaran yang terjadi di dalam mode mana pun yang Anda pilih. Nilai effort yang didokumentasikan untuk GPT-6 Luna adalah none, low, medium (default), high, xhigh dan max, dan semuanya dapat dikombinasikan dengan mode pro.
Tentang penagihan, panduannya eksplisit dan sedikit kontra-intuitif. Mode Pro menggabungkan semua pekerjaan model di balik jawaban akhir dan menagih token tersebut "dengan tarif token standar model yang dipilih". Tidak ada premi pro pada kartu tarif. Biaya muncul sebagai volume, karena mode pro "melakukan lebih banyak pekerjaan model daripada mode standar, meningkatkan penggunaan token dan biaya" — dan token penalaran ditagih sebagai token keluaran sementara hanya muncul di objek penggunaan di bawah output_tokens_details.reasoning_tokens. Jika Anda tidak membaca bidang itu, kenaikannya tidak terlihat sampai tagihan tiba.
Dua perbandingan mengikuti dari itu dan keduanya layak dipisahkan. Dibandingkan dengan GPT-6 Luna dalam mode standar, mode pro adalah model yang sama dengan pengganda yang tidak diketahui pada konsumsi token. Dibandingkan dengan Claude Haiku 5.5, ini juga model yang berbeda pada skala yang berbeda — 1.050.000 token konteks dibandingkan dengan 1M, batas input 922.000 token dan batas pengetahuan 18 Mei 2026, pada tingkat yang menurut dokumentasi peluncuran Anthropic sendiri sedikit di atas Haiku untuk pekerjaan agentic yang sulit. Kedua perbedaan tersebut menarik ke arah yang sama pada biaya dan arah yang berlawanan pada kemampuan, itulah sebabnya tidak satu pun dapat dibaca dari daftar harga.
Kartu tarif, berdampingan
Kedua model ditagih dalam dua tingkat, dan ambang batasnya berada di posisi yang berbeda — hal ini lebih penting daripada tarif utamanya, karena kedua tarif utamanya identik.
• Masukan — Claude Haiku 5.5 $0,10 per juta hingga 100.000 token, $0,50 di atasnya. GPT-6 Luna $0,10 hingga 272.000 token, $0,20 di atasnya.
• Keluaran — Claude Haiku 5.5 $0.50 hingga 100,000 token, $2.50 di atasnya. GPT-6 Luna $0.50 hingga 272,000 token, $0.75 di atasnya.
• Cache — Pembacaan cache Claude Haiku 5.5 $0,01 dan penulisan cache $0,125 di bawah batas, $0,05 dan $0,625 di atasnya. Pembacaan cache GPT-6 Luna $0,01 dan penulisan cache $0,125 di bawah 272.000 token, $0,02 dan $0,25 di atasnya.
• Konteks dan output — 1 juta token dan output maksimum 128.000 untuk Claude Haiku 5.5; 1.050.000 token dengan batas input 922.000 token dan output maksimum 128.000 untuk GPT-6 Luna.
• Berpikir — adaptif pada keduanya. Claude Haiku 5.5 secara default menggunakan upaya sedang; GPT-6 Luna secara default menggunakan upaya sedang dan mode standar, dengan mode pro sebagai opsi tambahan di atasnya.
• Diskon batch dan caching — Claude Haiku 5.5 mendapat potongan 50% pada Message Batches API; GPT-6 Luna mendapat potongan 50% pada Batch dan Flex, dua kali lipat pada mode Fast, serta menambahkan premi 10% untuk pemrosesan regional.
Satu-satunya yang bentuknya tidak sama adalah tokenizer. Dokumentasi Anthropic mencatat bahwa Claude Haiku 5.5 menggunakan tokenizer yang lebih baru yang sama dengan Claude 4.7 dan versi setelahnya, sehingga teks yang sama terhitung sekitar 30% lebih banyak token daripada di Claude Haiku 4.5. Itu tidak mengubah tarifnya; itu mengubah seberapa cepat sebuah prompt mencapai ambang 100.000 token, dan itu adalah perbedaan biaya nyata yang tidak ditunjukkan oleh daftar tarif mana pun. Prompt 90.000 token terukur sekitar 117.000 dan dikenai $0,50 per juta input, bukan $0,10 — tarif lima kali lipat untuk prompt yang terlihat masih dengan aman berada di bawah ambang.
Berapa biaya mode pro, dalam satu-satunya satuan yang bisa digunakan siapa pun
Karena faktor pengalinya tidak dipublikasikan, hal yang berguna untuk disebutkan adalah berapa biaya setiap token tambahan, lalu bagaimana rentang yang masuk akal berperilaku pada volume besar.
• Pada harga GPT-6 Luna $0,50 per juta token output, setiap tambahan 10.000 token output per tugas memakan biaya $0,005. Jalankan 100.000 tugas sehari dan kenaikan itu menjadi satu miliar token tambahan — sekitar $500 sehari, atau $15.000 sebulan, pada model yang harga utamanya 10 sen per juta input.
• Sebagai gambaran skala, GPT-6 Luna pada upaya maksimum sudah menghabiskan 140 juta token keluaran saat menjalankan Intelligence Index terhadap median 100 juta, yang oleh penilai digambarkan agak bertele-tele. Tabel peluncuran Anthropic, yang dijalankan pada harness milik Anthropic sendiri, menempatkan GPT-6 Luna pada 16,4% di Terminal-Bench 4.0 dan 42,4% di FrontierCode 1.1, dibandingkan 39,2% dan 46,4% untuk Claude Haiku 5.5 — dilaporkan vendor, suite satu vendor, model pesaing.
• Di papan independen, urutannya lebih sempit. Artificial Analysis memberi skor Claude Haiku 5.5 sebesar 43 pada Max effort di Intelligence Index v4.3.2, peringkat kedua dari 182, dan GPT-6 Luna (Max) sebesar 38, peringkat kedelapan dari 182. Kedua angka tersebut berasal dari mode standar dengan upaya maksimal. Tidak ada evaluasi independen untuk GPT-6 Luna dalam mode pro: halamannya tidak memuat entri pro, dan Artificial Analysis tidak mencantumkannya.
Masalah struktural untuk mode pro adalah interaksi antara dua poin terakhir itu. Seluruh keunggulan biaya GPT-6 Luna dibanding Claude Haiku 5.5 berasal dari efisiensi token — 140 juta token keluaran versus 440 juta untuk suite yang sama, pada tarif identik, itulah sebabnya eval yang sama menghabiskan biaya $0,07 per tugas di satu sisi dan $0,21 di sisi lain. Mode pro, menurut definisi, adalah mode yang mengeluarkan lebih banyak token. Mengaktifkannya berarti mematikan hal yang membuat model ini murah dalam perbandingan ini, dan pengali yang akan memberi tahu seberapa besar dampaknya tidak dipublikasikan. Itu bukan argumen bahwa mode pro adalah pilihan yang buruk — pada tugas sulit, lebih banyak usaha biasanya berarti pekerjaan yang lebih baik — itu adalah argumen bahwa mode pro bersaing pada kemampuan, bukan pada harga, dan harus dievaluasi terhadap model kelas menengah yang harganya berdekatan, bukan terhadap kelas murah tempatnya berada.

Di mana masing-masing sebenarnya unggul
Jika dikerucutkan pada keputusannya, pembagiannya jelas, meskipun tidak ada sisi yang bebas dari catatan.
Claude Haiku 5.5 menguasai segmen murah. Model ini lebih cepat dalam dua pengertian yang penting: 241,9 token keluaran per detik yang diukur oleh Artificial Analysis dibandingkan 123,0 untuk GPT-6 Luna, dan waktu 295 detik hingga token pertama pada uji Index, yang merupakan hasil dari lamanya model berpikir sebelum menjawab pada upaya Max, bukan angka jaringan. Kartu tarifnya mencapai tingkat kedua pada 100.000 token, dan tokenizer-nya menggembungkan prompt sekitar 30%, jadi beban kerja dengan prompt panjang membayar lebih dari yang tertera pada label dalam kedua hal tersebut. Imbalannya adalah keunggulan kecerdasan lima poin pada indeks independen dan dial upaya — Low hingga Max — yang merupakan kontrol biaya paling berguna yang disertakan vendor mana pun pada peluncuran ini. Menetapkan upaya ke level rendah adalah cara Anda menukar sebagian dari keunggulan lima poin itu dengan angka biaya per tugas yang lebih dekat ke GPT-6 Luna.
GPT-6 Luna Pro menguasai ujung tersulit, dengan tagihan yang belum terkuantifikasi. Model di baliknya lebih murah per token di atas 272.000 token masukan daripada Claude Haiku 5.5 di atas 100.000, dengan faktor dua setengah pada masukan dan tiga sepertiga pada keluaran, dan tier pertamanya menjangkau delapan belas kali lebih jauh ke atas jendela konteks. Mode Standard secara terukur lebih murah per tugas yang diselesaikan. Mode Pro menukar itu dengan lebih banyak kerja per jawaban pada tarif yang sama, dan apakah ia mengalahkan Claude Haiku 5.5 pada upaya Max atau model tingkat menengah pada tugas tertentu adalah pertanyaan yang tidak dijawab oleh angka terbit mana pun. Cara menjawabnya adalah menjalankan tugas itu dengan kedua cara dan membaca bidang token penalaran.

Mencoba salah satunya tanpa bertaruh pada itu
Bagian yang canggung dari perbandingan ini adalah bahwa angka terpentingnya — biaya sebenarnya mode pro — hanya dapat dihasilkan dengan menjalankan lalu lintas Anda sendiri melaluinya, dan biaya efektif model yang lebih kecil bergantung pada di mana prompt Anda berada relatif terhadap batas 100.000 token setelah tokenisasi ulang. Keduanya adalah masalah pengukuran, dan keduanya lebih murah pada endpoint bersama daripada di antara dua klien vendor.
GPT-6 Luna sudah ada di katalog OrcaRouter hari ini dengan harga daftar dari penyedia dengan penambahan harga 0% yang diteruskan, sehingga baseline mode standar untuk perbandingan ini dapat dipanggil dari satu kunci, dan perubahan harga vendor langsung berdampak di sisi kami pada hari yang sama, bukan pada siklus penagihan berikutnya. Claude Haiku 5.5 belum ada di katalog; tier Anthropic yang kami rutekan saat ini adalah Claude Haiku 4.5, Claude Sonnet 5.5, dan Claude Opus 5.5, sehingga uji eskalasi dari leg murah naik ke tier menengah menjadi aturan routing, bukan perubahan kode. Failover otomatis di bawahnya inilah yang memungkinkan model berusia dua hari menangani lalu lintas produksi saat Anda masih mengukurnya: penyedia yang mulai gagal akan dialihkan, bukan membuat permintaan gagal, yang merupakan perbedaan antara pilot yang bisa Anda jalankan minggu ini dan cutover yang harus Anda jadwalkan.
Apa yang menyelesaikannya
Tiga hal, sesuai urutan seberapa besar pengaruhnya terhadap jawaban. Jika OpenAI menerbitkan pengali token mode pro, atau slug pro dengan baris harganya sendiri, hal itu akan mengubah ketidaktahuan utama menjadi aritmetika. Jika Artificial Analysis menjalankan ulang GPT-6 Luna dalam mode pro dengan effort yang setara, hal itu akan melakukannya dari sisi independen. Dan pengujian independen kedua atas Claude Haiku 5.5 pada medium alih-alih Max akan memberi tahu Anda berapa biaya model itu sebenarnya pada pengaturan defaultnya, yaitu konfigurasi yang akan dipakai sebagian besar orang — angka $0,21 per tugas di papan adalah angka untuk effort Max, dan Max bukanlah default.
Sampai saat itu, ringkasan yang akurat memang sempit. Claude Haiku 5.5 adalah model yang dapat Anda panggil, tetapkan harganya, dan uji tolok ukurnya hari ini, dan pada volume yang menjadi sasaran tingkatannya, model ini adalah jawaban yang lebih murah dengan cara terdokumentasi untuk menjadi lebih murah lagi. GPT-6 Luna Pro adalah konfigurasi dari model yang dapat Anda panggil; kartu tarifnya bukan masalah, konsumsi tokennya belum diaudit, dan seluruh alasan untuk memakainya bertumpu pada tugas-tugas yang cukup sulit sehingga menghabiskan lebih banyak token justru menjadi intinya. Belilah untuk tugas-tugas itu, ukurlah sebelum melakukannya, dan jangan menempatkannya pada jalur bervolume tinggi sampai seseorang menerbitkan pengalinya.

