
DeepSeek V4.1 Flash Memasuki Beta API Dua Hari: Arsitektur Baru, Multimodal Asli, dan Ambisi Kelas Pro
- openaiBARUOpenAI: GPT-6 Astra2026-09-0455Kecerdasan77Koding
- googleBARUGoogle: Gemini 3.8 Flash2026-09-0247Kecerdasan76Koding
- qwenBARUQwen: Qwen3.8 Max (0902)2026-09-0247Kecerdasan72Koding
- anthropicBARUAnthropic: Claude Fable 5.12026-09-0157Kecerdasan82Koding
- AlibabaBARUQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 juta token
- z-aiBARUZ.ai: GLM 5.3 Flash2026-08-2646Kecerdasan72Koding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 per 1 juta token
- z-aiZ.ai: GLM 5.32026-08-1849Kecerdasan75Koding
- obsidianQwen3.8 27B2026-08-1541Kecerdasan68Koding
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1242Kecerdasan69Koding
- grokSpaceXAI: Grok 4.62026-08-1251Kecerdasan77Koding
- metaMeta: Muse Spark 1.22026-08-0547Kecerdasan72Koding
- qwenQwen: Qwen3.8 Max2026-08-0347Kecerdasan72Koding
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3141Kecerdasan69Koding
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1 juta token
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2454Kecerdasan78Koding
- googleGoogle: Gemini 3.6 Flash2026-07-2140Kecerdasan69Koding
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2128Kecerdasan49Koding
DeepSeek V4.1 Flash muncul persis di tempat DeepSeek menguji berbagai hal sebelum mengumumkannya: di dalam API langsung, dengan ID model yang memuat tanggal kedaluwarsanya sendiri. ID tersebut — deepseek-v4.1-flash-expires-on-0910 — mulai melayani pada 8 September 2026, setelah tim DeepSeek memposting uji internal “versi perantara” di grup komunitas resminya, dan akhiran 0910 itu merupakan inti cerita dalam bentuk mini. Ini adalah build yang dilepas ke lingkungan API nyata untuk uji terbatas yang dijadwalkan offline sekitar 10 September, menjelang posting rilis resmi yang menurut para pemberi bocoran yang menyorot model ini akan hadir “segera”. Ini bukan peluncuran. Tidak ada kartu model, tidak ada laporan teknis, tidak ada entri changelog, dan hingga malam ini halaman Models & Pricing publik DeepSeek masih hanya mencantumkan DeepSeek V4 Flash, DeepSeek V4 Pro, dan DeepSeek-V4-Flash-Vision-Exp.
Semua yang di bawah ini harus dibaca dengan mengingat tanda bintang tersebut. Saluran resmi di sini adalah pengumuman grup komunitas dan formulir umpan balik yang menyertainya, bukan catatan rilis. Apa yang berikut ini merupakan gabungan dari pengumuman tersebut, liputan media Tiongkok dalam beberapa jam setelahnya, dan pengukuran hari pertama dari para pengembang yang mengarahkan kunci mereka sendiri ke endpoint—dengan klaim vendor dan angka komunitas diberi label sesuai apa adanya.
Apa yang sebenarnya terjadi hari ini
Sekitar pukul 15:00 waktu Beijing pada tanggal 8 September, tim DeepSeek memberi tahu grup komunitas resminya bahwa sebuah versi perantara — yang dalam bahasa Tionghoa disebut 中间版本, semacam checkpoint di antara dua versi — sedang dibuka untuk pengujian terbatas di lingkungan API yang sesungguhnya sebelum versi final dirilis. Siapa pun yang memiliki kunci API DeepSeek dapat memanggilnya: gunakan base URL dan kunci yang sudah ada, serta atur nama model menjadi deepseek-v4.1-flash-expires-on-0910. Itulah seluruh cerita aksesnya — tidak ada endpoint terpisah, tidak ada daftar tunggu, dan tidak ada konsol baru.
Batas praktisnya sempit. Sufiks tersebut mengodekan rencana: versi uji "akan otomatis kedaluwarsa dan offline pada 10 September", menyisakan sekitar dua hari masa aktif. Setiap akun dibatasi hingga 20 permintaan bersamaan — dibandingkan dengan batas konkurensi 2.500 yang dipublikasikan DeepSeek untuk deepseek-v4-flash — yang merupakan petunjuk kuat tentang niat: ini untuk pengujian fungsional dan evaluasi, bukan untuk mengarahkan lalu lintas produksi ke sana.
• Apa itu — titik pemeriksaan "versi perantara" yang ditempatkan di API live untuk pengujian jangka pendek sebelum build resmi.
• Tempat ia berjalan — API DeepSeek sendiri; URL dasar dan kunci tidak berubah, nama model diganti menjadi deepseek-v4.1-flash-expires-on-0910.
• Berapa lama — nama tersebut menyatakan expires-on-0910; tes ini diperkirakan akan offline sekitar 10 September.
• Siapa yang dapat memanggilnya — akun apa pun dengan kunci DeepSeek, dengan 20 permintaan bersamaan per akun.

Seperti apa tagihan beta: kartu tarif DeepSeek V4 Flash
DeepSeek mengatakan bahwa pengujian ditagih dengan tarif yang sama dengan deepseek-v4-flash, dan kartu tarif model tersebut yang berlaku saat inilah yang dipakai. Sejak perubahan harga pada 16 Agustus 2026, DeepSeek menerapkan harga peak/off-peak; angka pastinya adalah angka resmi untuk tier Flash:
• Masukan, cache hit — $0.007 per 1 juta token di luar jam sibuk, $0.014 saat jam sibuk
Input, cache miss — $0,22 per 1 juta token di luar jam sibuk, $0,44 jam sibuk
• Output — $0,66 per 1M token di luar jam sibuk, $1,32 jam sibuk
• Jam sibuk — 01:00–04:00 dan 06:00–10:00 UTC, Senin–Jumat; semua jam lainnya di luar jam sibuk dengan tarif setengah dari tarif jam sibuk

Perhatikan apa yang tidak berubah: harga per token. Klaim DeepSeek bahwa V4.1 Flash "lebih murah" dengan demikian merupakan klaim efisiensi, bukan pemotongan tarif — sebuah poin yang diungkapkan oleh beberapa penguji hari pertama dengan cara yang mahal, menyaksikan sesi lima menit menguras saldo mereka jauh lebih banyak dibandingkan waktu yang sama di DeepSeek V4 Flash, karena model tersebut menghabiskan token jauh lebih cepat. Apakah biaya per tugas benar-benar turun bergantung pada apakah ia menyelesaikan pekerjaan dengan lebih sedikit token dan lebih sedikit percobaan ulang, yang tidak dapat dinilai siapa pun dari dua hari pengujian kecepatan.
Apa arti "arsitektur baru, multimodal native" — sejauh ini, belum terverifikasi.
Deskripsi resmi DeepSeek untuk V4.1 Flash memuat empat klaim: struktur model baru, dukungan multimodal asli, kemampuan yang lebih kuat, dan generasi yang lebih cepat. Klaim arsitektur adalah yang paling menonjol karena mematahkan pola. Pembaruan sebelumnya, DeepSeek V4 Flash 0731, merupakan pembaruan pasca-pelatihan yang mempertahankan arsitektur dan skala yang sama dengan pratinjaunya; kata-kata DeepSeek di sini menunjukkan perubahan struktural, dan sejumlah media membacanya sebagai tanda bahwa model ini dilatih ulang, bukan di-fine-tune. Selain itu, semuanya hanyalah inferensi. Spekulasi komunitas tentang mekanisme perhatian yang berubah, jaringan pakar, atau modul visi terintegrasi memang hanya itu — spekulasi. Tidak ada jumlah parameter, tidak ada angka jendela konteks, tidak ada tabel tolok ukur, dan tidak ada laporan teknis yang dipublikasikan.
Frasa "multimodal asli" penting karena alasan tertentu. DeepSeek-V4-Flash-Vision-Exp, yang diluncurkan pada 21 Agustus dan bersifat open-weights sejak 31 Agustus, memasang encoder visi di atas basis teks DeepSeek V4 Flash — materi DeepSeek sendiri menggambarkan pasangan tersebut sebagai model teks ditambah jalur visi eksternal. V4.1 Flash digambarkan sebagai multimodal sejak awal, dengan input gambar-dan-teks yang ditangani oleh model dasar itu sendiri. Secara prinsip, itu adalah perbedaan arsitektural yang nyata, tetapi spesifikasi modalitasnya belum dipublikasikan: apa yang diuji oleh para penguji adalah teks-plus-gambar, dan pembaca harus memperlakukan "multimodal" sebagai terkonfirmasi hanya dalam pengertian teks-dan-gambar tersebut hingga kartu model muncul. Apakah rangkaian input yang lebih luas merupakan bagian dari rencana, hingga tulisan ini dibuat, masih belum diketahui, bukan terkonfirmasi.
Kecepatan adalah sorotan utamanya — dan itu adalah pengukuran komunitas.
Angka yang beredar pada hari pertama adalah sekitar 420 token output per detik dalam generasi panjang, dengan puncak yang dilaporkan di atas 500 token/detik pada beberapa run. Satu tes yang banyak dibagikan menghasilkan lebih dari 71.000 token dalam waktu kurang dari tiga menit. Tidak ada satu pun dari ini yang resmi: ini adalah pengukuran pengembang terhadap endpoint beta, dalam kondisi yang tidak terkontrol, dan DeepSeek belum mempublikasikan tolok ukur kecepatannya sendiri. Sebagai gambaran, Artificial Analysis mengukur endpoint publik DeepSeek V4 Flash 0731 pada sekitar 128 token/detik, jadi laporan-laporan awal menunjukkan lompatan throughput mentah sekitar tiga kali atau lebih — dengan catatan biasa bahwa throughput bergantung pada panjang input, konkurensi, dan kondisi server.
Perbandingan menyeluruh terhadap DeepSeek-V4-Flash-Vision-Exp adalah area yang paling terlihat besar kesenjangannya, karena pengukuran tersebut membandingkan tugas yang sama secara beruntun. Para penguji melaporkan sekitar {{1}}6× lebih cepat untuk tugas pembuatan kode SVG{{/1}}, sekitar {{2}}5,2× pada pengambilan konteks panjang 49k token{{/2}}, sekitar {{3}}5× pada tugas pembuatan dan optimasi SQL dalam skala besar{{/3}}, {{4}}4,6× pada masalah algoritmik{{/4}}, dan {{5}}3,9× pada tugas refaktorisasi asinkron{{/5}}. {{6}}Anggaplah angka-angka itu sebagai sinyal indikatif, bukan angka presisi: angka menyeluruh untuk tugas yang sama mencakup waktu berpikir, latensi token pertama, dan kecepatan pembuatan, dan angka-angka itu berasal dari penguji perorangan, bukan rangkaian pengujian terkontrol.{{/6}} {{7}}Arah yang konsisten di semua pengukuran itulah sinyal yang menarik, bukan angka pengali tunggal mana pun.{{/7}}
Pertanyaan yang menjadi inti dari beta
Detail paling strategis tersembunyi dalam formulir umpan balik yang DeepSeek lampirkan pada tes tersebut. Di samping pertanyaan-pertanyaan tentang kerangka kerja agen dan skenario dunia nyata, formulir itu langsung menanyakan kepada para penguji apakah versi perantara DeepSeek V4.1 Flash "dapat sepenuhnya menggantikan DeepSeek V4 Pro versi online". Itu adalah pertanyaan yang luar biasa bagi sebuah perusahaan untuk diajukan di hadapan pengguna, karena DeepSeek V4 Pro berada tiga tingkat harga di atas Flash: pada tarif resmi saat ini, model Pro mengenakan biaya $0,66 per 1 juta token input (cache miss) dan $1,98 per 1 juta token output di luar jam sibuk, berbanding $0,22 dan $0,66 untuk DeepSeek V4 Flash — bersih 3× di setiap baris. Jika model kelas Flash benar-benar mendekati kemampuan setara Pro dengan harga kelas Flash, pertanyaan itu akan terjawab dengan sendirinya bagi sebagian besar pengguna, dan DeepSeek mengetahuinya.
Dibaca bersama dengan frasa "struktur baru", kuesioner tersebut mengisyaratkan bahwa V4.1 Flash adalah langkah nyata pertama dari sesuatu yang lebih besar daripada sekadar penyegaran kecil — sebuah lini Flash yang diposisikan ulang untuk memperkecil jarak menuju model unggulan, sebagaimana DeepSeek telah berulang kali menggunakan model yang lebih murah dan lebih cepat untuk mengatur ulang ekspektasi pasar tentang apa yang didapatkan pada suatu tingkat harga. Tidak ada satu pun dari itu yang dikonfirmasi oleh tolok ukur; ini adalah pembacaan strategis atas pertanyaan dua kalimat. Tetapi ini adalah hal paling menarik yang dikatakan DeepSeek tentang V4.1 Flash sepanjang hari.
Di mana mencobanya, serta apa yang harus dijalankan di produksi sementara itu.
Selama masa uji coba, satu-satunya tempat untuk mengakses V4.1 Flash adalah API milik DeepSeek sendiri — tidak ada hosting pihak ketiga untuk build yang akan kedaluwarsa dalam dua hari, dan tidak seorang pun boleh menghubungkan jalur produksi ke ID model yang dijadwalkan berhenti merespons. Penggunaan yang masuk akal untuk dua hari ke depan adalah evaluasi: jalankan beban kerja representatif Anda, ukur kualitas dan ekonomi token yang sesungguhnya, dan anggap setiap angka kecepatan yang Anda lihat sebagai anekdot sampai rilis resmi muncul dengan model card.
Untuk lalu lintas yang harus terus berjalan, lini DeepSeek untuk publik tidak berubah — dan justru di situlah lapisan routing menunjukkan gunanya. Di OrcaRouter, DeepSeek V4 Flash, DeepSeek V4 Pro, dan DeepSeek-V4-Flash-Vision-Exp semuanya dapat diakses melalui satu API dengan harga daftar DeepSeek yang diteruskan tanpa markup sama sekali. Jadi, pemangkasan harga bulan Agustus sudah berlaku di sisi kami sejak hari pertama diberlakukan, bukan ketika spreadsheet margin sempat mengurusnya. Ketika V4.1 Flash resmi akhirnya dirilis ke para penyedia layanan, pengaturan yang sama adalah cara rendah biaya peralihan untuk mengadopsinya: kirim sebagian lalu lintas ke model baru, pertahankan DeepSeek V4 Flash atau V4 Pro sebagai failover otomatis, dan biarkan DSL router yang memutuskan panggilan mana yang layak mendapatkan model yang belum teruji dan mana yang harus tetap berada pada model andalan. Anda tidak perlu mempertaruhkan jalur produksi pada beta dua hari untuk mencari tahu apakah model itu bagus.

Pertanyaan terbuka
{{1}}Kapan rilis resminya? Sinyal yang menandai model ini menyebutkan bahwa postingan rilis diperkirakan hadir "dalam waktu dekat"; masa pakai beta yang hanya dua hari menunjukkan DeepSeek tidak berniat membuat dunia menunggu terlalu lama.{{/1}}
• Apakah build final sesuai dengan yang ini? Penguji independen yang melacak siklus pengujian DeepSeek mencatat bahwa perusahaan tampaknya menjalankan beberapa build kandidat secara paralel, dan kandidat tercepat dalam pengujian awal tidak selalu yang dirilis — jadi angka kecepatan hari ini mungkin tidak menggambarkan model GA.
• Apa spesifikasinya? Jumlah parameter, detail arsitektur, panjang konteks, dan daftar lengkap modalitas input semuanya tidak dipublikasikan, dan semuanya adalah hal pertama yang dibutuhkan oleh ulasan yang sesungguhnya.
• Apakah harga bertahan, dan apakah “biaya lebih rendah” mampu bertahan saat menghadapi beban kerja nyata? Versi beta ditagih dengan tarif DeepSeek V4 Flash; peluncuran bisa membawa kartu tarif baru, dan biaya per tugas belum diukur.
• Dapatkah ia benar-benar menjalankan tugas Pro? Kuesioner mengajukan pertanyaan itu, tetapi hanya evaluasi independen pada rangkaian uji agentik dan penalaran — tolok ukur yang saat ini memisahkan tingkatan Flash dari tingkatan Pro — yang dapat menjawabnya.
Jika Anda memiliki kunci DeepSeek, batas waktu dua hari adalah intinya: panggil deepseek-v4.1-flash-expires-on-0910 sebelum ia menghilang, jalankan beban kerja Anda sendiri, dan arsipkan angka-angkanya di bawah kategori "diukur oleh komunitas, kondisi bervariasi". Bagi yang lainnya, hal yang perlu diperhatikan adalah postingan rilis, dan pertanyaan di baliknya — apakah tier termurah DeepSeek baru saja mulai menyasar tier termahalnya.
Sementara beta dua hari tersebut masih dalam proses, model Flash stabil yang benar-benar dapat Anda jalankan hari ini tinggal satu panggilan API lagi: DeepSeek V4 Flash di OrcaRouter — dengan harga daftar DeepSeek, diteruskan dengan markup 0%.
Dan andalan yang terus diminta kuesioner beta untuk dibandingkan para penguji dengan V4.1 Flash: DeepSeek V4 Pro on OrcaRouter.
Dibandingkan dalam artikel ini2
Terdeteksi dari artikel ini · Benchmark: Artificial Analysis · diperbarui setiap hari
