
Dalam artikel ini (4)
Harga DeepSeek V4 Pro: analisis puncak dan non-puncak empat kali lipat
Poin utama
- Anggaran API model perlu pelacakan tingkat token, bukan perkiraan bulanan.
- Tarif jam sibuk dan di luar jam sibuk dapat mengarahkan permintaan tanpa memblokir pengguna.
- Cache hit, cache miss, dan panjang output kini menjadi masukan desain produk.
Langkah V4 Pro menunjukkan bagaimana akses AI murah dapat berkembang menjadi penetapan harga yang sadar sumber daya ketika penggunaan bertemu dengan komputasi yang terbatas.
Langkah V4 Pro menunjukkan bagaimana akses AI murah dapat berkembang menjadi penetapan harga yang sadar sumber daya begitu penggunaan bertemu dengan komputasi yang langka.
Harga API murah adalah taktik akuisisi pelanggan yang luar biasa, sampai tagihannya mulai terdengar seperti alarm asap. DeepSeek V4 Pro telah mencapai momen dewasa yang canggung: API-nya tidak lagi sekadar dijual sebagai akses murah ke model yang mumpuni, melainkan dihargai seperti infrastruktur bersama pada jam sibuk. Kenaikan empat kali lipat adalah tajuk utamanya. Pembagian jam puncak dan nonpuncak adalah pelajaran produknya.
Peluncuran ini adalah arsitektur harga Reuters melaporkan bahwa DeepSeek
menaikkan harga API untuk model V4-nya, dan Channel Insider menggambarkan kenaikan API V4 tersebut lebih dari empat kali lipat. Menurut DeepSeek API Docs, harga V4 Pro kini dibagi antara tarif nonpuncak dan puncak, dengan jam nonpuncak berbiaya setengah dari harga jam puncak. DeepSeek mencantumkan V4 Pro seharga $0,022 untuk input cache hit, $0,66 untuk input cache miss, dan $1,98 untuk output per 1 juta token pada harga nonpuncak, naik menjadi $0,044, $1,32, dan $3,96 pada harga puncak. V4 Flash mengikuti struktur yang sama pada $0,007, $0,22, dan $0,66 saat nonpuncak, lalu $0,014, $0,44, dan $1,32 saat puncak. DeepSeek API Docs juga menyebutkan dua model API V4: deepseek-v4-flash yang melayani DeepSeek-V4-Flash-0731, dan deepseek-v4-pro yang melayani DeepSeek-V4-Pro-0813. Keduanya menggunakan panjang konteks 1 juta dan output maksimum 384 ribu, menurut dokumentasi yang sama. Pembagian yang menarik adalah konkurensi: DeepSeek mencantumkan batas konkurensi 2500 untuk V4 Flash dan 500 untuk V4 Pro. Itulah lini produk dalam bentuk mini, satu jalur untuk throughput, jalur lain untuk kemampuan yang lebih berat. Kesenjangan konkurensi itu adalah petunjuknya. Halaman harga biasanya berpura-pura menjadi dokumen akuntansi, tetapi yang bagus sebenarnya adalah sistem pengatur lalu lintas. Halaman ini memberi tahu developer bahwa kapasitas premium tidak tak terbatas dan bahwa perusahaan ingin penggunaan berpindah ke jam yang lebih murah bila memungkinkan.
Mengapa V4 Pro bisa meminta harga lebih tinggi Artificial Analysis menggambarkan
DeepSeek V4 Pro (Reasoning, Max Effort) sebagai model open weights yang dirilis pada April 2026. Model ini mencetak skor 45 pada Artificial Analysis Intelligence Index, dibandingkan dengan median 26 di antara model yang sebanding, dan situs tersebut mengatakan model ini mendukung input teks, output teks, serta jendela konteks 1 juta token. Ini membantu menjelaskan mengapa DeepSeek dapat menguji batas harga yang lebih tinggi tanpa sepenuhnya meninggalkan posisi penantangnya. Jika modelnya secara nyata lebih kuat, percakapan harga bergeser dari token termurah menjadi token yang berguna. Masalahnya adalah keluasan jawaban. Artificial Analysis mengatakan DeepSeek V4 Pro menghasilkan 180 juta token dalam evaluasi Intelligence Index-nya, dibandingkan dengan median 99 juta, dan memberi label model tersebut sangat bertele-tele. Dalam ekonomi API, itu bukan catatan kaki, melainkan meteran yang terus berputar. Model yang bernalar dengan baik tetapi banyak bicara dapat mengubah batas output yang murah hati menjadi kejutan biaya bagi pelanggan yang tidak mengukur prompt, completion, dan retry.
Efek urutan kedua bersifat perilaku DeepSeek
API Docs mengatakan penagihan didasarkan pada jumlah total token input dan output, dengan input dibagi menjadi kategori cache hit dan cache miss. Perbedaan itu menjadi lebih penting di bawah struktur baru karena jalur yang mahal bukan hanya menggunakan V4 Pro, melainkan menggunakan V4 Pro saat puncak, tidak mengenai cache, dan menghasilkan respons panjang. Halaman harga ini seperti Choose Your Own Adventure, dengan akhir yang mahal dimulai dari prompt yang tidak ter-cache dan output yang bertele-tele. Langkah cerdas bagi builder adalah memperlakukan caching dan panjang respons sebagai persyaratan produk, bukan tugas bersih-bersih. Harga puncak dan nonpuncak juga mengubah percakapan dengan pelanggan. Harga API datar mengundang tim untuk bertanya apakah sebuah model cukup murah. Harga berbasis waktu bertanya apakah beban kerja itu cukup mendesak. Evaluasi batch, analisis internal, dan pekerjaan noninteraktif sering kali dapat dipindahkan ke jendela waktu yang lebih murah, sementara alur yang menghadap pengguna mungkin membenarkan tarif puncak jika latensi penting. Itu adalah model yang lebih jujur untuk infrastruktur yang langka daripada berpura-pura setiap token datang dengan profil biaya yang sama.
Apa yang harus ditiru builder, dan
apa yang harus diperhatikan pelanggan Reuters dan Channel Insider membingkai perubahan ini sebagai kenaikan harga, dan itu benar, tetapi pembacaan yang lebih berguna adalah bahwa DeepSeek sedang bergerak dari harga untuk adopsi menuju harga yang sadar sumber daya. Bagi founder dan pemimpin produk, pelajarannya sederhana: jika harga rendah adalah wedge Anda, putuskan sejak awal apa yang terjadi ketika penggunaan menjadi nyata. Jika jawabannya adalah kejutan tagihan empat kali lipat yang tiba-tiba, pelanggan akan merasa disergap. Jika jawabannya adalah tangga yang terlihat jelas berisi kontrol cache, waktu, dan output, pelanggan dapat membuat rencana. Bagi pelanggan, sprint berikutnya sebaiknya mencakup observabilitas biaya di tingkat token. Lacak tingkat cache hit, tingkat cache miss, panjang output, penggunaan puncak, dan fitur mana yang benar-benar membutuhkan V4 Pro alih-alih V4 Flash. Langkah logis berikutnya dari DeepSeek belum tentu perubahan harga lain. Perhatikan apakah dokumentasi resmi berkembang menuju kontrol anggaran yang lebih jelas, panduan caching, dan pola penjadwalan yang membuat arsitektur harga baru lebih mudah dioperasionalkan.