Status API DeepSeek V4.1 Flash: Pengujian, Harga, dan Akses
Status terkini DeepSeek V4.1 Flash: ID model sementara, harga API, ketersediaan, dan informasi utama sebelum integrasi.
Published 2026-09-08
DeepSeek V4.1 Flash memasuki pengujian terbatas pada 8 September 2026. ID model sementaranya adalah deepseek-v4.1-flash-expires-on-0910. Pengembang DeepSeek yang sudah ada dapat mempertahankan base URL mereka, menggunakan ID model baru, dan mengirim hingga 20 permintaan bersamaan per akun. Penagihan saat ini mengikuti harga V4 Flash. Contoh dari komunitas mencapai 300-507 token output/detik, tetapi ini adalah pengamatan individual, bukan tolok ukur APIMaster atau kecepatan layanan yang dijamin.
Di APIMaster, kami melihat rilis ini sebagai peluang yang berguna untuk mengevaluasi respons model yang lebih cepat, alur kerja multimodal, dan biaya API secara bersamaan. Per pemeriksaan katalog publik kami pada 8 September, APIMaster mencantumkan V4 Flash, V4 Pro, dan V4 Flash Vision Exp; ID pratinjau V4.1 Flash tidak tercantum. Anda dapat membuat akun APIMaster untuk memulai dengan model DeepSeek yang tersedia dan membandingkan opsi saat ini di marketplace model kami.
Status model saat ini
| Item | Status saat ini |
|---|---|
| Status upstream | Pengujian terbatas |
| ID model sementara | deepseek-v4.1-flash-expires-on-0910 |
| Akses upstream | Pertahankan base URL DeepSeek yang ada dan gunakan ID sementara |
| Batas konkurensi | Hingga 20 permintaan per akun |
| Status APIMaster | Model sementara ini belum terdaftar saat ini |
| Alternatif tersedia | deepseek-v4-flash, deepseek-v4-pro, deepseek-v4-flash-vision-exp |
| Langkah berikutnya | Periksa marketplace langsung atau gunakan penguji API DeepSeek dengan model yang tersedia |
Halaman ini akan diperbarui ketika rilis produksi, parameter API, atau ketersediaan di APIMaster berubah.
Apa yang baru di DeepSeek V4.1 Flash?
Laporan 8 September tersebut mendeskripsikan versi antara V4.1 Flash yang menggunakan arsitektur model baru, dengan dukungan multimodal native, kemampuan yang lebih kuat, respons yang lebih cepat, dan biaya yang lebih rendah. Ini adalah rilis pengujian awal, jadi klaim tersebut harus dibaca dalam konteks itu.
Bagi pengembang, kombinasi yang menarik adalah kemampuan yang lebih besar dengan harga API publik yang sama. Biaya model internal yang lebih rendah tidak otomatis berarti tagihan pelanggan yang lebih rendah: pratinjau saat ini ditagih dengan tarif V4 Flash.
Laporan tersebut tidak merinci jendela konteks, panjang output maksimum, format gambar yang didukung, antarmuka audio atau video, atau skor evaluasi terperinci. Multimodalitas native saja tidak menetapkan dukungan untuk setiap jenis media. Kami akan memeriksa antarmuka aktual dan menguji input representatif sebelum merancang aplikasi berdasarkan kemampuan tersebut.
Seberapa cepat? Memahami laporan 507 token/detik
Zhidx mengutip pengembang yang memposting pengalaman mereka di X. Satu pengembang melaporkan kecepatan output puncak 507 token/detik. Pengembang lain memperoleh 328 token/detik saat menghasilkan halaman HTML yang berisi animasi SVG burung pelikan yang mengendarai sepeda; pengembang terpisah melaporkan rata-rata di atas 300 token/detik pada tugas serupa.
Ini menjanjikan untuk pembuatan kode, respons panjang, dan asisten interaktif. Ini belum menjadi perbandingan terkontrol: artikel tersebut tidak menyediakan metode pengukuran bersama, pengaturan permintaan lengkap, atau distribusi hasil yang dapat diulang.
Di APIMaster, kami merekomendasikan untuk melihat tiga pengukuran secara bersamaan:
| Pengukuran | Apa yang diinformasikan |
|---|---|
| Waktu hingga token pertama | Berapa lama pengguna menunggu sebelum respons dimulai |
| Token output per detik | Seberapa cepat jawaban tiba setelah generasi dimulai |
| Total waktu penyelesaian dan kebenaran | Apakah seluruh tugas selesai dengan cepat dan menghasilkan hasil yang dapat digunakan |
Ilustrasi, bukan tolok ukur: jawaban 1.000 token pada 300 token/detik yang berkelanjutan membutuhkan sekitar 3,3 detik generasi output. Pada 507 token/detik, dibutuhkan sekitar 2,0 detik. Kedua perhitungan tidak termasuk antrean, pemrosesan awal, waktu penalaran, atau penundaan jaringan. Streaming yang lebih cepat sangat berharga, tetapi itu sendiri tidak membuktikan alur kerja lengkap yang lebih cepat atau lebih akurat.
Harga API DeepSeek V4.1 Flash
Laporan tersebut menyatakan pratinjau menggunakan harga yang sama dengan DeepSeek V4 Flash. Semua jumlah di bawah ini adalah yuan Tiongkok (CNY/RMB) per satu juta token, bukan dolar AS dan bukan harga rute APIMaster.
| Jenis token | Harga di luar jam sibuk (CNY / 1M token) | Harga jam sibuk (CNY / 1M token) |
|---|---|---|
| Input cache-hit | 0,05 | 0,10 |
| Input cache-miss | 1,50 | 3,00 |
| Output | 4,50 | 9,00 |
Contoh biaya: 1 juta token input cache-miss ditambah 1 juta token output akan dikenakan biaya CNY 6 di luar jam sibuk atau CNY 12 pada tarif jam sibuk, menggunakan harga yang dilaporkan. Contoh tersebut tidak termasuk penggunaan lain dan mengasumsikan semua input adalah cache miss.
Laporan yang diberikan tidak mendefinisikan jadwal jam sibuk atau zona waktunya. Periksa dokumentasi penagihan DeepSeek saat ini sebelum menjadwalkan beban kerja. Untuk penggunaan APIMaster, konsultasikan model langsung dan harga rute yang ditampilkan di marketplace; tabel upstream di atas bukanlah penawaran untuk layanan kami.
Cara mengakses pratinjau, dan apa arti 0910?
Untuk pengembang yang memenuhi syarat yang menggunakan API DeepSeek sendiri, perubahan yang dilaporkan cukup sederhana:
model = deepseek-v4.1-flash-expires-on-0910
base_url = keep your existing DeepSeek base URL
account concurrency limit = 20
Instruksi ini berlaku untuk pratinjau DeepSeek upstream. Ini tidak menetapkan ketersediaan melalui setiap gateway pihak ketiga, dan batas 20 permintaan bukanlah batas akun APIMaster yang dipublikasikan.
Nama model menunjukkan kedaluwarsa pada 10 September 2026. Zhidx menyimpulkan tanggal penonaktifan dari nama tersebut; teks yang diberikan tidak menyatakan waktu pasti atau zona waktu. Perlakukan pengidentifikasi sebagai sementara dan konfirmasikan pemberitahuan upstream saat ini sebelum mengandalkannya.
Kami merekomendasikan untuk menjaga nama model tetap dapat dikonfigurasi, mengevaluasi serangkaian kecil tugas nyata, dan mempertahankan alternatif yang telah diuji. Setelah periode pratinjau, gunakan pengidentifikasi yang didukung saat ini alih-alih mengasumsikan model expires-on-0910 akan tetap tersedia atau otomatis dipetakan ke penerusnya.
Di mana posisinya dalam rilis DeepSeek baru-baru ini
Laporan tersebut menempatkan V4.1 Flash dalam rangkaian pembaruan model dan alat pengembang yang cepat:
| Tanggal di 2026 | Pembaruan yang dilaporkan oleh Zhidx |
|---|---|
| 31 Juli | API versi produksi V4 Flash memasuki pengujian publik |
| 13 Agustus | API versi produksi V4 Pro dirilis; pratinjau pengembang DeepSeek Harness v0.1 memasuki pengujian publik dan diopen-source |
| 19 Agustus | DeepSeek Harness diperbarui ke v0.1.0-rc.8 |
| 21 Agustus | V4 Flash Vision Exp diluncurkan di platform API |
| 31 Agustus | V4 Flash Vision Exp diopen-source |
| 8 September | Versi antara V4.1 Flash memasuki pengujian terbatas |

Repositori GitHub DeepSeek Harness. Ini bukan uji kecepatan V4.1 Flash.
Dari perspektif kami, kesimpulan praktisnya adalah pengembang kini memiliki beberapa hal berbeda untuk dievaluasi: Flash untuk beban kerja teks, Pro sebagai opsi model lain, Vision Exp untuk tugas terkait gambar, dan pratinjau sementara baru untuk eksperimen awal. Linimasa rilis menunjukkan pengembangan yang berkelanjutan; ini tidak mengonfirmasi tanggal untuk rilis final V4.1.
Mulai menggunakan DeepSeek dengan APIMaster
Mengikuti rilis model baru harus mengarah pada sesuatu yang dapat Anda bangun. APIMaster menyatukan DeepSeek dan keluarga model lainnya ke dalam satu konsol dan API yang kompatibel dengan OpenAI, sehingga Anda dapat membandingkan model yang didukung tanpa memelihara integrasi terpisah untuk setiap penyedia.
Pemeriksaan katalog publik kami pada 8 September 2026 mengembalikan deepseek-v4-flash, deepseek-v4-pro, dan deepseek-v4-flash-vision-exp. Pengidentifikasi sementara deepseek-v4.1-flash-expires-on-0910 tidak ada dalam hasil tersebut. Periksa marketplace langsung untuk ketersediaan dan harga saat ini sebelum memilih model.
Untuk memulai:
- Daftar untuk APIMaster.
- Pilih model yang tersedia dan tinjau harga serta antarmuka yang didukung saat ini.
- Buka konsol, tambahkan kredit sesuai kebutuhan, dan buat kunci API Anda.
- Konfigurasikan aplikasi Anda dengan base URL APIMaster dan ID model yang dipilih.
- Kirim permintaan kecil, periksa hasil dan penggunaan, lalu skalakan ke beban kerja Anda.
Berikut contoh teks menggunakan V4 Flash yang saat ini tercantum, bukan pratinjau sementara:
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["APIMASTER_API_KEY"],
base_url="https://apimaster.ai/v1",
)
response = client.chat.completions.create(
model="deepseek-v4-flash",
messages=[
{"role": "user", "content": "Write a Python function that validates an email address."}
],
)
print(response.choices[0].message.content)
Untuk detail pengaturan, baca panduan API DeepSeek dan panduan kunci API kami. Anda juga dapat menggunakan penguji API DeepSeek untuk memeriksa konektivitas dan respons. Tes konektivitas yang berhasil tidak dengan sendirinya memverifikasi identitas model atau menetapkan tolok ukur kinerja.
FAQ
Apa ID model pratinjau DeepSeek V4.1 Flash?
Pengidentifikasi yang dilaporkan adalah deepseek-v4.1-flash-expires-on-0910. Ini milik rilis pengujian antara sementara yang diumumkan dalam laporan 8 September 2026.
Apakah V4.1 Flash lebih murah daripada V4 Flash?
Harga API pratinjau saat ini sama dengan V4 Flash menurut laporan tersebut. Input cache-miss di luar jam sibuk berbiaya CNY 1,50 per juta token dan output CNY 4,50; harga jam sibuk masing-masing CNY 3,00 dan CNY 9,00. Ini adalah harga upstream yang dilaporkan, bukan penawaran APIMaster.
Apakah DeepSeek V4.1 Flash menjamin 507 token/detik?
Tidak. Angka 507 token/detik adalah hasil komunitas individual yang dikutip oleh Zhidx. APIMaster tidak menyajikan tolok ukur V4.1 Flash independen dalam artikel ini, dan kinerja aktual bergantung pada pengaturan permintaan, beban kerja, dan kondisi layanan.
Apakah pratinjau V4.1 Flash tersedia di APIMaster?
Itu tidak tercantum dalam pemeriksaan katalog publik kami pada 8 September 2026. V4 Flash, V4 Pro, dan V4 Flash Vision Exp tercantum. Konsultasikan marketplace langsung untuk perubahan ketersediaan berikutnya.
Kapan model sementara kedaluwarsa?
Nama tersebut menunjukkan 10 September 2026. Laporan yang diberikan menyimpulkan tanggal tersebut dari ID model dan tidak memberikan waktu pasti atau zona waktu. Konfirmasikan pemberitahuan DeepSeek saat ini dan siapkan model alternatif.
Ubah berita model menjadi proyek Anda berikutnya
Pratinjau V4.1 Flash layak diikuti karena kecepatan dan arah multimodalnya yang dilaporkan. Untuk pekerjaan yang ingin Anda mulai hari ini, pilih model yang tersedia saat ini, ukur hasil pada tugas Anda sendiri, dan bangun dari sana.
Buat akun APIMaster Anda untuk menjelajahi DeepSeek dan model lain yang didukung, membandingkan harga API saat ini, dan membuat permintaan pertama Anda melalui satu antarmuka yang familiar.
Bandingkan rute dengan diskon dan bayar sesuai pemakaian; penghematan bergantung pada model dan rute yang Anda pilih.