AI

DeepSeek Rilis V4 Preview Open Source dengan Konteks 1 Juta Token

DeepSeek meluncurkan DeepSeek-V4 Preview secara resmi dan open source, menghadirkan dua varian model dengan konteks 1 juta token.

Oleh Tim Editorial

DeepSeek Rilis V4 Preview Open Source dengan Konteks 1 Juta Token
notebookcheck-cn.com

DeepSeek mengumumkan peluncuran resmi DeepSeek V4 Preview yang kini tersedia secara open source. Pengumuman ini disampaikan melalui akun X resmi @deepseek ai yang menyebut era baru konteks 1 juta token yang hemat biaya telah dimulai. Model ini dapat dicoba langsung melalui chat.deepseek.com dengan mode Expert Mode atau Instant Mode, sementara API sudah diperbarui dan tersedia pada hari yang sama. DeepSeek V4 hadir dalam dua varian utama. Varian pertama adalah DeepSeek V4 Pro dengan total parameter 1,6 triliun dan 49 miliar parameter aktif. Varian ini diklaim memiliki performa yang menyaingi model closed source terbaik dunia. Varian kedua adalah DeepSeek V4 Flash dengan total parameter 284 miliar dan 13 miliar parameter aktif, yang diposisikan sebagai pilihan cepat, efisien, dan ekonomis.

Kedua varian ini menggunakan arsitektur Mixture of Experts (MoE) yang memungkinkan hanya sebagian parameter yang aktif saat memproses setiap permintaan. Pendekatan ini menjadi kunci efisiensi biaya karena tidak semua parameter perlu dihitung untuk setiap tugas, berbeda dengan model dense yang mengaktifkan seluruh parameternya. Dengan 49 miliar parameter aktif dari total 1,6 triliun, DeepSeek V4 Pro dirancang untuk menekan biaya komputasi sambil mempertahankan kapasitas pengetahuan yang besar. Kemampuan konteks 1 juta token menjadi fitur utama yang diusung DeepSeek V4 Preview. Kapasitas ini memungkinkan model memproses dokumen yang sangat panjang dalam satu sesi, seperti buku utuh, basis kode besar, atau transkrip percakapan panjang. DeepSeek menyebut era ini sebagai era konteks 1 juta token yang hemat biaya, menekankan bahwa kapasitas besar tersebut tidak harus datang dengan biaya operasional yang mahal.

Dokumen teknis lengkap untuk DeepSeek V4 Pro telah dipublikasikan melalui Hugging Face dalam bentuk PDF, sementara bobot model terbuka (open weights) tersedia dalam koleksi resmi di platform yang sama. Langkah ini konsisten dengan pendekatan DeepSeek sebelumnya yang membuka akses ke model dan dokumentasi teknisnya untuk komunitas peneliti dan pengembang. Peluncuran ini terjadi di tengah persaingan ketat industri model bahasa besar yang didominasi pemain seperti OpenAI, Google, dan Anthropic. Strategi open source yang dijalankan DeepSeek memberikan alternatif bagi pengembang yang ingin mengontrol penuh model mereka tanpa terikat pada API proprietary. Ketersediaan open weights memungkinkan pengembang melakukan fine tuning dan deployment di infrastruktur mereka sendiri. Dari sisi pasar, peluncuran model dengan klaim performa menyaingi model closed source terbaik dunia berpotensi menekan harga layanan AI.

Model open source dengan biaya inferensi rendah kerap menjadi pertimbangan perusahaan yang ingin memangkas pengeluaran cloud AI. Newsletter aigc.news menyoroti bahwa peluncuran DeepSeek V4 diikuti pemotongan harga dua kali berturut turut, yang mengindikasikan strategi penetapan harga agresif untuk merebut pangsa pasar. Dokumentasi API DeepSeek mengonfirmasi ketersediaan model ini untuk pengembang melalui pembaruan API yang berlaku hari ini. Pengembang dapat mengakses DeepSeek V4 Pro dan DeepSeek V4 Flash melalui endpoint API yang sama dengan model sebelumnya, dengan parameter konteks yang diperluas hingga 1 juta token. Ini menjadi nilai tambah bagi aplikasi yang membutuhkan pemrosesan dokumen panjang seperti analisis legal, riset akademik, dan analisis kode. Keputusan DeepSeek untuk merilis model dalam status Preview menunjukkan bahwa pengembangan masih berlanjut dan versi final dapat hadir dengan penyempurnaan lebih lanjut.

Status preview juga memberi ruang bagi DeepSeek untuk mengumpulkan umpan balik dari pengguna awal sebelum menetapkan versi stabil. Sementara itu, ketersediaan dua varian dengan ukuran berbeda memberi fleksibilitas bagi pengguna untuk memilih antara performa maksimal dan efisiensi biaya sesuai kebutuhan. Persaingan model open source semakin memanas dengan kehadiran DeepSeek V4. Model dengan total parameter 1,6 triliun menempatkan DeepSeek di jajaran model berskala sangat besar, sementara pendekatan parameter aktif yang relatif kecil menunjukkan fokus pada efisiensi komputasi. Kombinasi skala besar dan biaya operasional rendah menjadi nilai jual utama yang ditawarkan DeepSeek kepada pasar. Langkah DeepSeek membuka sumber model dan mempublikasikan laporan teknis secara bersamaan menunjukkan komitmen terhadap transparansi riset. Ini berbeda dengan pendekatan beberapa kompetitor yang menjaga detail arsitektur model mereka tetap tertutup.

Keterbukaan ini memungkinkan komunitas riset memvalidasi klaim performa dan mengeksplorasi pengembangan lebih lanjut di atas fondasi yang disediakan DeepSeek. Dengan API yang langsung tersedia dan model yang bisa dicoba gratis di platform chat, DeepSeek menargetkan adopsi cepat dari pengembang dan perusahaan. Kombinasi open weights, dokumentasi teknis, dan akses API langsung memberikan tiga jalur berbeda bagi pengguna untuk mengadopsi teknologi ini. Strategi ini dirancang untuk memperluas basis pengguna sekaligus membangun ekosistem di sekitar model DeepSeek V4.

Sumber dan referensi