
DeepSeek V4 Flash is an efficiency-optimized Mixture-of-Experts model from DeepSeek with 284B total parameters and 13B activated parameters, supporting a 1M-token context window. It is designed for fast inference and high-throughput workloads, while maintaining strong reasoning and coding performance.

DeepSeek V4 Pro is a large-scale Mixture-of-Experts model from DeepSeek with 1.6T total parameters and 49B activated parameters, supporting a 1M-token context window. It is designed for advanced reasoning, coding, and long-horizon agent workflows, with strong performance across knowledge, math, and software engineering benchmarks.

DeepSeek-OCR 2 is a model released by DeepSeek on January 27, 2026, using the innovative DeepEncoder V2 method, which allows AI to dynamically rearrange parts of an image based on its meaning, rather than just mechanically scanning from left to right. While maintaining high data compression efficiency, the model has achieved significant breakthroughs in multiple benchmarks and production metrics. The model can cover complex document pages with only 256 to 1120 vision tokens, achieving an overall score of 91.09% in the OmniDocBench v1.5 evaluation

DeepSeek v3.2 adalah rilis produksi terbaru dalam keluarga DeepSeek V3: sebuah keluarga model bahasa berskala besar dengan bobot terbuka yang mengutamakan penalaran, dirancang untuk pemahaman konteks panjang, penggunaan agen/alat yang andal, penalaran tingkat lanjut, serta pemrograman dan matematika.
deepseek-r2 coming soon
DeepSeek-OCR adalah model pengenalan karakter optik (OCR) untuk mengekstrak teks dari gambar dan dokumen. Ini memproses halaman hasil pemindaian, foto, dan tangkapan layar antarmuka pengguna untuk menghasilkan transkripsi dengan petunjuk tata letak seperti pemisah baris. Penggunaan umum mencakup digitalisasi dokumen, pemasukan faktur dan kuitansi, pengindeksan pencarian, serta memungkinkan alur kerja RPA. Sorotan teknis mencakup pemrosesan gambar-ke-teks, dukungan untuk konten hasil pemindaian dan pemotretan, serta keluaran teks terstruktur untuk penguraian lanjutan di tahap hilir.
Model DeepSeek-V3 yang paling populer dan hemat biaya. Versi 671B performa penuh. Model ini mendukung panjang konteks maksimum 64,000 token.
Model generasi teks Mixture of Experts dengan 671B parameter, hasil penggabungan R1-0528, R1, dan V3-0324 dari DeepSeek-AI, mendukung konteks hingga 60k token.
DeepSeek-Reasoner adalah keluarga LLM dan endpoint API milik DeepSeek yang mengutamakan penalaran, dirancang untuk (1) mengungkapkan penalaran chain-of-thought (CoT) internal kepada pemanggil dan (2) beroperasi dalam mode "thinking" yang disetel untuk perencanaan multi-langkah, matematika, pemrograman, serta penggunaan agen/alat.
Model DeepSeek-V3 yang paling populer dan hemat biaya. Versi 671B penuh. Model ini mendukung panjang konteks maksimum 64,000 token.
DeepSeek V3.1 adalah peningkatan pada seri V DeepSeek: model bahasa besar hibrida “thinking / non-thinking” yang ditujukan untuk kecerdasan umum dengan throughput tinggi dan biaya rendah serta penggunaan alat yang bersifat agen. Ini mempertahankan kompatibilitas API bergaya OpenAI, menambahkan pemanggilan alat yang lebih cerdas, dan—menurut perusahaan—menghadirkan generasi yang lebih cepat serta keandalan agen yang lebih baik.