
DeepSeek V4 Flash is an efficiency-optimized Mixture-of-Experts model from DeepSeek with 284B total parameters and 13B activated parameters, supporting a 1M-token context window. It is designed for fast inference and high-throughput workloads, while maintaining strong reasoning and coding performance.

DeepSeek V4 Pro is a large-scale Mixture-of-Experts model from DeepSeek with 1.6T total parameters and 49B activated parameters, supporting a 1M-token context window. It is designed for advanced reasoning, coding, and long-horizon agent workflows, with strong performance across knowledge, math, and software engineering benchmarks.

DeepSeek-OCR 2 is a model released by DeepSeek on January 27, 2026, using the innovative DeepEncoder V2 method, which allows AI to dynamically rearrange parts of an image based on its meaning, rather than just mechanically scanning from left to right. While maintaining high data compression efficiency, the model has achieved significant breakthroughs in multiple benchmarks and production metrics. The model can cover complex document pages with only 256 to 1120 vision tokens, achieving an overall score of 91.09% in the OmniDocBench v1.5 evaluation

DeepSeek v3.2 ialah keluaran produksi terkini dalam keluarga DeepSeek V3: sebuah keluarga model bahasa open-weight berskala besar yang mengutamakan penaakulan, direka untuk pemahaman konteks panjang, penggunaan agen/alatan yang mantap, penaakulan lanjutan, pengaturcaraan dan matematik.
deepseek-r2 coming soon
DeepSeek-OCR ialah model pengecaman aksara optik untuk mengekstrak teks daripada imej dan dokumen. Ia memproses halaman yang diimbas, foto dan tangkapan skrin UI untuk menghasilkan transkripsi dengan petunjuk susun atur seperti pecahan baris. Penggunaan biasa termasuk pendigitalan dokumen, kemasukan invois dan resit, pengindeksan carian, serta mendayakan aliran kerja RPA. Sorotan teknikal termasuk pemprosesan imej-ke-teks, sokongan untuk kandungan yang diimbas dan difoto, serta output teks berstruktur untuk penghuraian hiliran.
Model DeepSeek-V3 yang paling popular dan berkesan dari segi kos. Versi penuh 671B. Model ini menyokong panjang konteks sehingga 64,000 token.
Model penjanaan teks Mixture of Experts dengan 671B parameter, digabungkan daripada R1-0528, R1, dan V3-0324 milik DeepSeek-AI, menyokong sehingga 60k token konteks.
DeepSeek-Reasoner ialah keluarga LLM dan endpoint API yang mengutamakan penaakulan milik DeepSeek, yang direka untuk (1) mendedahkan penaakulan rantai pemikiran (CoT) dalaman kepada pemanggil dan (2) beroperasi dalam mod โthinkingโ yang ditala khas untuk perancangan berbilang langkah, matematik, pengekodan serta penggunaan agen/alatan.
Model DeepSeek-V3 yang paling popular dan paling menjimatkan kos. Versi penuh 671B. Model ini menyokong panjang konteks maksimum sebanyak 64,000 token.
DeepSeek V3.1 ialah naik taraf dalam V-series DeepSeek: model bahasa besar hibrid 'berfikir / tidak berfikir' yang disasarkan untuk kecerdasan am berkadar pemprosesan tinggi, berkos rendah serta penggunaan alat berasaskan agen. Ia mengekalkan keserasian API gaya OpenAI, menambah pemanggilan alat yang lebih pintar, danโmenurut syarikatโmembawakan penjanaan yang lebih pantas serta kebolehpercayaan agen yang dipertingkat.