
DeepSeek V4 Flash is an efficiency-optimized Mixture-of-Experts model from DeepSeek with 284B total parameters and 13B activated parameters, supporting a 1M-token context window. It is designed for fast inference and high-throughput workloads, while maintaining strong reasoning and coding performance.

DeepSeek V4 Pro is a large-scale Mixture-of-Experts model from DeepSeek with 1.6T total parameters and 49B activated parameters, supporting a 1M-token context window. It is designed for advanced reasoning, coding, and long-horizon agent workflows, with strong performance across knowledge, math, and software engineering benchmarks.

DeepSeek-OCR 2 is a model released by DeepSeek on January 27, 2026, using the innovative DeepEncoder V2 method, which allows AI to dynamically rearrange parts of an image based on its meaning, rather than just mechanically scanning from left to right. While maintaining high data compression efficiency, the model has achieved significant breakthroughs in multiple benchmarks and production metrics. The model can cover complex document pages with only 256 to 1120 vision tokens, achieving an overall score of 91.09% in the OmniDocBench v1.5 evaluation

DeepSeek v3.2 to najnowsze wydanie produkcyjne w rodzinie DeepSeek V3: wielkoskalowa, zorientowana na rozumowanie rodzina modeli językowych z otwartymi wagami, zaprojektowana do rozumienia długiego kontekstu, niezawodnego wykorzystania agentów i narzędzi, zaawansowanego rozumowania, programowania i matematyki.
deepseek-r2 coming soon
DeepSeek-OCR to model optycznego rozpoznawania znaków (OCR) do wyodrębniania tekstu z obrazów i dokumentów. Przetwarza zeskanowane strony, zdjęcia oraz zrzuty ekranu interfejsu użytkownika (UI), aby tworzyć transkrypcje z informacjami o układzie, takimi jak podziały wierszy. Typowe zastosowania obejmują digitalizację dokumentów, przyjmowanie i wprowadzanie faktur oraz paragonów, indeksowanie na potrzeby wyszukiwania oraz wspieranie potoków RPA. Do najważniejszych aspektów technicznych należą przetwarzanie obrazu na tekst, obsługa treści skanowanych i fotografowanych oraz ustrukturyzowany wynik tekstowy do parsowania na dalszym etapie.
Najpopularniejszy i najbardziej opłacalny model DeepSeek-V3. Pełnokrwista wersja 671B. Ten model obsługuje maksymalną długość kontekstu wynoszącą 64,000 tokenów.
Model generowania tekstu typu Mixture of Experts o 671B parametrach, scalony z R1-0528, R1 i V3-0324 firmy DeepSeek-AI, obsługujący do 60k tokenów kontekstu.
DeepSeek-Reasoner to rodzina modeli LLM i punktów końcowych API firmy DeepSeek, stawiająca na rozumowanie w pierwszej kolejności, zaprojektowana tak, aby (1) udostępniać klientom wewnętrzny łańcuch rozumowania (CoT) oraz (2) działać w trybach „myślenia” dostrojonych do wieloetapowego planowania, matematyki, programowania i korzystania z agentów/narzędzi.
Najpopularniejszy i najbardziej opłacalny model DeepSeek-V3. Pełna wersja 671B. Ten model obsługuje maksymalną długość kontekstu 64,000 tokenów.
DeepSeek V3.1 to aktualizacja w serii V firmy DeepSeek: hybrydowy, „thinking / non-thinking” duży model językowy ukierunkowany na wysokoprzepustową, niskokosztową inteligencję ogólną oraz agentowe korzystanie z narzędzi. Zachowuje zgodność z API w stylu OpenAI, dodaje inteligentniejsze wywoływanie narzędzi i—według firmy—zapewnia szybsze generowanie oraz większą niezawodność agentów.