
DeepSeek V4 Flash is an efficiency-optimized Mixture-of-Experts model from DeepSeek with 284B total parameters and 13B activated parameters, supporting a 1M-token context window. It is designed for fast inference and high-throughput workloads, while maintaining strong reasoning and coding performance.

DeepSeek V4 Pro is a large-scale Mixture-of-Experts model from DeepSeek with 1.6T total parameters and 49B activated parameters, supporting a 1M-token context window. It is designed for advanced reasoning, coding, and long-horizon agent workflows, with strong performance across knowledge, math, and software engineering benchmarks.

DeepSeek-OCR 2 is a model released by DeepSeek on January 27, 2026, using the innovative DeepEncoder V2 method, which allows AI to dynamically rearrange parts of an image based on its meaning, rather than just mechanically scanning from left to right. While maintaining high data compression efficiency, the model has achieved significant breakthroughs in multiple benchmarks and production metrics. The model can cover complex document pages with only 256 to 1120 vision tokens, achieving an overall score of 91.09% in the OmniDocBench v1.5 evaluation

DeepSeek v3.2 — последний продакшен-релиз в семействе DeepSeek V3: большое семейство языковых моделей с открытыми весами, в первую очередь ориентированное на рассуждение, разработанное для понимания длинного контекста, надёжного использования агентов и инструментов, продвинутого рассуждения, программирования и математики.
deepseek-r2 coming soon
DeepSeek-OCR — это модель оптического распознавания символов для извлечения текста из изображений и документов. Она обрабатывает сканированные страницы, фотографии и скриншоты интерфейса, формируя распознанный текст со структурными метками, например разрывами строк. Типичные сценарии использования включают оцифровку документов, прием и обработку счетов и квитанций, поисковую индексацию и поддержку конвейеров RPA. Ключевые технические возможности включают преобразование изображений в текст, поддержку сканированного и сфотографированного контента, а также структурированный вывод текста для последующего разбора.
Самая популярная и выгодная по соотношению цена/качество модель DeepSeek-V3. Полноценная версия 671B. Эта модель поддерживает максимальную длину контекста 64,000 токенов.
Модель генерации текста Mixture of Experts на 671B параметров, объединённая из R1-0528, R1 и V3-0324 от DeepSeek-AI, поддерживающая контекст до 60k токенов.
DeepSeek-Reasoner — это ориентированное на рассуждения семейство LLM и конечных точек API от DeepSeek, предназначенное для (1) предоставления клиентам доступа к внутренней цепочке рассуждений (CoT) и (2) работы в «thinking»-режимах, настроенных для многошагового планирования, математики, программирования и использования агентов/инструментов.
Самая популярная и наиболее выгодная модель DeepSeek-V3. Полноценная версия 671B. Эта модель поддерживает максимальную длину контекста 64,000 токенов.
DeepSeek V3.1 — обновление в V-серии DeepSeek: гибридная большая языковая модель с режимами «с рассуждениями / без рассуждений», ориентированная на высокую пропускную способность и низкую стоимость в задачах общего интеллекта и агентного использования инструментов. Она сохраняет совместимость API в стиле OpenAI, добавляет более умный механизм вызова инструментов и — по словам компании — обеспечивает более быструю генерацию и повышенную надежность агентов.