
DeepSeek V4 Flash is an efficiency-optimized Mixture-of-Experts model from DeepSeek with 284B total parameters and 13B activated parameters, supporting a 1M-token context window. It is designed for fast inference and high-throughput workloads, while maintaining strong reasoning and coding performance.

DeepSeek V4 Pro is a large-scale Mixture-of-Experts model from DeepSeek with 1.6T total parameters and 49B activated parameters, supporting a 1M-token context window. It is designed for advanced reasoning, coding, and long-horizon agent workflows, with strong performance across knowledge, math, and software engineering benchmarks.

DeepSeek-OCR 2 is a model released by DeepSeek on January 27, 2026, using the innovative DeepEncoder V2 method, which allows AI to dynamically rearrange parts of an image based on its meaning, rather than just mechanically scanning from left to right. While maintaining high data compression efficiency, the model has achieved significant breakthroughs in multiple benchmarks and production metrics. The model can cover complex document pages with only 256 to 1120 vision tokens, achieving an overall score of 91.09% in the OmniDocBench v1.5 evaluation

DeepSeek v3.2 é a versão de produção mais recente da família DeepSeek V3: uma família de modelos de linguagem de grande porte, de pesos abertos e com prioridade ao raciocínio, projetada para compreensão de contextos longos, uso robusto de agentes e ferramentas, raciocínio avançado, programação e matemática.
deepseek-r2 coming soon
DeepSeek-OCR é um modelo de reconhecimento óptico de caracteres para extrair texto de imagens e documentos. Ele processa páginas digitalizadas, fotos e capturas de tela de interface do usuário (UI) para produzir transcrições com indicações de layout, como quebras de linha. Os usos comuns incluem digitalização de documentos, ingestão de faturas e recibos, indexação para pesquisa e habilitação de pipelines de RPA. Os destaques técnicos incluem processamento de imagem para texto, suporte a conteúdo digitalizado e fotografado e saída de texto estruturado para parsing downstream.
O modelo DeepSeek-V3 mais popular e com melhor custo-benefício. Versão completa de 671B. Este modelo suporta um comprimento máximo de contexto de 64,000 tokens.
Um modelo de geração de texto Mixture of Experts com 671B parâmetros, fundido a partir de R1-0528, R1 e V3-0324 da DeepSeek-AI, com suporte a até 60k tokens de contexto.
DeepSeek-Reasoner é a família da DeepSeek de LLMs e endpoints de API focada prioritariamente em raciocínio, projetada para (1) expor aos chamadores a cadeia de raciocínio (CoT) interna e (2) operar em “pensamento” modos ajustados para planejamento em múltiplas etapas, matemática, programação e uso de agentes/ferramentas.
O modelo DeepSeek-V3 mais popular e com melhor custo-benefício. Versão completa de 671B. Este modelo suporta um comprimento máximo de contexto de 64,000 tokens.
DeepSeek V3.1 é a atualização na V-series da DeepSeek: um modelo de linguagem de grande porte híbrido “com raciocínio / sem raciocínio”, voltado à inteligência geral de alto rendimento e baixo custo e ao uso agentivo de ferramentas. Mantém compatibilidade com API no estilo OpenAI, adiciona chamadas de ferramentas mais inteligentes e—segundo a empresa—traz geração mais rápida e maior confiabilidade dos agentes.