Unlock exclusive introductory pricing for the newly launched Gemini 3.5 Flash.
DeepSeek V4 Flash
D

DeepSeek V4 Flash

Popular
Entrada:$0.12/M
Saída:$0.24/M

DeepSeek V4 Flash is an efficiency-optimized Mixture-of-Experts model from DeepSeek with 284B total parameters and 13B activated parameters, supporting a 1M-token context window. It is designed for fast inference and high-throughput workloads, while maintaining strong reasoning and coding performance.

DeepSeek V4 Pro
D

DeepSeek V4 Pro

Popular
Entrada:$0.416/M
Saída:$0.832/M

DeepSeek V4 Pro is a large-scale Mixture-of-Experts model from DeepSeek with 1.6T total parameters and 49B activated parameters, supporting a 1M-token context window. It is designed for advanced reasoning, coding, and long-horizon agent workflows, with strong performance across knowledge, math, and software engineering benchmarks.

DeepSeek-OCR2
D

DeepSeek-OCR2

Por Solicitação:$0.04

DeepSeek-OCR 2 is a model released by DeepSeek on January 27, 2026, using the innovative DeepEncoder V2 method, which allows AI to dynamically rearrange parts of an image based on its meaning, rather than just mechanically scanning from left to right. While maintaining high data compression efficiency, the model has achieved significant breakthroughs in multiple benchmarks and production metrics. The model can cover complex document pages with only 256 to 1120 vision tokens, achieving an overall score of 91.09% in the OmniDocBench v1.5 evaluation

DeepSeek-V3.2
D

DeepSeek-V3.2

Popular
Contexto:128K
Entrada:$0.216/M
Saída:$0.3456/M

DeepSeek v3.2 é a versão de produção mais recente da família DeepSeek V3: uma família de modelos de linguagem de grande porte, de pesos abertos e com prioridade ao raciocínio, projetada para compreensão de contextos longos, uso robusto de agentes e ferramentas, raciocínio avançado, programação e matemática.

D

DeepSeek R2

D

DeepSeek R2

Em breve
Entrada:$60/M
Saída:$60/M

deepseek-r2 coming soon

D

DeepSeek-OCR

D

DeepSeek-OCR

Popular
Por Solicitação:$0.04

DeepSeek-OCR é um modelo de reconhecimento óptico de caracteres para extrair texto de imagens e documentos. Ele processa páginas digitalizadas, fotos e capturas de tela de interface do usuário (UI) para produzir transcrições com indicações de layout, como quebras de linha. Os usos comuns incluem digitalização de documentos, ingestão de faturas e recibos, indexação para pesquisa e habilitação de pipelines de RPA. Os destaques técnicos incluem processamento de imagem para texto, suporte a conteúdo digitalizado e fotografado e saída de texto estruturado para parsing downstream.

D

DeepSeek-V3

D

DeepSeek-V3

Entrada:$0.216/M
Saída:$0.88/M

O modelo DeepSeek-V3 mais popular e com melhor custo-benefício. Versão completa de 671B. Este modelo suporta um comprimento máximo de contexto de 64,000 tokens.

D

DeepSeek-R1T2-Chimera

D

DeepSeek-R1T2-Chimera

Entrada:$0.2416/M
Saída:$0.2416/M

Um modelo de geração de texto Mixture of Experts com 671B parâmetros, fundido a partir de R1-0528, R1 e V3-0324 da DeepSeek-AI, com suporte a até 60k tokens de contexto.

D

DeepSeek-Reasoner

D

DeepSeek-Reasoner

Entrada:$0.44/M
Saída:$1.752/M

DeepSeek-Reasoner é a família da DeepSeek de LLMs e endpoints de API focada prioritariamente em raciocínio, projetada para (1) expor aos chamadores a cadeia de raciocínio (CoT) interna e (2) operar em “pensamento” modos ajustados para planejamento em múltiplas etapas, matemática, programação e uso de agentes/ferramentas.

D

DeepSeek-Chat

D

DeepSeek-Chat

Popular
Contexto:64K
Entrada:$0.216/M
Saída:$0.88/M

O modelo DeepSeek-V3 mais popular e com melhor custo-benefício. Versão completa de 671B. Este modelo suporta um comprimento máximo de contexto de 64,000 tokens.

D

DeepSeek-V3.1

D

DeepSeek-V3.1

Entrada:$0.44/M
Saída:$1.32/M

DeepSeek V3.1 é a atualização na V-series da DeepSeek: um modelo de linguagem de grande porte híbrido “com raciocínio / sem raciocínio”, voltado à inteligência geral de alto rendimento e baixo custo e ao uso agentivo de ferramentas. Mantém compatibilidade com API no estilo OpenAI, adiciona chamadas de ferramentas mais inteligentes e—segundo a empresa—traz geração mais rápida e maior confiabilidade dos agentes.