Unlock exclusive introductory pricing for the newly launched Gemini 3.5 Flash.
DeepSeek V4 Flash
D

DeepSeek V4 Flash

Populaire
Entrée:$0.12/M
Sortie:$0.24/M

DeepSeek V4 Flash is an efficiency-optimized Mixture-of-Experts model from DeepSeek with 284B total parameters and 13B activated parameters, supporting a 1M-token context window. It is designed for fast inference and high-throughput workloads, while maintaining strong reasoning and coding performance.

DeepSeek V4 Pro
D

DeepSeek V4 Pro

Populaire
Entrée:$0.416/M
Sortie:$0.832/M

DeepSeek V4 Pro is a large-scale Mixture-of-Experts model from DeepSeek with 1.6T total parameters and 49B activated parameters, supporting a 1M-token context window. It is designed for advanced reasoning, coding, and long-horizon agent workflows, with strong performance across knowledge, math, and software engineering benchmarks.

DeepSeek-OCR2
D

DeepSeek-OCR2

Par requête:$0.04

DeepSeek-OCR 2 is a model released by DeepSeek on January 27, 2026, using the innovative DeepEncoder V2 method, which allows AI to dynamically rearrange parts of an image based on its meaning, rather than just mechanically scanning from left to right. While maintaining high data compression efficiency, the model has achieved significant breakthroughs in multiple benchmarks and production metrics. The model can cover complex document pages with only 256 to 1120 vision tokens, achieving an overall score of 91.09% in the OmniDocBench v1.5 evaluation

DeepSeek-V3.2
D

DeepSeek-V3.2

Populaire
Contexte:128K
Entrée:$0.216/M
Sortie:$0.3456/M

DeepSeek v3.2 est la dernière version de production de la famille DeepSeek V3 : une famille de grands modèles de langage à poids ouverts, axée en priorité sur le raisonnement, conçue pour la compréhension de contextes longs, l'utilisation robuste d'agents/outils, un raisonnement avancé, la programmation et les mathématiques.

D

DeepSeek R2

D

DeepSeek R2

Bientôt disponible
Entrée:$60/M
Sortie:$60/M

deepseek-r2 coming soon

D

DeepSeek-OCR

D

DeepSeek-OCR

Populaire
Par requête:$0.04

DeepSeek-OCR est un modèle de reconnaissance optique de caractères (OCR) destiné à extraire du texte à partir d’images et de documents. Il traite des pages numérisées, des photos et des captures d’écran d’interfaces utilisateur pour produire des transcriptions avec des repères de mise en page, tels que des sauts de ligne. Parmi les usages courants figurent la numérisation de documents, l’ingestion de factures et de reçus, l’indexation pour la recherche et la mise en place de pipelines RPA. Les points techniques marquants incluent la conversion d’images en texte, la prise en charge de contenus numérisés et photographiés, ainsi qu’une sortie texte structurée pour un traitement en aval.

D

DeepSeek-V3

D

DeepSeek-V3

Entrée:$0.216/M
Sortie:$0.88/M

Le modèle DeepSeek-V3 le plus populaire et le plus économique. Version 671B complète. Ce modèle prend en charge une longueur de contexte maximale de 64,000 jetons.

D

DeepSeek-R1T2-Chimera

D

DeepSeek-R1T2-Chimera

Entrée:$0.2416/M
Sortie:$0.2416/M

Un modèle de génération de texte Mixture of Experts de 671B paramètres, fusionné à partir de R1-0528, R1 et V3-0324 de DeepSeek-AI, prenant en charge jusqu’à 60k jetons de contexte.

D

DeepSeek-Reasoner

D

DeepSeek-Reasoner

Entrée:$0.44/M
Sortie:$1.752/M

DeepSeek-Reasoner est la famille de LLM et de points de terminaison d’API de DeepSeek, axée en priorité sur le raisonnement, conçue pour (1) exposer aux appelants le raisonnement interne en chaîne de pensée (CoT) et (2) fonctionner en modes « réflexion » optimisés pour la planification multi-étapes, les mathématiques, la programmation et l’utilisation d’agents et d’outils.

D

DeepSeek-Chat

D

DeepSeek-Chat

Populaire
Contexte:64K
Entrée:$0.216/M
Sortie:$0.88/M

Le modèle DeepSeek-V3 le plus populaire et le plus économique. Version 671B complète. Ce modèle prend en charge une longueur de contexte maximale de 64,000 jetons.

D

DeepSeek-V3.1

D

DeepSeek-V3.1

Entrée:$0.44/M
Sortie:$1.32/M

DeepSeek V3.1 est la mise à niveau de la série V de DeepSeek : un grand modèle de langage hybride « raisonnement / non-raisonnement » visant une intelligence générale à haut débit et à faible coût, ainsi que l’utilisation d’outils par des agents. Il conserve la compatibilité avec l’API de style OpenAI, ajoute des appels d’outils plus intelligents et — selon l’entreprise — offre une génération plus rapide et une fiabilité accrue des agents.