Unlock exclusive introductory pricing for the newly launched Gemini 3.5 Flash.
DeepSeek V4 Flash
D

DeepSeek V4 Flash

Popolare
Ingresso:$0.12/M
Uscita:$0.24/M

DeepSeek V4 Flash is an efficiency-optimized Mixture-of-Experts model from DeepSeek with 284B total parameters and 13B activated parameters, supporting a 1M-token context window. It is designed for fast inference and high-throughput workloads, while maintaining strong reasoning and coding performance.

DeepSeek V4 Pro
D

DeepSeek V4 Pro

Popolare
Ingresso:$0.416/M
Uscita:$0.832/M

DeepSeek V4 Pro is a large-scale Mixture-of-Experts model from DeepSeek with 1.6T total parameters and 49B activated parameters, supporting a 1M-token context window. It is designed for advanced reasoning, coding, and long-horizon agent workflows, with strong performance across knowledge, math, and software engineering benchmarks.

DeepSeek-OCR2
D

DeepSeek-OCR2

Per Richiesta:$0.04

DeepSeek-OCR 2 is a model released by DeepSeek on January 27, 2026, using the innovative DeepEncoder V2 method, which allows AI to dynamically rearrange parts of an image based on its meaning, rather than just mechanically scanning from left to right. While maintaining high data compression efficiency, the model has achieved significant breakthroughs in multiple benchmarks and production metrics. The model can cover complex document pages with only 256 to 1120 vision tokens, achieving an overall score of 91.09% in the OmniDocBench v1.5 evaluation

DeepSeek-V3.2
D

DeepSeek-V3.2

Popolare
Contesto:128K
Ingresso:$0.216/M
Uscita:$0.3456/M

DeepSeek v3.2 è l'ultima release di produzione della famiglia DeepSeek V3: una famiglia di grandi modelli linguistici a pesi aperti, incentrata sul ragionamento, progettata per la comprensione di contesti lunghi, l'uso robusto di agenti/strumenti, il ragionamento avanzato, la programmazione e la matematica.

D

DeepSeek R2

D

DeepSeek R2

Prossimamente
Ingresso:$60/M
Uscita:$60/M

deepseek-r2 coming soon

D

DeepSeek-OCR

D

DeepSeek-OCR

Popolare
Per Richiesta:$0.04

DeepSeek-OCR è un modello di riconoscimento ottico dei caratteri per l'estrazione di testo da immagini e documenti. Elabora pagine scansionate, foto e screenshot dell'UI per produrre trascrizioni con indicatori di layout come le interruzioni di riga. Gli usi comuni includono la digitalizzazione dei documenti, l'acquisizione di fatture e ricevute, l'indicizzazione per la ricerca e l'abilitazione di pipeline RPA. I punti salienti tecnici includono l'elaborazione da immagine a testo, il supporto per contenuti scansionati e fotografati e un output di testo strutturato per il parsing a valle.

D

DeepSeek-V3

D

DeepSeek-V3

Ingresso:$0.216/M
Uscita:$0.88/M

Il modello DeepSeek-V3 più popolare e conveniente. Versione completa 671B. Questo modello supporta una lunghezza massima del contesto di 64,000 tokens.

D

DeepSeek-R1T2-Chimera

D

DeepSeek-R1T2-Chimera

Ingresso:$0.2416/M
Uscita:$0.2416/M

Un modello di generazione di testo Mixture of Experts da 671B parametri, derivato dalla fusione dei modelli R1-0528, R1 e V3-0324 di DeepSeek-AI, che supporta fino a 60k token di contesto.

D

DeepSeek-Reasoner

D

DeepSeek-Reasoner

Ingresso:$0.44/M
Uscita:$1.752/M

DeepSeek-Reasoner è la famiglia di LLM ed endpoint API di DeepSeek incentrata sul ragionamento, progettata per (1) esporre ai chiamanti il ragionamento interno a catena di pensiero (CoT) e (2) operare in modalità di 'thinking' ottimizzate per la pianificazione a più fasi, la matematica, la programmazione e l'uso di agenti/strumenti.

D

DeepSeek-Chat

D

DeepSeek-Chat

Popolare
Contesto:64K
Ingresso:$0.216/M
Uscita:$0.88/M

Il modello DeepSeek-V3 più popolare e con il miglior rapporto qualità-prezzo. Versione completa da 671B. Questo modello supporta una lunghezza massima del contesto di 64,000 token.

D

DeepSeek-V3.1

D

DeepSeek-V3.1

Ingresso:$0.44/M
Uscita:$1.32/M

DeepSeek V3.1 è l'aggiornamento della V-series di DeepSeek: un modello linguistico di grandi dimensioni ibrido "pensante / non pensante" orientato a un'intelligenza generale ad alto throughput e a basso costo, e all'utilizzo agentico degli strumenti. Mantiene la compatibilità con API in stile OpenAI, aggiunge un'invocazione degli strumenti più intelligente e — secondo l'azienda — offre una generazione più rapida e una maggiore affidabilità degli agenti.