
DeepSeek V4 Flash is an efficiency-optimized Mixture-of-Experts model from DeepSeek with 284B total parameters and 13B activated parameters, supporting a 1M-token context window. It is designed for fast inference and high-throughput workloads, while maintaining strong reasoning and coding performance.

DeepSeek V4 Pro is a large-scale Mixture-of-Experts model from DeepSeek with 1.6T total parameters and 49B activated parameters, supporting a 1M-token context window. It is designed for advanced reasoning, coding, and long-horizon agent workflows, with strong performance across knowledge, math, and software engineering benchmarks.

DeepSeek-OCR 2 is a model released by DeepSeek on January 27, 2026, using the innovative DeepEncoder V2 method, which allows AI to dynamically rearrange parts of an image based on its meaning, rather than just mechanically scanning from left to right. While maintaining high data compression efficiency, the model has achieved significant breakthroughs in multiple benchmarks and production metrics. The model can cover complex document pages with only 256 to 1120 vision tokens, achieving an overall score of 91.09% in the OmniDocBench v1.5 evaluation

DeepSeek v3.2، DeepSeek V3 فیملی کی تازہ ترین پروڈکشن ریلیز ہے: ایک بڑی، استدلال کو مقدم رکھنے والی اوپن ویٹ لینگویج ماڈل فیملی جو طویل سیاق و سباق کی فہم، مضبوط ایجنٹ/ٹول کے استعمال، اعلیٰ درجے کے استدلال، کوڈنگ اور ریاضی کے لیے ڈیزائن کی گئی ہے۔
deepseek-r2 coming soon
DeepSeek-OCR ایک آپٹیکل کریکٹر ریکگنیشن (OCR) ماڈل ہے جو تصاویر اور دستاویزات سے متن اخذ کرنے کے لیے بنایا گیا ہے۔ یہ اسکین شدہ صفحات، تصاویر اور UI اسکرین شاٹس کو پروسیس کر کے ایسے ٹرانسکرپشنز تیار کرتا ہے جن میں لے آؤٹ کے اشارے، مثلاً لائن بریکس، شامل ہوتے ہیں۔ عام استعمالات میں دستاویزات کی ڈیجیٹائزیشن، انوائس اور رسیدوں کا اندراج، سرچ انڈیکسنگ، اور RPA پائپ لائنز کو فعال بنانا شامل ہے۔ فنی نمایاں خصوصیات میں تصویر سے متن میں تبدیلی، اسکین شدہ اور فوٹوگراف شدہ مواد کی معاونت، اور بعد ازاں پارسنگ کے لیے ساختہ متن کی آؤٹ پٹ شامل ہیں۔
سب سے مقبول اور لاگت مؤثر DeepSeek-V3 ماڈل۔ 671B کا مکمل صلاحیتوں والا ورژن۔ یہ ماڈل زیادہ سے زیادہ 64,000 ٹوکنز کی کانٹیکسٹ لمبائی سپورٹ کرتا ہے۔
ایک 671B پیرامیٹر والا Mixture of Experts ٹیکسٹ جنریشن ماڈل، جو DeepSeek-AI کے R1-0528، R1 اور V3-0324 کو یکجا کر کے تیار کیا گیا ہے، اور 60k کانٹیکسٹ ٹوکنز تک کی سپورٹ رکھتا ہے۔
DeepSeek-Reasoner، DeepSeek کی استدلال-اول LLMs اور API endpoints کی فیملی ہے، جسے (1) کال کرنے والے صارفین کے لیے اندرونی chain-of-thought (CoT) استدلال کو ظاہر کرنے اور (2) متعدد مراحل کی منصوبہ بندی، ریاضی، کوڈنگ، اور ایجنٹ/ٹول کے استعمال کے لیے موزوں کردہ “thinking” موڈز میں کام کرنے کے لیے ڈیزائن کیا گیا ہے۔
سب سے مقبول اور لاگت مؤثر DeepSeek-V3 ماڈل۔ 671B مکمل صلاحیت والا ورژن۔ یہ ماڈل زیادہ سے زیادہ 64,000 ٹوکنز کے کانٹیکسٹ کی لمبائی کی حمایت کرتا ہے۔
DeepSeek V3.1، DeepSeek کی V-series کا اپ گریڈ ہے: ایک ہائبرڈ 'thinking / non-thinking' بڑا لسانی ماڈل جو زیادہ تھروپٹ، کم لاگت عمومی ذہانت اور ایجنٹ پر مبنی ٹول کے استعمال کے لیے بنایا گیا ہے۔ یہ OpenAI طرز کی API مطابقت برقرار رکھتا ہے، مزید ذہین ٹول کالنگ شامل کرتا ہے، اور—کمپنی کے مطابق—تیز تر جنریشن اور ایجنٹ کی قابلِ اعتمادیت میں بہتری لاتا ہے۔