
DeepSeek V4 Flash is an efficiency-optimized Mixture-of-Experts model from DeepSeek with 284B total parameters and 13B activated parameters, supporting a 1M-token context window. It is designed for fast inference and high-throughput workloads, while maintaining strong reasoning and coding performance.

DeepSeek V4 Pro is a large-scale Mixture-of-Experts model from DeepSeek with 1.6T total parameters and 49B activated parameters, supporting a 1M-token context window. It is designed for advanced reasoning, coding, and long-horizon agent workflows, with strong performance across knowledge, math, and software engineering benchmarks.

DeepSeek-OCR 2 is a model released by DeepSeek on January 27, 2026, using the innovative DeepEncoder V2 method, which allows AI to dynamically rearrange parts of an image based on its meaning, rather than just mechanically scanning from left to right. While maintaining high data compression efficiency, the model has achieved significant breakthroughs in multiple benchmarks and production metrics. The model can cover complex document pages with only 256 to 1120 vision tokens, achieving an overall score of 91.09% in the OmniDocBench v1.5 evaluation

DeepSeek v3.2 เป็นรุ่นสำหรับการใช้งานจริงล่าสุดในตระกูล DeepSeek V3: ตระกูลโมเดลภาษาแบบเปิดน้ำหนักขนาดใหญ่ที่เน้นการให้เหตุผลเป็นอันดับแรก ออกแบบมาสำหรับการทำความเข้าใจบริบทยาว การใช้งานเอเจนต์/เครื่องมือที่เชื่อถือได้ การให้เหตุผลขั้นสูง การเขียนโค้ด และคณิตศาสตร์.
deepseek-r2 coming soon
DeepSeek-OCR เป็นโมเดลการรู้จำอักขระด้วยแสง (OCR) สำหรับการสกัดข้อความจากภาพและเอกสาร มันประมวลผลหน้าที่สแกนแล้ว ภาพถ่าย และภาพหน้าจอ UI เพื่อสร้างข้อความที่ถอดออกมาพร้อมตัวบ่งชี้การจัดหน้า เช่น การขึ้นบรรทัดใหม่ การใช้งานทั่วไปได้แก่ การแปลงเอกสารเป็นดิจิทัล การรับเข้าข้อมูลใบแจ้งหนี้และใบเสร็จ การทำดัชนีเพื่อการค้นหา และการเปิดใช้งานไปป์ไลน์ RPA ไฮไลต์ด้านเทคนิคประกอบด้วยการประมวลผลภาพเป็นข้อความ การรองรับเนื้อหาที่สแกนและถ่ายภาพ และผลลัพธ์ข้อความแบบมีโครงสร้างสำหรับการพาร์สในขั้นตอนถัดไป
โมเดล DeepSeek-V3 ที่ได้รับความนิยมสูงและคุ้มค่าคุ้มราคาที่สุด. เวอร์ชัน 671B แบบเต็มสเปก. โมเดลนี้รองรับความยาวบริบทสูงสุด 64,000 โทเคน.
โมเดลสร้างข้อความแบบ Mixture of Experts ที่มีพารามิเตอร์ 671B ผสานรวมมาจาก R1-0528, R1 และ V3-0324 ของ DeepSeek-AI รองรับบริบทได้สูงสุด 60k โทเค็น
DeepSeek-Reasoner เป็นตระกูลของ LLMs และเอ็นด์พอยต์ API ของ DeepSeek ที่เน้นการให้เหตุผลเป็นอันดับแรก ออกแบบมาเพื่อ (1) เปิดเผยการให้เหตุผลแบบ chain-of-thought (CoT) ภายในแก่ผู้เรียกใช้งาน และ (2) ทำงานในโหมด “คิด” ที่ปรับจูนสำหรับการวางแผนหลายขั้นตอน คณิตศาสตร์ การเขียนโค้ด และการใช้งานเอเจนต์/เครื่องมือ
โมเดล DeepSeek-V3 ที่ได้รับความนิยมสูงสุดและคุ้มค่าที่สุด. 671B เวอร์ชันเต็มพลัง. โมเดลนี้รองรับความยาวบริบทสูงสุด 64,000 โทเค็น.
DeepSeek V3.1 เป็นการอัปเกรดในซีรีส์ V ของ DeepSeek: โมเดลภาษาขนาดใหญ่แบบไฮบริด “คิด/ไม่คิด” ที่มุ่งรองรับปริมาณงานสูง ต้นทุนต่ำ เพื่อความฉลาดทั่วไปและการใช้เครื่องมือแบบเอเจนต์. ยังคงความเข้ากันได้กับ API สไตล์ OpenAI เพิ่มความสามารถในการเรียกใช้เครื่องมือที่ฉลาดขึ้น และ—ตามที่บริษัทระบุ—ให้การสร้างผลลัพธ์ที่รวดเร็วยิ่งขึ้นและความเชื่อถือได้ของเอเจนต์ที่ดีขึ้น.