
DeepSeek V4 Flash is an efficiency-optimized Mixture-of-Experts model from DeepSeek with 284B total parameters and 13B activated parameters, supporting a 1M-token context window. It is designed for fast inference and high-throughput workloads, while maintaining strong reasoning and coding performance.

DeepSeek V4 Pro is a large-scale Mixture-of-Experts model from DeepSeek with 1.6T total parameters and 49B activated parameters, supporting a 1M-token context window. It is designed for advanced reasoning, coding, and long-horizon agent workflows, with strong performance across knowledge, math, and software engineering benchmarks.

DeepSeek-OCR 2 is a model released by DeepSeek on January 27, 2026, using the innovative DeepEncoder V2 method, which allows AI to dynamically rearrange parts of an image based on its meaning, rather than just mechanically scanning from left to right. While maintaining high data compression efficiency, the model has achieved significant breakthroughs in multiple benchmarks and production metrics. The model can cover complex document pages with only 256 to 1120 vision tokens, achieving an overall score of 91.09% in the OmniDocBench v1.5 evaluation

DeepSeek v3.2 là bản phát hành chính thức mới nhất trong dòng DeepSeek V3: một họ mô hình ngôn ngữ mở trọng số quy mô lớn, ưu tiên suy luận, được thiết kế để hiểu ngữ cảnh dài, hỗ trợ sử dụng agent/công cụ mạnh mẽ, suy luận nâng cao, lập trình và toán học.
deepseek-r2 coming soon
DeepSeek-OCR là một mô hình nhận dạng ký tự quang học dùng để trích xuất văn bản từ hình ảnh và tài liệu. Nó xử lý các trang được quét, ảnh chụp và ảnh chụp màn hình UI để tạo bản chép văn bản kèm các dấu hiệu bố cục như ngắt dòng. Các trường hợp sử dụng phổ biến bao gồm số hóa tài liệu, tiếp nhận hóa đơn và biên lai, lập chỉ mục tìm kiếm và kích hoạt các quy trình RPA. Những điểm nổi bật về kỹ thuật bao gồm xử lý chuyển đổi hình ảnh thành văn bản, hỗ trợ nội dung được quét và được chụp, và đầu ra văn bản có cấu trúc để phục vụ việc phân tích ở các bước tiếp theo.
Mô hình DeepSeek-V3 phổ biến và hiệu quả về chi phí nhất. Phiên bản 671B đầy đủ. Mô hình này hỗ trợ độ dài ngữ cảnh tối đa 64,000 token.
Một mô hình sinh văn bản Mixture of Experts với 671B tham số, được hợp nhất từ R1-0528, R1 và V3-0324 của DeepSeek-AI, hỗ trợ ngữ cảnh lên tới 60k tokens.
DeepSeek-Reasoner là dòng LLM và endpoint API ưu tiên lập luận của DeepSeek, được thiết kế để (1) cho phép bên gọi xem được lập luận theo chuỗi tư duy (CoT) nội bộ và (2) vận hành ở các chế độ “thinking” được tinh chỉnh cho lập kế hoạch nhiều bước, toán học, lập trình và sử dụng tác tử/công cụ.
Mô hình DeepSeek-V3 phổ biến nhất và hiệu quả về chi phí nhất. Phiên bản 671B đầy đủ. Mô hình này hỗ trợ độ dài ngữ cảnh tối đa là 64,000 token.
DeepSeek V3.1 là bản nâng cấp trong dòng V của DeepSeek: một mô hình ngôn ngữ lớn lai “tư duy / không tư duy” nhằm đạt trí tuệ tổng quát với thông lượng cao, chi phí thấp và sử dụng công cụ mang tính tác tử. Nó giữ khả năng tương thích với API kiểu OpenAI, bổ sung khả năng gọi công cụ thông minh hơn và—theo công ty—mang lại tốc độ sinh nhanh hơn và độ tin cậy của tác tử được cải thiện.