
DeepSeek đã phát hành DeepSeek V3.2 và biến thể tính toán cao DeepSeek-V3.2-Speciale, với công cụ chú ý thưa thớt mới (DSA), cải thiện hành vi của tác nhân/công cụ và

DeepSeek v3.2 là phiên bản phát hành chính thức mới nhất trong họ DeepSeek V3: một họ mô hình ngôn ngữ mở, ưu tiên suy luận, được thiết kế để hiểu ngữ cảnh dài, sử dụng tác nhân/công cụ mạnh mẽ, suy luận nâng cao, mã hóa và toán học.

DeepSeek đã phát hành DeepSeek V3.2 như phiên bản kế nhiệm của dòng V3.x và một biến thể DeepSeek-V3.2-Speciale đi kèm mà công ty định vị là

DeepSeek đã phát hành một mô hình thử nghiệm có tên là DeepSeek-V3.2-Exp vào ngày 29 tháng 9 năm 2025, giới thiệu một cơ chế chú ý thưa thớt mới (DeepSeek Sparse

DeepSeek-V3.1-Terminus là phiên bản cải tiến mới nhất của họ DeepSeek — một mô hình ngôn ngữ lớn (LLM) hướng đến tác nhân lai mà DeepSeek định vị là

DeepSeek-V3.1 là mô hình ngôn ngữ MoE “suy nghĩ/không suy nghĩ” lai (tổng cộng 671B, ≈37B được kích hoạt cho mỗi mã thông báo) có thể chạy cục bộ nếu bạn sử dụng đúng

DeepSeek-V3.1 là mô hình trò chuyện Hỗn hợp chuyên gia (MoE) lai được DeepSeek phát hành vào tháng 2025 năm XNUMX, hỗ trợ hai chế độ suy luận — chế độ "không suy nghĩ" nhanh

DeepSeek V3.1 là bản nâng cấp mới nhất trong dòng V của DeepSeek: một mô hình ngôn ngữ lớn "có suy nghĩ/không suy nghĩ" lai, hướng đến việc sử dụng công cụ trí tuệ tổng quát và tác nhân thông lượng cao, chi phí thấp. Nó vẫn giữ nguyên khả năng tương thích API theo phong cách OpenAI, bổ sung khả năng gọi công cụ thông minh hơn, và—theo công ty—mang lại tốc độ tạo tác nhân nhanh hơn và độ tin cậy của tác nhân được cải thiện.