
DeepSeek 發布了 DeepSeek V3.2 和高效能運算版本 DeepSeek-V3.2-Speciale,其中包含新的稀疏注意力引擎 (DSA)、改進的代理程式/工具行為以及

DeepSeek v3.2 是 DeepSeek V3 系列的最新生產版本:一個大型的、推理優先的開放權重語言模型系列,專為長期上下文理解、強大的代理/工具使用、高級推理、編碼和數學而設計。

DeepSeek 發布了 DeepSeek V3.2,作為其 V3.x 系列的後續產品,以及一款配套的 DeepSeek-V3.2-Speciale 版本,該公司將其定位為…

DeepSeek 於 2025 年 9 月 29 日發布了名為 DeepSeek-V3.2-Exp 的實驗模型,引入了一種新的稀疏注意力機制(DeepSeek Sparse

DeepSeek-V3.1-Terminus 是 DeepSeek 系列的最新改進版,它是一種混合型、面向代理的大型語言模型 (LLM),DeepSeek 將其定位為

DeepSeek-V3.1 是一個混合「思考/非思考」的 MoE 語言模型(總計 671B,每個 token 活化 ≈37B),如果使用正確的

DeepSeek-V3.1 是 DeepSeek 於 2025 年 XNUMX 月發布的混合專家 (MoE) 聊天模型,支援兩種推理模式——快速“無思考”

DeepSeek V3.1 是 DeepSeek V 系列的最新升級版:一個混合「思考/非思考」大型語言模型,旨在實現高吞吐量、低成本的通用智慧和代理工具的使用。它保留了 OpenAI 風格的 API 相容性,增加了更聰明的工具調用,並且(據該公司稱)實現了更快的生成速度和更高的代理可靠性。