
DeepSeek 發布了 DeepSeek V3.2 和高效能運算版本 DeepSeek-V3.2-Speciale,其中包含新的稀疏注意力引擎 (DSA)、改進的代理程式/工具行為以及

DeepSeek v3.2 是 DeepSeek V3 系列的最新生產版本:一個大型的、推理優先的開放權重語言模型系列,專為長期上下文理解、強大的代理/工具使用、高級推理、編碼和數學而設計。

DeepSeek 於 2025 年 9 月 29 日發布了名為 DeepSeek-V3.2-Exp 的實驗模型,引入了一種新的稀疏注意力機制(DeepSeek Sparse

DeepSeek-V3.1-Terminus 是 DeepSeek 系列的最新改進版,它是一種混合型、面向代理的大型語言模型 (LLM),DeepSeek 將其定位為

DeepSeek-V3.1 是一個混合「思考/非思考」的 MoE 語言模型(總計 671B,每個 token 活化 ≈37B),如果使用正確的

DeepSeek 已迅速成為 2025 年最受關注的生成式人工智慧應用之一,但它的迅速崛起也伴隨著相當大的

DeepSeek R1 已迅速成為最強大的開源推理模型之一,在數學、編碼和複雜

DeepSeek 已迅速成為領先的人工智慧視覺搜尋和分析平台,使用戶能夠以驚人的速度處理和解釋圖像