產品
模型
DeepSeek V3.2
DeepSeek V3.2 是推理優先的模型,具備 128K 上下文視窗,專為智慧體任務設計,將思考直接整合到工具使用中。
DeepSeek-R1-0528
更新版 DeepSeek-R1 推理模型,提升了程式設計和數學能力,並減少幻覺。
DeepSeek R1
DeepSeek 開放權重 671B MoE 推理模型,面向數學、程式設計和複雜問題求解。
DeepSeek-V3.1
支援思考與非思考模式,強化代理程式設計和工具使用,並提供 128K 上下文視窗。
DeepSeek-V3.2-Exp
實驗性 V3.2 模型,引入稀疏注意力,以提升長上下文程式設計和代理任務的效率。
DeepSeek V3.1 Terminus
DeepSeek V3.1 Terminus 在 V3.1 基礎上提升語言一致性,並最佳化程式碼代理和搜尋代理的行為。
DeepSeek-V3
開放權重 MoE 模型,奠定了 V3 程式設計、推理和通用模型系列。
DeepSeek-V4.1-Flash
DeepSeek 的 552B MoE 模型,具備原生視覺理解、100 萬 token 上下文、思考與非思考模式、工具呼叫和 JSON 輸出。
DeepSeek-V4-Flash-Preview
DeepSeek V4 Flash 的開放權重預覽版,擁有 2840 億總參數、130 億啟用參數,支援 100 萬 token 上下文、雙思考模式、JSON 輸出和工具呼叫。
DeepSeek-V4-Flash-Vision-Exp
DeepSeek 面向文字與圖像理解的實驗性多模態 V4 Flash 模型,預設啟用推理,支援 100 萬 token 上下文和最高 384K 輸出。
DeepSeek-V4-Flash
DeepSeek 開源 V4 Flash 系列的 7 月 31 日更新版,已透過 API 提供並增強智慧體能力;更新後的 0731 權重尚未發布。
DeepSeek-V4-Pro-Preview
DeepSeek 的旗艦開放權重 V4 模型,1.6 兆總參數、490 億啟用參數,支援 100 萬上下文、雙思考模式、JSON 輸出和工具呼叫。
DeepSeek-V4-Pro
DeepSeek 目前的 V4 Pro 模型,提供 100 萬 token 上下文、思考與非思考模式、JSON 輸出、工具呼叫和 Responses API 支援。