DeepSeek

廠商

領先的 AI 研究公司,專注於開發先進的語言模型和 AI 技術,用於程式設計和通用智慧。

產品

模型

DeepSeek V3.2

DeepSeek V3.2 是推理優先的模型,具備 128K 上下文視窗,專為智慧體任務設計,將思考直接整合到工具使用中。

671B128.0K context8.0K output
→

DeepSeek-R1-0528

更新版 DeepSeek-R1 推理模型,提升了程式設計和數學能力,並減少幻覺。

671B 總參數 / 37B 啟用參數64.0K context
→

DeepSeek R1

DeepSeek 開放權重 671B MoE 推理模型,面向數學、程式設計和複雜問題求解。

671B128.0K context
→

DeepSeek-V3.1

支援思考與非思考模式,強化代理程式設計和工具使用,並提供 128K 上下文視窗。

671B 總參數 / 37B 啟用參數128.0K context
→

DeepSeek-V3.2-Exp

實驗性 V3.2 模型,引入稀疏注意力,以提升長上下文程式設計和代理任務的效率。

671B 總參數 / 37B 啟用參數128.0K context
→

DeepSeek V3.1 Terminus

DeepSeek V3.1 Terminus 在 V3.1 基礎上提升語言一致性,並最佳化程式碼代理和搜尋代理的行為。

671B128.0K context
→

DeepSeek-V3

開放權重 MoE 模型,奠定了 V3 程式設計、推理和通用模型系列。

671B 總參數 / 37B 啟用參數64.0K context8.2K output
→

DeepSeek-V4.1-Flash

DeepSeek 的 552B MoE 模型,具備原生視覺理解、100 萬 token 上下文、思考與非思考模式、工具呼叫和 JSON 輸出。

552B1.0M context384.0K output
→

DeepSeek-V4-Flash-Preview

DeepSeek V4 Flash 的開放權重預覽版,擁有 2840 億總參數、130 億啟用參數,支援 100 萬 token 上下文、雙思考模式、JSON 輸出和工具呼叫。

284B 總參數 / 13B 啟用參數1.0M context
→

DeepSeek-V4-Flash-Vision-Exp

DeepSeek 面向文字與圖像理解的實驗性多模態 V4 Flash 模型,預設啟用推理,支援 100 萬 token 上下文和最高 384K 輸出。

1.0M context393.2K output
→

DeepSeek-V4-Flash

DeepSeek 開源 V4 Flash 系列的 7 月 31 日更新版,已透過 API 提供並增強智慧體能力;更新後的 0731 權重尚未發布。

284B 總參數 / 13B 啟用參數1.0M context384.0K output
→

DeepSeek-V4-Pro-Preview

DeepSeek 的旗艦開放權重 V4 模型,1.6 兆總參數、490 億啟用參數,支援 100 萬上下文、雙思考模式、JSON 輸出和工具呼叫。

1.6T 總參數 / 49B 啟用參數1.0M context384.0K output
→

DeepSeek-V4-Pro

DeepSeek 目前的 V4 Pro 模型,提供 100 萬 token 上下文、思考與非思考模式、JSON 輸出、工具呼叫和 Responses API 支援。

1.0M context384.0K output
→

社群

LinkedIn

關注我們

X (Twitter)

關注我們

GitHub

檢視儲存庫

YouTube

觀看影片

Discord

加入社群

Reddit

參與討論

部落格

閱讀部落格文章