DeepSeek

廠商

領先的 AI 研究公司,專注於開發先進的語言模型和 AI 技術,用於程式設計和通用智慧。

模型

DeepSeek V3.2

DeepSeek V3.2 是推理優先的模型,具備 128K 上下文視窗,專為智慧體任務設計,將思考直接整合到工具使用中。

671B128.0K context8.0K output

DeepSeek-R1-0528

更新版 DeepSeek-R1 推理模型,提升了程式設計和數學能力,並減少幻覺。

671B 總參數 / 37B 啟用參數64.0K context

DeepSeek R1

DeepSeek 開放權重 671B MoE 推理模型,面向數學、程式設計和複雜問題求解。

671B128.0K context

DeepSeek-V3.1

支援思考與非思考模式,強化代理程式設計和工具使用,並提供 128K 上下文視窗。

671B 總參數 / 37B 啟用參數128.0K context

DeepSeek-V3.2-Exp

實驗性 V3.2 模型,引入稀疏注意力,以提升長上下文程式設計和代理任務的效率。

671B 總參數 / 37B 啟用參數128.0K context

DeepSeek V3.1 Terminus

DeepSeek V3.1 Terminus 在 V3.1 基礎上提升語言一致性,並最佳化程式碼代理和搜尋代理的行為。

671B128.0K context

DeepSeek-V3

開放權重 MoE 模型,奠定了 V3 程式設計、推理和通用模型系列。

671B 總參數 / 37B 啟用參數64.0K context8.2K output

DeepSeek-V4-Flash-Preview

DeepSeek V4 Flash 的開放權重預覽版,擁有 2840 億總參數、130 億啟用參數,支援 100 萬 token 上下文、雙思考模式、JSON 輸出和工具呼叫。

284B 總參數 / 13B 啟用參數1.0M context

DeepSeek-V4-Flash

DeepSeek 開源 V4 Flash 系列的 7 月 31 日更新版,已透過 API 提供並增強智慧體能力;更新後的 0731 權重尚未發布。

284B 總參數 / 13B 啟用參數1.0M context384.0K output

DeepSeek-V4-Pro-Preview

DeepSeek 的旗艦開放權重 V4 模型,1.6 兆總參數、490 億啟用參數,支援 100 萬上下文、雙思考模式、JSON 輸出和工具呼叫。

1.6T 總參數 / 49B 啟用參數1.0M context384.0K output

社群

LinkedIn

關注我們

X (Twitter)

關注我們

GitHub

檢視儲存庫

YouTube

觀看影片

Discord

加入社群

Reddit

參與討論

部落格

閱讀部落格文章