产品
模型
DeepSeek V3.2
DeepSeek V3.2 是推理优先的模型,具备 128K 上下文窗口,专为智能体任务设计,将思考直接集成到工具使用中。
DeepSeek-R1-0528
更新版 DeepSeek-R1 推理模型,提升了编码和数学能力,并减少了幻觉。
DeepSeek R1
DeepSeek 开放权重 671B MoE 推理模型,面向数学、编码和复杂问题求解。
DeepSeek-V3.1
支持思考与非思考模式,强化智能体编码和工具使用,并提供 128K 上下文窗口。
DeepSeek-V3.2-Exp
实验性 V3.2 模型,引入稀疏注意力,以提高长上下文编码和智能体任务的效率。
DeepSeek V3.1 Terminus
DeepSeek V3.1 Terminus 在 V3.1 基础上提升语言一致性,并优化代码智能体和搜索智能体的行为。
DeepSeek-V3
开放权重 MoE 模型,奠定了 V3 编码、推理和通用模型系列。
DeepSeek-V4.1-Flash
DeepSeek 的 552B MoE 模型,具备原生视觉理解、100 万 token 上下文、思考与非思考模式、工具调用和 JSON 输出。
DeepSeek-V4-Flash-Preview
DeepSeek V4 Flash 的开放权重预览版,拥有 2840 亿总参数、130 亿激活参数,支持 100 万 token 上下文、双思考模式、JSON 输出和工具调用。
DeepSeek-V4-Flash-Vision-Exp
DeepSeek 面向文本与图像理解的实验性多模态 V4 Flash 模型,默认启用推理,支持 100 万 token 上下文和最高 384K 输出。
DeepSeek-V4-Flash
DeepSeek 开源 V4 Flash 系列的 7 月 31 日更新版,已通过 API 提供并增强智能体能力;更新后的 0731 权重尚未发布。
DeepSeek-V4-Pro-Preview
DeepSeek 的旗舰开放权重 V4 模型,1.6 万亿总参数、490 亿激活参数,支持 100 万上下文、双思考模式、JSON 输出和工具调用。
DeepSeek-V4-Pro
DeepSeek 当前的 V4 Pro 模型,提供 100 万 token 上下文、思考与非思考模式、JSON 输出、工具调用和 Responses API 支持。