DeepSeek

厂商

领先的 AI 研究公司,专注于开发先进的语言模型和 AI 技术,用于编码和通用智能。

产品

模型

DeepSeek V3.2

DeepSeek V3.2 是推理优先的模型,具备 128K 上下文窗口,专为智能体任务设计,将思考直接集成到工具使用中。

671B128.0K context8.0K output
→

DeepSeek-R1-0528

更新版 DeepSeek-R1 推理模型,提升了编码和数学能力,并减少了幻觉。

671B 总参数 / 37B 激活参数64.0K context
→

DeepSeek R1

DeepSeek 开放权重 671B MoE 推理模型,面向数学、编码和复杂问题求解。

671B128.0K context
→

DeepSeek-V3.1

支持思考与非思考模式,强化智能体编码和工具使用,并提供 128K 上下文窗口。

671B 总参数 / 37B 激活参数128.0K context
→

DeepSeek-V3.2-Exp

实验性 V3.2 模型,引入稀疏注意力,以提高长上下文编码和智能体任务的效率。

671B 总参数 / 37B 激活参数128.0K context
→

DeepSeek V3.1 Terminus

DeepSeek V3.1 Terminus 在 V3.1 基础上提升语言一致性,并优化代码智能体和搜索智能体的行为。

671B128.0K context
→

DeepSeek-V3

开放权重 MoE 模型,奠定了 V3 编码、推理和通用模型系列。

671B 总参数 / 37B 激活参数64.0K context8.2K output
→

DeepSeek-V4.1-Flash

DeepSeek 的 552B MoE 模型,具备原生视觉理解、100 万 token 上下文、思考与非思考模式、工具调用和 JSON 输出。

552B1.0M context384.0K output
→

DeepSeek-V4-Flash-Preview

DeepSeek V4 Flash 的开放权重预览版,拥有 2840 亿总参数、130 亿激活参数,支持 100 万 token 上下文、双思考模式、JSON 输出和工具调用。

284B 总参数 / 13B 激活参数1.0M context
→

DeepSeek-V4-Flash-Vision-Exp

DeepSeek 面向文本与图像理解的实验性多模态 V4 Flash 模型,默认启用推理,支持 100 万 token 上下文和最高 384K 输出。

1.0M context393.2K output
→

DeepSeek-V4-Flash

DeepSeek 开源 V4 Flash 系列的 7 月 31 日更新版,已通过 API 提供并增强智能体能力;更新后的 0731 权重尚未发布。

284B 总参数 / 13B 激活参数1.0M context384.0K output
→

DeepSeek-V4-Pro-Preview

DeepSeek 的旗舰开放权重 V4 模型,1.6 万亿总参数、490 亿激活参数,支持 100 万上下文、双思考模式、JSON 输出和工具调用。

1.6T 总参数 / 49B 激活参数1.0M context384.0K output
→

DeepSeek-V4-Pro

DeepSeek 当前的 V4 Pro 模型,提供 100 万 token 上下文、思考与非思考模式、JSON 输出、工具调用和 Responses API 支持。

1.0M context384.0K output
→

社区

LinkedIn

关注我们

X (Twitter)

关注我们

GitHub

查看代码仓库

YouTube

观看视频

Discord

加入社区

Reddit

参与讨论

博客

阅读博客文章