DeepSeek

厂商

领先的 AI 研究公司,专注于开发先进的语言模型和 AI 技术,用于编码和通用智能。

模型

DeepSeek V3.2

DeepSeek V3.2 是推理优先的模型,具备 128K 上下文窗口,专为智能体任务设计,将思考直接集成到工具使用中。

671B128.0K context8.0K output

DeepSeek-R1-0528

更新版 DeepSeek-R1 推理模型,提升了编码和数学能力,并减少了幻觉。

671B 总参数 / 37B 激活参数64.0K context

DeepSeek R1

DeepSeek 开放权重 671B MoE 推理模型,面向数学、编码和复杂问题求解。

671B128.0K context

DeepSeek-V3.1

支持思考与非思考模式,强化智能体编码和工具使用,并提供 128K 上下文窗口。

671B 总参数 / 37B 激活参数128.0K context

DeepSeek-V3.2-Exp

实验性 V3.2 模型,引入稀疏注意力,以提高长上下文编码和智能体任务的效率。

671B 总参数 / 37B 激活参数128.0K context

DeepSeek V3.1 Terminus

DeepSeek V3.1 Terminus 在 V3.1 基础上提升语言一致性,并优化代码智能体和搜索智能体的行为。

671B128.0K context

DeepSeek-V3

开放权重 MoE 模型,奠定了 V3 编码、推理和通用模型系列。

671B 总参数 / 37B 激活参数64.0K context8.2K output

DeepSeek-V4-Flash-Preview

DeepSeek V4 Flash 的开放权重预览版,拥有 2840 亿总参数、130 亿激活参数,支持 100 万 token 上下文、双思考模式、JSON 输出和工具调用。

284B 总参数 / 13B 激活参数1.0M context

DeepSeek-V4-Flash

DeepSeek 开源 V4 Flash 系列的 7 月 31 日更新版,已通过 API 提供并增强智能体能力;更新后的 0731 权重尚未发布。

284B 总参数 / 13B 激活参数1.0M context384.0K output

DeepSeek-V4-Pro-Preview

DeepSeek 的旗舰开放权重 V4 模型,1.6 万亿总参数、490 亿激活参数,支持 100 万上下文、双思考模式、JSON 输出和工具调用。

1.6T 总参数 / 49B 激活参数1.0M context384.0K output

社区

LinkedIn

关注我们

X (Twitter)

关注我们

GitHub

查看代码仓库

YouTube

观看视频

Discord

加入社区

Reddit

参与讨论

博客

阅读博客文章