DeepSeek
공급업체
코딩 및 일반 지능을 위한 고급 언어 모델과 AI 기술 개발에 집중하는 선도적인 AI 연구 기업입니다.
모델
DeepSeek V3.2
DeepSeek V3.2은 128K 컨텍스트 윈도를 갖춘 추론 우선 모델로, 도구 사용에 통합된 생각 기능을 갖춘 에이전트 작업을 위해 설계되었습니다.
671B128.0K context8.0K output
DeepSeek-R1-0528
코딩과 수학 성능을 높이고 환각을 줄인 DeepSeek-R1 업데이트 체크포인트입니다.
671B 전체 / 37B 활성64.0K context
DeepSeek R1
수학, 코딩과 복잡한 문제 해결을 위한 DeepSeek의 671B 오픈 웨이트 MoE 추론 모델입니다.
671B128.0K context
DeepSeek-V3.1
사고·비사고 모드, 강화된 에이전트 코딩과 도구 사용, 128K 컨텍스트를 지원하는 모델입니다.
671B 전체 / 37B 활성128.0K context
DeepSeek-V3.2-Exp
긴 컨텍스트 코딩과 에이전트 작업 효율을 높이는 희소 어텐션을 도입한 실험용 V3.2 체크포인트입니다.
671B 전체 / 37B 활성128.0K context
DeepSeek V3.1 Terminus
DeepSeek V3.1 Terminus는 V3.1보다 언어 일관성과 코드·검색 에이전트 동작을 개선했습니다.
671B128.0K context
DeepSeek-V3
V3 코딩·추론·범용 모델 계열의 기반이 된 오픈 웨이트 MoE 모델입니다.
671B 전체 / 37B 활성64.0K context8.2K output
DeepSeek-V4-Flash-Preview
총 284B 및 활성 13B 매개변수, 100만 토큰 컨텍스트, 이중 사고 모드, JSON 출력과 도구 호출을 지원하는 DeepSeek V4 Flash 오픈 웨이트 프리뷰입니다.
284B 전체 / 13B 활성1.0M context
DeepSeek-V4-Flash
DeepSeek 오픈 소스 V4 Flash 계열의 7월 31일 업데이트로, 강화된 에이전트 기능을 API에서 제공하지만 새 0731 가중치는 아직 공개되지 않았습니다.
284B 전체 / 13B 활성1.0M context384.0K output
DeepSeek-V4-Pro-Preview
총 1.6T 및 활성 49B 매개변수, 100만 컨텍스트, 이중 사고 모드, JSON 출력과 도구 호출을 지원하는 DeepSeek의 플래그십 오픈 웨이트 V4 모델입니다.
1.6T 전체 / 49B 활성1.0M context384.0K output