
DeepSeek-V4-Flash-Vision
deepseek-v4-flash-vision-exp 모델은 텍스트와 함께 이미지를 입력으로 받을 수 있으므로, 모델에게 사진을 설명하게 하거나, 스크린샷에서 텍스트를 읽게 하거나, 차트를 분석하는 등 다양한 작업을 요청할 수 있습니다. 지원되는 이미지 형식: JPEG, PNG, GIF, WebP. 형식은 파일 이름이나 선언된 MIME 타입이 아니라 실제 파일 내용으로부터 감지됩니다.

deepseek-v4-flash-vision-exp 모델은 텍스트와 함께 이미지를 입력으로 받을 수 있으므로, 모델에게 사진을 설명하게 하거나, 스크린샷에서 텍스트를 읽게 하거나, 차트를 분석하는 등 다양한 작업을 요청할 수 있습니다. 지원되는 이미지 형식: JPEG, PNG, GIF, WebP. 형식은 파일 이름이나 선언된 MIME 타입이 아니라 실제 파일 내용으로부터 감지됩니다.

DeepSeek V4 Pro는 DeepSeek의 대규모 Mixture-of-Experts 모델로, 총 파라미터 1.6T와 활성 파라미터 49B를 갖추고 있으며 1M 토큰 컨텍스트 윈도우를 지원합니다. 고도 추론, 코딩, 그리고 장기적 에이전트 워크플로우를 위해 설계되었으며, 지식, 수학, 소프트웨어 엔지니어링 벤치마크 전반에서 강력한 성능을 보입니다.

DeepSeek V4 Flash는 DeepSeek의 효율성에 최적화된 Mixture-of-Experts 모델로, 284B 총 파라미터와 13B 활성화 파라미터를 갖추고 1M-token 컨텍스트 윈도우를 지원합니다. 고속 인퍼런스와 고처리량 워크로드에 맞춰 설계되었으며, 강력한 추론 및 코딩 성능을 유지합니다.

DeepSeek v3.2는 DeepSeek V3 제품군의 최신 프로덕션 릴리스입니다: 긴 컨텍스트 이해, 견고한 에이전트/도구 활용, 고급 추론, 코딩과 수학을 위해 설계된 대규모 ‘추론 우선’ 오픈 웨이트 언어 모델 제품군.

deepseek-r2 곧 공개
DeepSeek-Reasoner는 DeepSeek의 추론 우선(reasoning-first) LLM 제품군 및 API 엔드포인트로서, (1) 호출자에게 내부 연쇄 사고(CoT) 추론을 노출하고, (2) 다단계 계획, 수학, 코딩, 에이전트/도구 사용에 최적化된 'thinking' 모드로 동작하도록 설계되었습니다.
가장 인기 있고 비용 효율적인 DeepSeek-V3 모델. 671B 풀 스펙 버전. 이 모델은 최대 컨텍스트 길이 64,000 토큰을 지원합니다.
곧 공개