DeepSeek의 V4 제품군은 이제 초기 프리뷰 단계를 넘어섰습니다. DeepSeek V4 Flash 는 7월 31일 V4-Flash-0731로 퍼블릭 베타에 진입했고, DeepSeek V4 Pro 는 8월 13일 APP, Web 및 API 전반에서 V4-Pro-0813로 GA에 도달했습니다. 두 모델은 V4 제품군의 백만-토큰 컨텍스트 설계와 MoE 아키텍처를 유지하며, Flash는 효율성에 최적화되고 Pro는 더 높은 능력의 추론 및 에이전트 모델로 포지셔닝되었습니다.
Pro GA 출시는 어떠한 V4.1 전망에 대해서도 기준선을 실질적으로 끌어올립니다. DeepSeek에 따르면 이번 GA 빌드는 특히 프로덕션 환경에서 에이전트 역량을 크게 강화했으며, 이제 V4-Pro와 V4-Flash 모두에 네이티브 Responses API 지원과 낮음, 높음, 최대의 사고 노력 수준을 제공합니다. 현재 API 모델 버전은 명시적으로 DeepSeek-V4-Pro-0813로 표기되어 있습니다. 그렇다면 DeepSeek V4.1은 이제 어디에 위치합니까? The Information의 5월 보도에 따르면 DeepSeek는 엔터프라이즈 도구 강화와 멀티모달 지원을 포함한 6월 V4.1 출시를 계획했습니다. 그 시기는 지났고, 현재 DeepSeek 릴리스 로그에는 여전히 V4.1 모델 카드나 릴리스 항목이 없습니다. 따라서 가장 안전한 해석은 GA 이후의 V4 반복 버전으로, 보도된 목표가 V4.1이라는 이름으로 또는 추가 V4 업데이트를 통해 여전히 도달할 수 있다는 것입니다.

확정된 이정표는 DeepSeek 변경 로그를 기준으로 하며; 초기의 V4.1 6월 계획은 The Information에서 나왔습니다.
DeepSeek-V4.1란 무엇인가?
DeepSeek-V4.1은 공식적으로 출시된 DeepSeek 모델이 아니라, 확인되지 않은 GA 이후의 V4 반복 버전으로 이해하는 것이 가장 적절합니다. V4 제품군은 이미 V4-Pro-0813이라는 프로덕션 Pro 체크포인트를 보유하므로, V4.1은 이제 원래의 V4 롤아웃을 완성하기 위한 단계라기보다 중간 주기의 기능 업데이트를 의미하게 됩니다. DeepSeek는 V4.1 모델 카드, 기술 보고서, API 변경 로그 또는 벤치마크 표를 공개하지 않았습니다.
| 질문 | 현재 답변 | 신뢰도 |
|---|---|---|
| DeepSeek가 “V4.1”을 공식 발표했는가? | 아니요. 현재 DeepSeek 릴리스 로그에는 V4.1 항목이나 모델 카드가 없습니다. | 높음 |
| V4.1 출시가 보도되었는가? | 예. The Information이 엔터프라이즈 도구와 멀티모달 지원을 포함한 6월 계획을 보도했습니다. | 중간 |
| 보도된 6월 일정이 실제로 있었는가? | 그 기간 동안 별도의 공식 V4.1 출시가 나타나지 않았습니다. | 높음 |
| 최신으로 확인된 V4 이정표는 무엇인가? | V4-Flash-0731은 7월 31일 퍼블릭 베타에 진입했고 V4-Pro-0813은 8월 13일 GA에 도달했습니다. | 높음 |
| V4.1이 여전히 별도 모델로 출시될 수 있는가? | 예, 그러나 이름, 사양, 시기는 여전히 미확정입니다. | 낮음/중간 |
예상 DeepSeek-V4.1 사양
DeepSeek가 V4.1 사양을 공개하지 않았으므로 아래 표는 확인된 현재 V4 기능과 방향성 있는 기대를 구분합니다. “예상”은 공식 V4.1 사양이 아니라 V4의 합리적 연장선 또는 언론에서 보도된 능력을 의미합니다.
| 항목 | V4-Flash-0731 | V4-Pro-0813 | DeepSeek-V4.1 (예상) |
|---|---|---|---|
| 모델 계열 | V4 | V4 | V4 계열의 반복 버전일 가능성 |
| 아키텍처 | V4 기반 MoE 하이브리드 어텐션 | V4 기반 MoE; GA는 프리뷰 구조 위에 구축 | V4 기반일 가능성; 미확정 |
| 총/활성 파라미터 | 284B / 13B | 1.6T / 49B | 불명; 신뢰할 공용 수치 없음 |
| 컨텍스트 윈도우 | 1M | 1M | 최소한 V4 기준선일 가능성 |
| 최대 출력 | 384K API maximum | 384K API maximum | 불명 |
| 사고 노력 | 낮음 / 높음 / 최대 | 낮음 / 높음 / 최대 | 현 제어를 유지 또는 확장할 것으로 예상 |
| Responses API | 지원됨 | 지원됨 | 현 V4 API 스택 기반이라면 예상됨 |
| 네이티브 이미지/파일 입력 | 현재 Responses API에서 미지원 | 현재 Responses API에서 미지원 | 멀티모달 방향으로 보도됨; 미확정 |
| 엔터프라이즈 / 에이전트 도구 | Functions, 웹 검색, apply_patch / Codex 지원 | Functions, 웹 검색, apply_patch / Codex 지원 | 강조된 영역으로 보도됨; MCP 확장은 미확정 |
| 가중치 공개 | 예 | 예, V4-Pro-0813 가중치 제공 | 별도 V4.1 체크포인트에서 가능; 미확정 |
| 공식 상태 | 공개 베타 API 출시 | GA | 공식 출시일이나 모델 카드 없음 |
DeepSeek-V4.1에서 무엇이 새로울 수 있을까?
더 큰 모델 없이 더 강력한 에이전트형 코딩
V4 이후를 가늠할 수 있는 가장 강력한 증거는 이제 V4-Pro-0813 GA 업데이트입니다. DeepSeek는 프로덕션 환경에서 에이전트 역량이 크게 향상되었다고 밝히며, Terminal Bench 2.1은 87.9, NL2Repo는 61.5, DeepSWE는 62.7을 기록했습니다. V4-Flash-0731은 이미 모델 아키텍처나 크기를 변경하지 않고도 재훈련만으로 큰 에이전트 향상을 낼 수 있음을 보여준 바 있습니다.
만약 V4.1이 중간 주기 업데이트라면, 현실적인 목표는 더 이상 “V4 프리뷰보다 더 낫다”가 아닙니다. 장기적인 소프트웨어 실행, 리포지토리 수준의 신뢰성, 도구 오케스트레이션, 프로덕션 일관성을 개선하면서 V4-Pro-0813 에이전트 기준선을 유지하거나 능가해야 합니다.
더 나은 도구 사용과 보다 완전한 에이전트 API
현재 DeepSeek의 V4 스택은 Flash와 Pro 모두에 Responses API 지원을 제공하며, Codex에 맞게 특별히 조정되어 있습니다. Responses API 호환성 표는 함수 호출과 서버 측 웹 검색을 지원하지만, file_search, code_interpreter, computer_use 및 MCP 도구 유형은 아직 무시됩니다. 이는 단순히 Responses API 자체를 추가하는 것보다 더 광범위한 엔터프라이즈 도구 커버리지가 V4.1의 보다 분명한 기회임을 의미합니다.
네이티브 MCP 지원은 여전히 그럴듯한 업그레이드 방향이지만, 아직 미확정입니다. 이미 Responses, Codex 지향 워크플로, 구조화된 출력, 도구 호출을 지원하는 API 표면 위에서 엔터프라이즈와 에이전트의 더 깊은 통합이 설득력 있는 V4.1 가설입니다.
멀티모달 입력은 가장 큰 제품 수준 업그레이드가 될 수 있음
V4.1이 멀티모달 지원과 함께 계획되었다고 보도되었습니다. 이는 현재 DeepSeek Responses API가 이미지와 파일 입력을 지원하지 않는다고 밝히고 있기 때문에 가능한 가장 분명한 제품 수준 차별화 요소로 남아 있습니다. 향후 V4.1 체크포인트가 네이티브 시각 또는 파일 이해를 추가한다면, 현재 텍스트 전용 API가 다루지 않는 문서, 스크린샷, 비주얼 코딩 워크플로로 DeepSeek의 범위를 확장할 것입니다.
DeepSeek가 V4.1 모델 카드나 API 스키마를 공개하기 전까지는 정확한 모달리티, 해상도 제한, 오디오/비디오 동작, 멀티모달 벤치마크는 불명으로 표시되어야 합니다.
DeepSeek 수준의 비용으로 프런티어 성능
낮은 추론 비용은 DeepSeek의 가장 차별화된 강점 중 하나로 남아 있지만, 전체 V4 롤아웃과 함께 공식 가격이 변경되었습니다. 현재 가격표는 피크/오프피크 요금을 사용합니다: V4-Flash 캐시 미스 입력은 오프피크 $0.22 / 피크 $0.44이고 출력은 100만 토큰당 $0.66 / $1.32입니다; V4-Pro 입력은 $0.66 / $1.32이고 출력은 $1.98 / $3.96입니다. 오프피크 요금은 피크의 절반입니다.
DeepSeek-V4.1의 예상 벤치마크 성능
여전히 공식 V4.1 벤치마크 점수는 없습니다. 현재 V4 계열의 가장 강력한 기준선은 DeepSeek-V4-Pro-0813 GA로, 에이전트 성능의 기준점을 Pro Preview에서 대체했습니다. DeepSeek는 Terminal Bench 2.1에서 87.9, NL2Repo에서 61.5, Cybergym에서 83.3, DeepSWE에서 62.7, Toolathlon-Verified에서 74.1을 보고했으며, AutomationBench와 DSBench에서도 향상을 보였습니다.

그림 6. DeepSeek 변경 로그를 바탕으로 시각화한 DeepSeek-V4-Pro-0813 GA 공식 에이전트 벤치마크 값.
| 벤치마크 | V4-Pro-0813 | V4-Flash-0731 | V4-Pro Preview |
|---|---|---|---|
| Terminal Bench 2.1 | 87.9 | 82.7 | 72.1 |
| NL2Repo | 61.5 | 54.2 | 38.5 |
| Cybergym | 83.3 | 76.7 | 52.7 |
| DeepSWE | 62.7 | 54.4 | 12.8 |
| Toolathlon-Verified | 74.1 | 70.3 | 55.9 |
| Agents' Last Exam | 25.7 | 25.2 | 16.5 |
| AutomationBench (Public) | 31.8 | 25.1 | 12.8 |
| DSBench-FullStack | 71.1 | 68.7 | — |
| DSBench-Hard | 67.2 | 59.6 | — |

그림 7. 공통 에이전트 벤치마크에서의 V4-Pro-0813 대비 V4-Flash-0731. 값은 DeepSeek 변경 로그에서 가져왔으며, 평가 하네스와 사고 설정은 교차 모델 비교에 영향을 줄 수 있습니다.
이 진전은 V4.1에 대해 증거 기반으로 세 가지 기대를 시사합니다. 첫째, 의미 있는 V4.1 출시는 오래된 프리뷰를 단순히 능가하는 것이 아니라 최소한 V4-Pro-0813 GA 기준선을 유지해야 합니다. 둘째, DeepSeek는 파라미터 수 확장만이 아니라 후속 학습과 에이전트 최적화를 통해서도 성과를 계속 끌어내고 있습니다. 셋째, 핵심 에이전트 성능이 이미 V4 설계 한계에 근접했다면, 가장 가치 있는 V4.1 업그레이드는 더 넓은 멀티모달 및 엔터프라이즈 도구 역량일 수 있습니다.
DeepSeek-V4.1 vs V4-Flash vs V4-Pro
| 항목 | V4-Flash-0731 | V4-Pro-0813 | DeepSeek-V4.1 예상 |
|---|---|---|---|
| 포지셔닝 | 빠르고 효율적인 에이전트/코딩 모델 | 현재 더 높은 능력의 V4 추론/에이전트 모델 | 중간 주기 V4 기능 업그레이드 가능성 |
| 규모 | 284B 총 / 13B 활성 | 1.6T 총 / 49B 활성 | 불명 |
| 컨텍스트 | 1M | 1M | V4 기반이라면 최소 1M일 가능성 |
| 에이전트 코딩 | 0731 재훈련 이후 매우 강력 | 현재 V4 공식 에이전트 기준선 중 가장 강력 | Pro GA 기준선을 충족 또는 초과할 것으로 예상 |
| 사고 노력 | 낮음 / 높음 / 최대 | 낮음 / 높음 / 최대 | 제어 보존 또는 확장 예상 |
| Responses API | 지원됨 | 지원됨 | 현 V4 스택 기반이라면 예상됨 |
| 멀티모달 입력 | 현재 Responses API에 이미지/파일 입력 없음 | 현재 Responses API에 이미지/파일 입력 없음 | 가능성이 보도됨; 미확정 |
| 공식 API 비용 | 더 낮은 V4 등급; 피크/오프피크 요금제 | 더 높은 V4 등급; 피크/오프피크 요금제 | 불명 |
| 상태 | 퍼블릭 베타의 공식 API 출시 | GA | DeepSeek 미발표 |
DeepSeek-V4.1은 무엇에 사용될까?
만약 보도된 방향이 유지된다면, V4.1은 현재 V4 제품군이 이미 강하지만 더 넓은 제품 역량이 아직 부족한 영역에서 가장 매력적일 것입니다.
-
리포지토리 규모의 코딩 에이전트. 긴 컨텍스트 코드 이해, 패치 생성, 테스트 루프 및 터미널 실행은 V4-Pro-0813과 Flash-0731의 에이전트 향상을 고려할 때 가장 명확한 적합 영역입니다.
-
엔터프라이즈 연구 및 문서 워크플로. 1M 컨텍스트 기준선, Responses API 지원 및 웹/도구 통합은 대규모 내부 지식 세트, 정책 코퍼스 및 기술 문서를 지원할 수 있습니다. V4.1이 더 풍부한 검색 또는 파일 도구를 추가한다면 여기서 더 유용해질 것입니다.
-
비용 민감형 자율 에이전트. V4-Flash는 반복적인 계획 및 도구 호출 루프에 특히 매력적이며, V4-Pro는 더 높은 능력의 티어를 제공합니다. V4.1이 이 비용 규율을 유지한다면 더욱 매력적일 것입니다.
-
시각 문서 및 스크린샷 분석. 이는 보도된 멀티모달 기능이 공식적으로 제공될 때에만 주요 네이티브 사용 사례가 됩니다.
-
프라이빗 또는 맞춤형 배포. DeepSeek는 V4-Pro-0813과 V4-Flash-0731 가중치를 공개했으므로, 별도로 공개되는 V4.1 체크포인트도 셀프 호스팅이나 도메인 적응이 필요한 조직에 매력적일 수 있습니다. V4.1 자체의 공개 가중치 제공 여부는 미확정입니다.
여전히 알 수 없는 것들
가까운 출시를 다루는 글에서 가장 큰 위험은 그럴듯한 추정을 가짜 사양으로 바꾸는 일입니다. DeepSeek가 1차 자료를 공개하기 전까지 다음 항목은 명시적으로 열려 있어야 합니다.
- “DeepSeek-V4.1”이 공식 모델명이 될지 여부.
- V4.1이 V4-Flash-0731 및 V4-Pro-0813을 넘어서는 개선을 위한 별도 라벨인지, 아니면 구분되는 체크포인트인지.
- 총 파라미터 수, 활성 파라미터 수 및 아키텍처 변경 사항.
- 정확한 멀티모달 입력과 이미지, 오디오, 비디오 또는 파일 지원 여부.
- 네이티브 MCP, computer-use, file-search 또는 code-interpreter 지원 여부.
- 공식 벤치마크 점수와 평가 설정.
- 별도 V4.1 체크포인트의 API 가격, 공개 가중치 제공 여부, 상업적 조건, 확정 출시일.
최종 의견
DeepSeek-V4.1이 흥미로운 이유는 현재 V4 사이클이 완전히 새로운 아키텍처를 도입하지 않고도 제품군을 실질적으로 강화할 수 있음을 보여주었기 때문입니다. Flash-0731 후속 학습 업데이트는 큰 에이전트 향상을 제공했고, Pro-0813 GA 릴리스는 네이티브 Responses API 지원과 더 유연한 사고 노력까지 추가하며 그 기준선을 다시 끌어올렸습니다.
따라서 가장 설득력 있는 V4.1 가설은 “수수께끼의 새로운 조 단위 파라미터 모델”이 아니라 보다 성숙한 V4입니다. 더 강력한 프로덕션 에이전트 실행, 더 넓은 엔터프라이즈 도구, 잠재적인 네이티브 멀티모달 입력, 그리고 Flash 효율성과 Pro급 추론의 더 정교한 균형입니다. 핵심 불확실성은 DeepSeek가 이러한 개선을 V4.1이라는 이름으로 공개할지 여부입니다.
개발자는 이미 DeepSeek V4 Flash와 DeepSeek V4 Pro를 CometAPI를 통해 테스트할 수 있으며, 별도 모델이 가시화될 경우 DeepSeek V4.1 페이지를 통해 CometAPI 가용성을 추적할 수 있습니다. CometAPI는 각 제공자별로 통합을 다시 구축할 필요 없이 다양한 프런티어 모델을 비교할 수 있는 통합 API 레이어를 제공합니다.
