TLDR DeepSeek Harness는 종종 작업을 더 빠르고 훨씬 낮은 비용으로 완료합니다(DeepSeek 모델과 조합할 때 토큰 기준으로 약 50–57배 저렴한 경우도 있음). 반면 Claude Code는 대체로 품질이 높고 컨텍스트 이해가 더 뛰어나며 클라이언트 인도 수준의 결과물을 안정적으로 제공합니다.
DeepSeek Harness(DSH / dsh)는 2026년 8월 13일경 개발자 프리뷰로 공개된 MIT 라이선스의 완전한 오픈 소스, 모델 비종속 에이전트 런타임으로, “모든 것은 플러그인”이라는 원칙에 기반합니다. Claude Code는 Anthropic의 성숙한 클로즈드 소스, 프로덕션 준비 완료 코딩 에이전트로 Claude 모델과 긴밀히 통합되어 있으며 구독 또는 API로 이용할 수 있습니다. 기능(파일 편집, 셸 도구, 하위 에이전트, 플래닝)은 크게 수렴했지만, 결정적 차이는 개방성/감사 가능성, 모델 락인, 비용 구조, 확장성, 성숙도입니다. 많은 팀이 둘 다 함께 사용하거나, DeepSeek Harness로 Claude Code를 하위 에이전트로 오케스트레이션합니다. 유연한 멀티 모델 접근을 경쟁력 있는 요금으로 원한다면 CometAPI 같은 통합 게이트웨이를 통해 요청을 라우팅하세요.
핵심 요약
- DeepSeek Harness는 오픈 소스(MIT), 로컬 우선, 모델 비종속이며 Cordis 플러그인으로 높은 확장성을 제공합니다; 여전히 개발자 프리뷰 단계로, 호환성 깨짐 변경이 예상됩니다.
- Claude Code는 강력한 IDE/터미널 통합, 성숙한 권한/샌드박싱, Claude 모델에 최적화된 정교함을 갖춘 상용 제품입니다.
- 실사용 테스트(동일 프롬프트): 어떤 사례에서는 DeepSeek Harness가 약 11분에 빌드를 완료한 반면 Claude Code는 30분을 넘어 계속 실행되었습니다; 토큰을 더 많이 사용하더라도 토큰 비용은 DeepSeek 쪽이 크게 유리할 수 있습니다.
- 프로덕션 산출물의 품질과 신뢰성은 현재 Claude Code가 우세합니다; 소유권, 비용 통제, 커스터마이징은 DeepSeek Harness가 유리합니다.
- 둘을 결합할 수 있습니다: DeepSeek Harness는 Claude Code(또는 Codex)를 하위 에이전트로 호출할 수 있습니다.
- CometAPI 같은 통합 API 레이어를 사용하면 하나의 키와 OpenAI 호환 엔드포인트로 DeepSeek V4-Pro/Flash, Claude 모델 및 500개 이상의 다른 모델에 접근할 수 있으며, 통상 20–40% 낮은 실효 비용을 기대할 수 있습니다.
What Is DeepSeek Harness?
DeepSeek Harness(명령줄 이름 dsh)는 DeepSeek AI가 개발한 오픈 소스 에이전트 런타임으로, 공식 DeepSeek V4-Pro 모델과 함께 2026년 8월 13일 MIT 라이선스로 공개되었습니다.
DeepSeek는 근본적인 등식을 이렇게 제시합니다: Agent = Model + Harness. 모델은 ‘두뇌’입니다. 하니스는 모델이 현실 세계에서 행동하도록 하는 나머지 모든 것을 제공합니다: 도구 호출, 파일 시스템 접근, 터미널/샌드박스 실행, 세션 메모리, 플래닝, 하위 에이전트, 권한 정책, 사용자 인터페이스.
핵심 설계 철학은 “Everything is a Plugin”입니다. Cordis 플러그인 시스템 위에 구축되어 모델 어댑터, 도구, 스킬, 세션, 샌드박스, 스토리지, 에이전트 루프 자체, 스케줄링, 심지어 UI까지 사실상 모든 구성요소가 교체 가능한 플러그인입니다. 개발자는 소스 코드를 수정하지 않고 구성만으로 전체 런타임을 재구성할 수 있습니다.
주요 기술 하이라이트:
- 기본 제공 로컬 Web UI (http://127.0.0.1:3080)
- 스크립팅과 CI를 위한 헤드리스/CLI 모드
- 다양한 런타임 프로필(Standard, Code/PTC, 벤치마크용 Minimal, Creator)
- 완전한 감사 가능성과 재실행을 위한 추가 전용 트래젝터리/이벤트 로그
- 기본 제한형 샌드박스(bwrap/Landlock 스타일)
- 다른 에이전트를 하위 에이전트로 호출하는 기능(Claude Code 또는 Codex 포함)
- Python SDK와 성장하는 플러그인 생태계
프로젝트는 공개 며칠 만에 100,000–190,000+ GitHub 스타를 넘기는 이례적인 초기 인기를 얻었으며, 폐쇄형 코딩 에이전트에 대한 오픈 대안을 향한 개발자들의 강한 관심을 반영합니다.
What Is Claude Code?
Claude Code는 Anthropic의 전용 AI 코딩 에이전트입니다. 주로 터미널 CLI로 실행되며 VS Code, JetBrains IDE, 데스크톱 앱, 브라우저, 모바일, Slack, GitHub 워크플로우(액션, PR 리뷰, 이슈→PR 플로우 포함)와 깊이 통합되어 있습니다. Claude 모델(Opus, Sonnet, Haiku 계열; 2026 라인업에서는 흔히 Opus 5 / Sonnet 5 등으로 언급) 최적화된 클로즈드 소스 상용 제품입니다.
파일 읽기/편집, 셸 명령 실행, 플래닝, 하위 에이전트, 스킬, 훅, MCP 클라이언트 지원, 승인 프롬프트가 포함된 성숙한 권한/샌드박스 시스템 등의 내장 도구를 제공합니다. 컨텍스트 관리, 검증, 완성도가 강점입니다. 가격은 보통 Claude Pro/Max 구독(티어와 사용량에 따라 월 $20–$200 범위) 또는 직접 API 과금이며; 사용량은 Claude 전반의 서피스 간에 풀을 공유하며 overfl
DeepSeek Harness vs Claude Code: Head-to-Head Comparison Table
| 항목 | DeepSeek Harness (DSH) | Claude Code |
|---|---|---|
| 출처 / 라이선스 | DeepSeek AI, MIT 오픈 소스 | Anthropic, 독점 상용 |
| 상태(2026년 8월) | 개발자 프리뷰(호환성 깨짐 변경 예상) | 안정적인 프로덕션 제품 |
| 모델 락인 | 없음 — 어떤 OpenAI 호환 엔드포인트도 사용 가능 | 주로 Claude 모델(Bedrock/Vertex 옵션) |
| 주요 인터페이스 | 로컬 웹 UI, 헤드리스 CLI, Python SDK | 터미널 CLI, VS Code, JetBrains, 데스크톱 등 |
| 확장성 | 모든 것이 Cordis 플러그인 | 스킬, 훅, 플러그인(프리뷰), MCP |
| 감사 가능성 | 전체 소스 + 트래젝터리 뷰 | 클로즈드 구현 |
| 샌드박스 / 권한 | 구성 가능한 플러그인(bwrap/Landlock 기본) | 성숙한 내장 프롬프트와 제어 |
| 비용 모델 | 라이선스 무료; 모델 API 비용만 지불 | 구독(월 $20–$200) 또는 API 요금 |
| 하위 에이전트 / 스킬 | 예; Claude Code/Codex를 프로바이더로 호출 가능 | 예 |
| 세션 지속성 | 예(검색 가능한 로컬 스토리지) | 예 |
| 적합한 용도 | 커스터마이징, 멀티 모델, 비용 통제, 감사 | 신뢰성, 완성도, 프로덕션 배포 |
Architecture Deep Dive
그 상충관계는 강조할 가치가 있습니다:
- DeepSeek Harness는 결정해야 할 것을 더 많이 제공합니다.
- Claude Code는 신경 써야 할 것을 더 적게 만듭니다.
많은 소프트웨어 팀에게 두 번째 진술은 제한이 아니라 오히려 장점입니다.
DeepSeek Harness – Cordis & Everything Is a Plugin
DeepSeek Harness는 인프라입니다.
그 주요 가치 제안은 단지 코드를 작성할 수 있다는 점이 아닙니다.
더 깊은 가치 제안은 개발자가 모델을 둘러싼 기계를 바꿀 수 있다는 점입니다.
팀은 이론적으로 다음을 원할 수 있습니다:
- 기저 모델을 교체
- 도구 레이어를 변경
- 맞춤 샌드박스를 구현
- 에이전트 루프를 수정
- 독자적 메모리를 추가
- 특화 하위 에이전트를 생성
- UI를 교체
- 세션 지속성 방식을 변경
- 새 런타임 모드를 구축
- 내부 보안 통제를 구현
DeepSeek Harness는 이 수준의 조합 가능성을 중심으로 설계되었습니다.
런타임은 플러그인 조합 프레임워크인 Cordis 위에 구축되어 있습니다. 사실상 특권적인 코어가 없습니다: 에이전트 루프 자체가 플러그인입니다. 이로써 극도의 유연성이 가능해집니다—메인 저장소를 포크하지 않고도 모델 프로바이더를 교체하고, 도구 레지스트리를 바꾸고, 샌드박스 정책을 변경하거나, 심지어 플래닝 루프를 다시 작성할 수 있습니다. 프로필과 번들은 사용자가 구성을 깔끔하게 적층할 수 있게 합니다. 트래젝터리 로그는 모든 단계(시스템 프롬프트, 도구 호출, 추론, 하위 에이전트 스케줄링)를 검사 및 재실행 가능하게 합니다.
Claude Code – Opinionated Product Layer
Code Mode는 특히 흥미로운 설계를 도입합니다.
모델은 Code Mode SDK를 사용해 생성된 TypeScript 프로그램을 통해 여러 라운드의 도구 호출을 오케스트레이션할 수 있습니다.
개념적으로 이는 단순히 개별 도구 호출을 한 번에 하나씩 내리는 것을 넘어, 에이전트가 더 높은 수준의 절차를 구성하도록 해줍니다.
이 접근법은 다음에 잠재적 가치를 제공합니다:
- 복잡한 자동화
- 반복적인 다단계 작업
- 긴 에이전트 워크플로우
- 맞춤 오케스트레이션 로직
Anthropic은 Claude의 강점에 최적화된 세심하게 설계된 클로즈드 에이전트 루프를 제공합니다. 확장은 잘 정의된 서피스(스킬, 훅, MCP)를 통해 이뤄집니다. 코어는 여전히 독점으로 유지되어 내부의 신속한 반복과 일관된 사용자 경험을 가능하게 하지만, 깊은 커스터마이징과 독립적인 감사는 제한됩니다.
Performance, Speed, Quality, and Real-World Tests
동일한 프롬프트로 실행한 독립적 테스트(예: 회계법인 웹사이트나 기타 다중 파일 프로젝트 전체 빌드)에서 분명한 패턴이 보고되었습니다:
- 속도: DeepSeek Harness는 완전 빌드를 약 11분에 끝내는 경우가 잦았고, 같은 사례에서 Claude Code는 30분이 지나도 계속 작업 중이었습니다. 동일 모델 테스트(둘 다 Claude Opus급 모델 사용)에서도 DSH가 약 3분에 끝낸 반면 Claude Code는 약 17분이 걸린 경우가 있었습니다. 토큰 효율은 때로 Claude Code가 유리했지만(예: 한 번의 실행에서 48k 토큰 vs 483k), 경과 시간은 종종 하니스가 우위였습니다.
- 품질: Claude Code는 완성도, 비즈니스 컨텍스트의 자발적 활용, 시각/UX 감각, 전반적 “클라이언트 인도” 수준에서 일관되게 높은 점수를 받았습니다. 한 상세 비교에서 테스터들은 Claude Code를 약 9/10, DeepSeek Harness를 약 7/10으로 평가했으며; 어느 팀도 일상 워크플로우를 완전히 Claude Code에서 벗어나진 않았지만, 특정 작업은 DSH로 옮겼습니다. 동일 모델 테스트에서는 테스트 스위트를 통과하는 바이트 동일 패치를 생성하기도 했는데, 시간 차이는 존재했습니다(윈도우 환경의 한 실행에서는 승인 이후 Claude Code가 더 빨랐음).
- 성숙도 및 신뢰성: 장시간 세션, 심층 작업, 시각적 검증, 신뢰 가능한 산출물이 필요한 경우 Claude Code가 우세합니다. DeepSeek Harness(v0.1 프리뷰)는 여전히 버그, 컨텍스트 이슈, 특정 모델에서 약한 검증을 보입니다. 반면 빠른 리서치, 병렬/오버플로 작업, 저비용 태스크에 강점을 보입니다.
모델 자체(DeepSeek V4 시리즈 vs Claude Opus/Sonnet 계열)에 관한 벤치마크 맥락에서는 SWE-bench 스타일 소프트웨어 엔지니어링과 전반적 코딩 지수에서 Claude가 종종 앞서지만, DeepSeek 모델은 LiveCodeBench/알고리즘 과제에서 매우 경쟁력이 있으면서 훨씬 저렴합니다. 하니스 자체도 에이전틱 결과에 큰 영향을 미칩니다—도구 정의, 재시도 로직, 샌드박스 동작, 컨텍스트 관리가 기반 모델만큼 중요합니다.
Cost Analysis
DeepSeek Harness 자체는 라이선스 비용이 0입니다. 기본 모델 프로바이더 요금만 지불하면 됩니다. DeepSeek V4-Flash와 V4-Pro는 가장 비용 효율적인 프런티어 옵션에 속하며(Flash는 입력/출력 기준 백만당 약 $0.14/$0.28, Pro는 더 높지만 여전히 낮은 편; 정확한 현재 가격과 캐싱에 따라 달라짐), 실제 실행에서 상당한 빌드가 약 5센트로 끝나는 반면 동등한 Claude 사용 비용은 훨씬 높을 수 있습니다.
Claude Code 가격은 예측 가능한 고사용량에 적합한 구독 지향(가벼운 용도는 $20 Pro, 더 높은 Max 티어는 더 비쌈) 또는 순수 API 과금입니다. 개인 또는 팀의 고사용량은 월 수백~수천 달러에 이를 수 있습니다. 한 분석에서는 개인 헤비 유저의 연간 비용을 Claude Code 약 $1,200으로, DeepSeek 기반 워크플로우의 토큰 비용은 대략 $240–$600으로 전망했습니다. 토큰 단위 비교에서는 모델과 캐싱에 따라 DeepSeek 쪽이 10–57배 저렴한 경우가 자주 관찰됩니다.
팀 환경에서는 작업의 하위 단계를 저렴한 모델과 프리미엄 모델에 적절히 라우팅해 절감 폭이 커집니다. DSH가 저렴한 모델로 벌크 작업을 처리하고, 중요한 경로는 Claude Code로 맡기는 하이브리드 구성이 실용적입니다.
Extensibility, Security, and Ownership
DeepSeek Harness의 플러그인 아키텍처(Cordis)는 모델 어댑터, 도구, 에이전트 루프, 샌드박스, 스토리지, UI 등 거의 모든 컴포넌트를 교체할 수 있게 합니다. 이는 심층 커스터마이징, 자체 호스팅, 컴플라이언스/감사 요구사항 충족, 커스텀 플러그인/스킬 배포를 가능하게 합니다. 자격 증명은 강력한 로컬 권한(예: 0600)으로 관리됩니다. 샌드박스 기본값은 제한적입니다.
Claude Code는 스킬, 훅, MCP, 플러그인 등을 통한 강력한 확장성과 성숙한 권한 시스템을 제공하지만, 코어 에이전트 루프와 구현은 클로즈드로 남아 있습니다. 내부를 감사하거나 완전히 재구성할 수는 없습니다. 규제를 받는 환경이나 에이전트 런타임에 대한 완전한 통제가 필요한 조직에는 DSH가 구조적 이점을 가집니다.
둘 모두 하위 에이전트 및 멀티 에이전트 패턴을 지원합니다. 특히 DSH가 Claude Code 자체를 하위 에이전트로 호출할 수 있다는 점은 실용적인 브리지입니다.
How to Get Started and Practical Recommendations
DeepSeek Harness: npm/pnpm으로 설치(Node.js/TypeScript 기반)하고, 모델 엔드포인트와 플러그인을 구성한 뒤 로컬 Web UI 또는 헤드리스 모드로 실행합니다. 프리뷰가 진화하는 동안 반복을 예상하세요.
npx @deepseek-ai/dsh web
로컬 Web UI를 엽니다. DeepSeek 또는 호환 엔드포인트의 API 키를 제공하세요. 전체 소스: https://github.com/deepseek-ai/deepseek-harness
Claude Code: Anthropic 패키지를 전역 npm 설치 후, 프로젝트 디렉터리에서 실행합니다. 강력한 공식 문서와 IDE 확장으로 진입 장벽이 낮습니다.
하이브리드 & 멀티 모델 전략: 많은 실무자는 일상적이고 신뢰가 필요한 작업에는 Claude Code를 기본 드라이버로 유지하고, 비용 민감하거나 실험적 작업에는 DeepSeek Harness를 사용합니다. DSH가 Claude Code를 하위 에이전트로 호출할 수 있으므로, 하위 작업별로 최적의 도구를 선택하는 오케스트레이션 레이어를 설계할 수 있습니다.
Recommended API Access via CometAPI
두 생태계를 모두 시험해 보되 여러 벤더의 계정, 키, 결제를 따로 관리하고 싶지 않다면, CometAPI가 하나의 OpenAI 호환 엔드포인트(https://api.cometapi.com/v1)와 단일 API 키로 500개+ 모델(DeepSeek V4-Pro/Flash 및 비전 변형, Claude 모델(Opus/Sonnet/Haiku 계열) 등)에 접근하도록 지원합니다. 가격은 일반적으로 공식 벤더 요금 대비 20–40% 낮은 종량제이며, 월 최소 사용량 없이 무료 체험 크레딧과 엔터프라이즈 친화 기능(SLA, 통합 청구, 낮은 지연)을 제공합니다.
DeepSeek Harness(또는 베이스 URL 오버라이드가 가능한 경우 Claude Code)에서 CometAPI 엔드포인트를 사용하도록 지정할 수 있습니다. 이는 워크플로우 중간에 모델을 전환하거나 하니스+모델 조합 A/B 테스트, 비용 통제를 단순화하면서 최신 DeepSeek 및 Claude 기능에 접근하는 데 유리합니다. 문서와 모델 카탈로그는 cometapi.com과 apidoc.cometapi.com에서 확인할 수 있습니다. 이 방식은 에이전트 런타임을 평가하거나 내부 멀티 모델 에이전트 플랫폼을 구축하는 팀에 특히 유용합니다.
When to Choose Which (Decision Framework)
- 오늘 당장 최대의 신뢰성과 완성도가 필요하고, Anthropic 생태계에서 작업하며, IDE 통합과 벤더 지원을 중시하거나, 기한이 촉박한 클라이언트/프로덕션 코드를 배포해야 한다면 Claude Code를 선택하세요.
- 오픈 소스 감사 가능성, 모델 자유(로컬/멀티 프로바이더 포함), 에이전트 루프/도구의 심층 커스터마이징, 가능한 최저 비용을 우선시하거나 에이전트 인프라를 구축/연구 중이라면 DeepSeek Harness를 선택하세요. 프리뷰 단계의 마찰을 수용해야 합니다.
- 대부분의 프로페셔널 환경에서는 둘 다(또는 DSH가 Claude Code를 오케스트레이션) 사용하는 것이 좋습니다: 작업 클래스별로 최적 도구를 쓰고 비용/품질 트레이드오프를 최적화하세요.
- CometAPI 같은 통합 게이트웨이를 사용해 모델 전환을 사소하게 만들고 전체 지출을 예측 가능하게 유지하세요.
Conclusion
DeepSeek Harness와 Claude Code의 비교는 단순한 “무엇이 더 낫나”의 문제가 아니라, 두 가지 상이한 철학의 대조입니다. Claude Code는 대부분의 개발자가 오늘 프로덕션 작업에 사용해야 할 정제된, 즉시 배포 가능한 코딩 에이전트입니다. DeepSeek Harness는 커뮤니티가 에이전트 레이어 자체에 대한 소유권을 갖고 어떤 모델이든 플러그인할 자유를 제공하는 개방적이고 조합 가능한 섀시입니다.
