TLDR DeepSeek Harness spesso conclude le attività più rapidamente e a costi drasticamente inferiori (talvolta ~50–57× più economico in termini di token se abbinato ai modelli DeepSeek), mentre Claude Code generalmente produce output di qualità superiore, più consapevole del contesto, pronto per il cliente e offre maggiore stabilità.
DeepSeek Harness (DSH / dsh), rilasciato in anteprima per sviluppatori intorno al 13 agosto 2026, è un runtime di agenti completamente open source con licenza MIT e agnostico rispetto al modello, costruito sul principio che “everything is a plugin”. Claude Code è l’agente di coding maturo, closed-source e pronto per la produzione di Anthropic, strettamente integrato con i modelli Claude e disponibile tramite abbonamento o API. Le capacità (modifica file, strumenti shell, sotto-agent, pianificazione) si sono in gran parte allineate, ma le differenze decisive sono apertura/auditabilità, lock-in di modello, modello di costo, estensibilità e maturità. Molti team utilizzano entrambi—o usano DeepSeek Harness per orchestrare Claude Code come sotto-agente. Per un accesso flessibile e multi-modello a tariffe competitive, instrada le richieste attraverso un gateway unificato come CometAPI.
Key Takeaways
- DeepSeek Harness è open source (MIT), local-first, agnostico rispetto al modello e altamente estensibile tramite plugin Cordis; è ancora un’anteprima per sviluppatori con possibili breaking change.
- Claude Code è un prodotto commerciale raffinato con solide integrazioni IDE/terminal, sistemi maturi di permessi/sandboxing e un’ottimizzazione stretta per i modelli Claude.
- Test reali (prompt identici): DeepSeek Harness ha completato build in ~11 minuti contro Claude Code ancora in esecuzione oltre i 30 minuti in un caso; i costi dei token possono favorire DeepSeek con ampi margini anche quando consuma più token.
- Qualità e affidabilità favoriscono attualmente Claude Code per deliverable di produzione; proprietà, controllo dei costi e personalizzazione favoriscono DeepSeek Harness.
- Puoi combinarli: DeepSeek Harness può chiamare Claude Code (o Codex) come sotto-agente.
- Usa un livello API unificato come CometAPI per accedere a DeepSeek V4-Pro/Flash, ai modelli Claude e a 500+ altri con una singola chiave, endpoint compatibili con OpenAI e costi effettivi tipicamente inferiori del 20–40%.
What Is DeepSeek Harness?
DeepSeek Harness (nome da riga di comando dsh) è un runtime di agenti open source sviluppato da DeepSeek AI e rilasciato sotto licenza MIT il 13 agosto 2026, insieme al modello ufficiale DeepSeek V4-Pro.
DeepSeek inquadra l’equazione fondamentale come Agente = Modello + Harness. Il modello è il “cervello”. L’harness fornisce tutto il resto che consente al modello di agire nel mondo reale: invocazione di strumenti, accesso al file system, esecuzione in terminale/sandbox, memoria di sessione, pianificazione, sotto-agenti, politiche di permesso e un’interfaccia utente.
La sua filosofia di design principale è “Tutto è un plugin.” Costruito sul sistema di plugin Cordis, praticamente ogni componente—adapter di modello, strumenti, competenze, sessioni, sandbox, storage, il loop dell’agente stesso, scheduling e persino la UI—è un plugin sostituibile. Gli sviluppatori possono ricomporre l’intero runtime tramite configurazione senza modificare il codice sorgente.
Highlight tecnici chiave:
- Interfaccia Web locale di default (http://127.0.0.1:3080)
- Modalità headless/CLI per scripting e CI
- Profili runtime multipli (Standard, Code/PTC, Minimal per benchmarking, Creator)
- Log di traiettoria/eventi append-only per completa auditabilità e replay
- Sandbox ristretta di default (stile bwrap/Landlock)
- Capacità di chiamare altri agenti (inclusi Claude Code o Codex) come sotto-agenti
- SDK Python e un ecosistema di plugin in crescita
Il progetto ha raggiunto una popolarità precoce straordinaria, superando ben oltre 100,000–190,000+ stelle su GitHub in pochi giorni dal rilascio, riflettendo un forte interesse degli sviluppatori per un’alternativa open agli agenti di coding chiusi.
What Is Claude Code?
Claude Code è l’agente di coding dedicato di Anthropic. Funziona principalmente come CLI da terminale con profonde integrazioni in VS Code, IDE JetBrains, app desktop, browser, mobile, Slack e flussi di lavoro GitHub (inclusi Actions, review di PR e flussi da issue a PR). È un prodotto commerciale closed-source ottimizzato per i modelli Claude (famiglie Opus, Sonnet, Haiku nella lineup 2026, spesso riferite come Opus 5 / Sonnet 5 ecc.).
Offre strumenti integrati per leggere/modificare file, eseguire comandi shell, pianificazione, sotto-agenti, competenze, hook, supporto client MCP e sistemi maturi di permessi/sandbox con prompt di approvazione. Gestione del contesto, verifica e rifinitura sono punti di forza. La tariffazione è tipicamente tramite abbonamenti Claude Pro/Max (gamma $20–$200/mese a seconda del livello e dell’uso) o fatturazione API diretta; gli utilizzi condividono pool attraverso le superfici Claude con overfl
DeepSeek Harness vs Claude Code: Head-to-Head Comparison Table
| Dimensione | DeepSeek Harness (DSH) | Claude Code |
|---|---|---|
| Origine / Licenza | DeepSeek AI, MIT open source | Anthropic, commerciale proprietario |
| Stato (Ago 2026) | Anteprima per sviluppatori (possibili breaking change) | Prodotto stabile per la produzione |
| Lock-in di modello | Nessuno — qualsiasi endpoint compatibile OpenAI | Principalmente modelli Claude (opzioni Bedrock/Vertex) |
| Interfacce principali | Web UI locale, CLI headless, SDK Python | CLI da terminale, VS Code, JetBrains, desktop, ecc. |
| Estensibilità | Tutto è un plugin Cordis | Skills, hook, plugin (anteprima), MCP |
| Auditabilità | Codice completo + vista della traiettoria | Implementazione chiusa |
| Sandbox / Permessi | Plugin configurabili (default bwrap/Landlock) | Prompt e controlli integrati e maturi |
| Modello di costo | Licenza gratuita; si pagano solo i costi API del modello | Abbonamento ($20–$200/mese) o tariffe API |
| Sotto-agent / Skill | Sì; può chiamare Claude Code/Codex come provider | Sì |
| Persistenza sessione | Sì (storage locale ricercabile) | Sì |
| Migliore per | Personalizzazione, multi-modello, controllo dei costi, audit | Affidabilità, rifinitura, distribuzione in produzione |
Architecture Deep Dive
Vale la pena enfatizzare questo trade-off:
- DeepSeek Harness ti dà più cose da decidere.
- Claude Code ti dà meno cose di cui preoccuparti.
Per molti team software, la seconda affermazione è una caratteristica piuttosto che una limitazione.
DeepSeek Harness – Cordis & Everything Is a Plugin
DeepSeek Harness è infrastruttura.
Il suo valore principale non è semplicemente che può scrivere codice.
Il suo valore più profondo è che lo sviluppatore può cambiare la macchina intorno al modello.
Un team potrebbe teoricamente voler:
- Sostituire il modello sottostante
- Cambiare il livello degli strumenti
- Implementare una sandbox personalizzata
- Modificare il loop dell’agente
- Aggiungere memoria proprietaria
- Creare sotto-agent specializzati
- Sostituire la UI
- Cambiare la persistenza della sessione
- Costruire nuove modalità runtime
- Implementare controlli di sicurezza interni
DeepSeek Harness è progettato per questo livello di componibilità.
Il runtime è costruito su Cordis, un framework di composizione di plugin. In pratica non esiste un core privilegiato: lo stesso loop dell’agente è un plugin. Questo consente un’estrema flessibilità—sostituire il provider del modello, rimpiazzare il registro degli strumenti, cambiare la policy della sandbox o persino riscrivere il loop di pianificazione senza fare fork del repository principale. Profili e bundle consentono di stratificare le configurazioni in modo pulito. I log di traiettoria rendono ogni passo (prompt di sistema, chiamata di strumento, ragionamento, scheduling dei sotto-agent) ispezionabile e riproducibile.
Claude Code – Opinionated Product Layer
ode mode introduce un design particolarmente interessante.
Il modello può usare un Code Mode SDK per orchestrare più round di chiamate a strumenti attraverso programmi TypeScript generati.
Concettualmente, questo può consentire a un agente di costruire procedure di livello superiore invece di emettere semplicemente singole chiamate a strumenti una alla volta.
Questo approccio è potenzialmente prezioso per:
- Automazione complessa
- Attività ripetitive multi-step
- Lunghi workflow di agenti
- Logica di orchestrazione personalizzata
Anthropic distribuisce un loop di agente attentamente ingegnerizzato e chiuso, ottimizzato per i punti di forza di Claude. L’estensione avviene attraverso superfici ben definite (Skills, hook, MCP). Il core rimane proprietario, il che consente un’iterazione interna rapida e un’esperienza utente più coerente ma limita la personalizzazione profonda e l’audit indipendente.
Performance, Speed, Quality, and Real-World Tests
Tester indipendenti che eseguono prompt identici (ad esempio, costruire un sito web completo per uno studio di contabilità o altri progetti multi-file) hanno riportato pattern chiari:
- Velocità: DeepSeek Harness ha spesso terminato build complete in ~11 minuti mentre Claude Code era ancora in esecuzione oltre i 30 minuti. In altri test con lo stesso modello (entrambi usando modelli classe Claude Opus), DSH ha completato attività in ~3 minuti contro ~17 minuti per Claude Code. L’efficienza in termini di token talvolta favoriva Claude Code (ad es., 48k token vs 483k in una run), ma il tempo effettivo spesso favoriva l’harness.
- Qualità: Claude Code ha costantemente ottenuto punteggi più alti per rifinitura, uso non sollecitato del contesto di business, impressione visiva/UX e aspetto complessivo “pronto per il cliente”. I tester hanno valutato Claude Code ~9/10 e DeepSeek Harness ~7/10 in un confronto dettagliato; nessun team ha spostato completamente i flussi di lavoro quotidiani da Claude Code, ma entrambi hanno spostato attività specifiche su DSH. Test con lo stesso modello hanno talvolta prodotto patch byte-identiche che superavano le suite di test, con differenze di tempo (Claude Code più veloce in una run su Windows dopo approvazioni).
- Maturità e Affidabilità: Claude Code vince per sessioni lunghe, lavori approfonditi, verifica visiva e deliverable che devono essere affidabili. DeepSeek Harness (v0.1 anteprima) mostra ancora bug, problemi di contesto e una verifica più debole con alcuni modelli. Brilla per ricerca rapida, lavoro parallelo/overflow e attività a basso costo.
Il contesto dei benchmark sui modelli stessi (serie DeepSeek V4 vs famiglie Claude Opus/Sonnet) mostra Claude spesso in testa su indici di ingegneria del software in stile SWE-bench e nel coding complessivo, mentre i modelli DeepSeek sono altamente competitivi su LiveCodeBench/compiti algoritmici e molto più economici. L’harness stesso influenza significativamente gli esiti agentici—definizioni degli strumenti, logica di retry, comportamento della sandbox e gestione del contesto contano tanto quanto il modello sottostante.
Cost Analysis
DeepSeek Harness in sé ha costo di licenza zero. Paghi solo le tariffe del provider del modello sottostante. DeepSeek V4-Flash e V4-Pro sono tra le opzioni di frontiera più convenienti (~$0.14/$0.28 per milione di input/output per Flash e più alto ma comunque basso per Pro, soggetto ai prezzi e al caching correnti). Esecuzioni reali sono costate ~5 centesimi per build sostanziali rispetto a un uso Claude equivalente molto più alto.
I prezzi di Claude Code sono orientati all’abbonamento per un uso intenso prevedibile ($20 Pro per uso leggero, livelli Max più alti per uso intenso/parallelo) o puramente API. Un uso intenso da parte di singoli o team può raggiungere centinaia o migliaia di dollari al mese. Un’analisi ha proiettato costi annuali per un utente singolo intensivo di ~$1,200 per Claude Code contro circa $240–$600 in token per workflow basati su DeepSeek. Confronti a livello di token mostrano frequentemente DeepSeek 10–57× più economico a seconda dei modelli esatti e del caching.
Per i team, la flessibilità di instradare diversi sottocompiti verso modelli economici vs premium (o modelli locali) amplifica i risparmi. Setup ibridi—DeepSeek Harness che orchestra modelli più economici per il lavoro massivo e Claude Code per i percorsi critici—sono pratici.
Extensibility, Security, and Ownership
L’architettura a plugin (Cordis) di DeepSeek Harness consente di sostituire quasi qualsiasi componente: adapter di modello, strumenti, il loop dell’agente, sandbox, storage e UI. Questo abilita personalizzazione profonda, self-hosting, requisiti di compliance/audit e distribuzione di plugin/skill personalizzati. Le credenziali sono gestite con forti permessi locali (ad es., 0600). I default della sandbox sono restrittivi.
Claude Code offre forte estensibilità tramite skills, hook, MCP e plugin, oltre a sistemi di permessi maturi, ma il loop dell’agente e l’implementazione core restano chiusi. Non puoi auditare o ricostruire completamente gli internals. Per ambienti regolamentati o organizzazioni che richiedono pieno controllo del runtime dell’agente, DSH ha un vantaggio strutturale.
Entrambi supportano sotto-agent e pattern multi-agente. La capacità di DSH di invocare lo stesso Claude Code come sotto-agente è un ponte pratico notevole.
How to Get Started and Practical Recommendations
DeepSeek Harness: Installa via npm/pnpm (basato su Node.js/TypeScript), configura endpoint di modello e plugin, lancia la Web UI locale o la modalità headless. Aspettati iterazioni mentre l’anteprima evolve.
npx @deepseek-ai/dsh web
Apre la Web UI locale. Fornisci una chiave API per DeepSeek o qualsiasi endpoint compatibile. Sorgente completo: https://github.com/deepseek-ai/deepseek-harness
Claude Code: Installazione globale npm del pacchetto Anthropic, poi esecuzione nelle directory del progetto. Documentazione ufficiale solida e estensioni IDE abbassano la barriera.
Strategia Ibrida & Multi-Modello: Molti professionisti mantengono Claude Code come driver affidabile quotidiano e usano DeepSeek Harness per lavoro sensibile ai costi o sperimentale. Poiché DSH può chiamare Claude Code come sotto-agente, puoi progettare layer di orchestrazione che scelgono il miglior strumento per sottocompito.
Recommended API Access via CometAPI
Per sviluppatori che vogliono sperimentare con entrambi gli ecosistemi senza gestire più account vendor, chiavi e fatturazioni, CometAPI fornisce un singolo endpoint compatibile con OpenAI (https://api.cometapi.com/v1) e una chiave API per 500+ modelli, inclusi DeepSeek V4-Pro/Flash (e varianti vision), modelli Claude (famiglie Opus/Sonnet/Haiku) e molti altri. I prezzi sono tipicamente inferiori del 20–40% rispetto alle tariffe ufficiali dei vendor su base pay-as-you-go, senza minimi mensili, crediti di prova gratuiti e funzionalità orientate all’impresa (SLA, billing unificato, bassa latenza).
Puoi puntare DeepSeek Harness (o Claude Code tramite override della base URL compatibile con Anthropic) agli endpoint CometAPI. Questo semplifica il cambio di modelli a metà workflow, l’A/B testing di combinazioni harness + modello e il controllo dei costi mantenendo accesso alle capacità più recenti di DeepSeek e Claude. Documentazione e cataloghi dei modelli sono disponibili su cometapi.com e apidoc.cometapi.com. Questo approccio è particolarmente utile per team che valutano runtime di agenti o costruiscono piattaforme interne multi-modello.
When to Choose Which (Decision Framework)
- Scegli Claude Code se ti serve oggi il massimo dell’affidabilità e della rifinitura, lavori nell’ecosistema Anthropic, valorizzi le integrazioni IDE e il supporto del vendor o distribuisci codice client-facing/in produzione con scadenze.
- Scegli DeepSeek Harness se dai priorità all’auditabilità open source, alla libertà di modello (inclusi modelli locali o multi-provider), alla personalizzazione profonda del loop/degli strumenti dell’agente, al costo più basso possibile o se stai costruendo/ricercando infrastruttura di agenti. Accetta l’attrito da fase di anteprima.
- Scegli entrambi (o DSH che orchestra Claude Code) per la maggior parte degli ambienti professionali: usa il miglior strumento per ciascuna classe di compito e ottimizza il trade-off costo/qualità.
- Usa un gateway unificato come CometAPI per rendere banale il cambio di modello e mantenere la spesa complessiva prevedibile.
Conclusion
DeepSeek Harness vs Claude Code non è un semplice “qual è migliore”—è un confronto tra due filosofie diverse. Claude Code è l’agente di coding raffinato e pronto alla distribuzione che la maggior parte degli sviluppatori dovrebbe usare oggi per lavoro di produzione. DeepSeek Harness è il telaio aperto e componibile che dà alla comunità la proprietà del layer dell’agente stesso e la libertà di collegare qualsiasi modello.
