DeepSeek Harness : le Claude Code gratuit, installé en 5 minutes

J'ai installé un clone de Claude Code hier soir. En cinq minutes. Sans carte bancaire, sans abonnement, sans rien.
Puis je lui ai demandé de se fabriquer une mémoire. Il a écrit l'outil lui-même, en direct, et m'a montré le décompte à la fin : combien de tokens, combien de temps, ce qui s'était passé à chaque étape.
Le truc s'appelle DeepSeek Harness. Plus de 180 000 étoiles GitHub en une dizaine de jours. Licence MIT. Gratuit. Et si tu ne devais retenir qu'une seule chose de cet article, c'est celle-là : le modèle n'est plus le sujet. Le harness l'est.
Le cerveau et le corps
Le modèle, c'est le cerveau. Le harness, c'est le corps.
Claude est un cerveau. Claude Code est le corps qui le fait agir sur ta machine. DeepSeek V4 Flash est un cerveau. DeepSeek Harness est le corps que DeepSeek vient de balancer en open source, gratuit, et dans lequel tu peux mettre n'importe quel cerveau.
Pourquoi c'est un tournant ? Parce que jusqu'ici, les meilleurs corps étaient verrouillés. Claude Code appartient à Anthropic, Codex à OpenAI. Changer de modèle voulait dire changer d'outil, réapprendre les raccourcis, recréer tes configs, retravailler tes habitudes.
DeepSeek Harness casse ce verrou. C'est un corps universel : tu branches le modèle que tu veux (DeepSeek, Claude, GPT-5.6, un modèle local sous Ollama), tu gardes le même environnement, les mêmes outils, les mêmes réflexes. Et si le modèle du moment change dans six mois, tu débranches l'ancien, tu branches le nouveau, terminé.
Le plus fort, c'est que le corps lui-même est modifiable. Le principe fondateur tient en quatre mots : everything is a plugin. Le chat, les outils, l'interface, la mémoire, les sous-agents, même la boucle principale qui fait réfléchir l'agent : tout est un plugin. Tu sors une pièce, tu la remplaces par la tienne, le reste continue de tourner. L'ensemble repose sur Cordis, le framework de composabilité spatio-temporelle de DeepSeek.
Une comparaison pour bien comprendre. Claude Code, c'est un set Lego préassemblé : excellent, mais si tu n'aimes pas la forme du toit, tu ne peux pas la changer. DeepSeek Harness te donne toutes les briques et la notice. Si tu as toujours rêvé que ton agent te réponde d'une certaine façon, ait toujours ce type d'icônes, ou n'affiche pas telle section de l'interface : tu peux le faire.
Petit avertissement honnête avant d'aller plus loin : c'est une developer preview. Le projet itère vite, et ça peut casser sous toi. Mais à ce prix-là (0 euro), c'est jouable.
L'installation : cinq minutes chrono
Prérequis : Node.js installé. C'est tout.
Ouvre un terminal et tape :
npx @deepseek-ai/dsh web
Le serveur démarre, l'interface s'ouvre dans ton navigateur sur http://127.0.0.1:3080. Une page web locale, pas une application desktop. Tu vis déjà dans ton navigateur, le harness s'y installe.
Si tu n'as pas envie de taper de commandes, il y a la méthode paresseuse : ouvrir Claude Code et lui dire « télécharge ce repo GitHub et lance-le en local ». Tu colles le lien, il clone le dépôt, installe les dépendances, démarre le serveur. Tu n'as rien fait de tes mains.
Et pour ceux qui veulent tout contrôler, la version source :
git clone https://github.com/deepseek-ai/deepseek-harness.git
cd deepseek-harness
pnpm install
pnpm run build
pnpm dsh web
Au premier lancement, tu choisis ton modèle et ton provider. DeepSeek V4 Flash est gratuit. Si tu veux utiliser Claude ou GPT-5.6 dedans, tu colles ta clé API. OpenRouter fonctionne aussi, y compris ses modèles gratuits, ce qui veut dire que tu peux commencer avec exactement zéro euro.
Et c'est parti. L'interface ressemble à ce que tu connais de Claude Code : un chat, un plan, des fichiers à valider, un compteur de tokens.
Les quatre modes (et quand les utiliser)
La première chose à regarder dans l'interface, c'est le sélecteur de mode. Quatre positions, quatre usages :
1. Standard
L'agent de code complet. Il lit tes fichiers, les modifie, exécute des commandes, propose des plans. C'est le mode de tous les jours, celui que j'utilise 90% du temps.
2. PTC (Plan-Think-Code)
Le standard, plus les outils exposés via le SDK Codex. Concrètement : au lieu d'enchaîner dix appels d'outils un par un, le modèle peut combiner plusieurs opérations dans un seul programme TypeScript. C'est le mode « je réfléchis avant d'agir », taillé pour les tâches multi-étapes où chaque erreur coûte cher.
3. Minimal
L'interface dépouillée. Juste un chat, pas de plan, pas de fichiers. Pour les questions rapides qui ne méritent pas une session complète, et pour ne pas brûler du contexte inutilement.
4. Creator
Le mode construction. Toutes les capacités du standard, plus l'inspection en runtime. Il sert à créer des presets d'agents custom : ta propre configuration de modèle, d'outils et de skills, que tu pourras réutiliser à chaque session. C'est ici que tu fabriques ton Claude Code à toi.
Mon conseil : commence par Standard. La tentation de démarrer dans le creator mode est grande (tout le monde veut personnaliser avant de savoir quoi personnaliser), mais Standard fait 95% du job au début.
L'exemple de la mémoire
Pendant mes tests, j'ai fait un truc simple : « construis-toi un outil de mémoire ».
L'agent a posé son plan, puis il a codé une couche mémoire légère avec trois fonctions : save, search, forget. Il m'a montré le nombre de tokens consommés et le temps passé, puis il a généré une page HTML pour visualiser le résultat. Une petite interface qui permet à l'agent de se souvenir d'une conversation à l'autre.
Ce qu'il faut bien comprendre : ce n'est pas un prompt amélioré. C'est l'agent qui modifie son propre corps, dans un harness dont tu possèdes le code. C'est toute la différence avec un produit fermé : tu ne demandes pas la permission à un éditeur pour ajouter une fonctionnalité.
Autre exemple que j'ai testé : je lui ai donné une maquette d'interface en exemple, et je lui ai demandé de construire la même. Il a sorti la structure, le style, et un rendu franchement propre. Comme quoi le goût du design n'est pas réservé aux harness premium, il faut juste l'amener avec toi.
Le brancher à tout : Zapier et le catalogue de skills
Un harness seul, c'est sympa. Un harness branché à tes outils, c'est un employé.
Le chemin le plus court passe par Zapier. Pourquoi Zapier plutôt qu'un connecteur direct vers chaque service ? Parce que c'est ta couche d'authentification unique. Tu connectes une fois, et tous tes services passent par le même tuyau : Gmail, Outlook, tes apps perso. Un seul endroit à maintenir, un seul endroit à révoquer si un jour tu changes d'avis. C'est exactement le même principe quand tu relies tes différents agents (Codex, Claude Code, le harness) à tes outils perso : une seule couche, connectée une fois, partagée partout.
Concrètement, l'intégration se fait en deux phrases. Tu ouvres une nouvelle session, et tu demandes à l'agent d'intégrer Zapier au harness pour qu'il puisse rédiger des emails à ta place. Le connecteur s'installe.
Ensuite, le cas d'usage typique : « va sur Gmail et rédige-moi un brouillon d'email pour... ». L'agent fait un vrai tool call vers ta boîte mail. Tu le vois appeler l'outil, tu vois la réponse, tu valides. Le draft se construit dans le harness avec le même niveau de détail que dans Claude Code : rien n'est envoyé sans relecture.
Et il y a le catalogue de skills. Comme les skills de Claude Code, mais dans un harness dont tu possèdes le code. Tu peux installer des skills existants ou écrire les tiens, et ils se retrouvent listés dans l'interface au moment de lancer une session.
Claude Code ou DeepSeek Harness ? La vraie réponse
Je n'utilise plus l'un ou l'autre. J'utilise les deux, sur des tâches différentes. Voici ma matrice de décision.
Claude Code (ou Codex) quand :
- Le rendu est destiné à un client et le polish compte
- Tu construis un site ou une interface avec un vrai parti pris de design
- Tu veux zéro surprise et de la fiabilité
Claude Code a un avantage difficile à copier : le goût du design est cuit dans le produit. Cerveau plus corps, comme disent les anglophones. Le corps de Claude Code embarque des années de réglages fins sur l'esthétique. Avec le harness DeepSeek et un modèle économique, tu peux viser le même résultat, mais tu devras construire ce goût toi-même, skill par skill. Si le temps que tu y passes coûte plus cher que la différence de tokens, reste sur Claude Code.
DeepSeek Harness quand :
- Du volume, où le prix compte : le workhorse
- Un nouveau modèle sort (un Qwen, un modèle local) et tu veux le tester sans rien réinstaller
- Tu veux posséder ton outil, le modifier, le faire évoluer
C'est ici qu'il faut parler du concept de workhorse. Dans ma façon de penser l'IA, il y a deux étages. Les modèles frontier (Claude, Fable, GPT-5.6) : le top de la performance, réservé aux tâches critiques. Et le workhorse : 1% du prix, 95% de la capacité. C'est DeepSeek V4 Flash.
DeepSeek V4 Flash est d'ailleurs le modèle le plus utilisé d'OpenRouter en volume : plus de 11 000 milliards de tokens servis. Les gens ne l'utilisent pas pour faire joli. Ils l'utilisent parce que sur 80% des tâches, la différence avec un modèle frontier ne se voit pas, et la facture, elle, se voit.
Le harness est gratuit (licence MIT). Tu ne paies que les tokens. Et si tu veux payer zéro token, les modèles gratuits d'OpenRouter fonctionnent aussi, même si je te conseille de rester sur DeepSeek V4 Flash : c'est simplement un meilleur modèle.
Les cinq questions qu'on me pose tout le temps
C'est vraiment gratuit ?
Oui. Licence MIT, zéro euro pour le logiciel. Tu paies les tokens que tu consommes, point. DeepSeek V4 Flash étant gratuit, un setup complet à 0 euro est possible.
Mon code part en Chine ?
Non. Ça tourne sur ta machine, pas dans le cloud. La télémétrie est désactivée par défaut. Si tu veux une assurance supplémentaire, branche un modèle local (via Ollama par exemple) et rien ne sort de ton réseau.
Je peux utiliser mon abonnement Claude Code dedans ?
Non. Le harness fonctionne avec des clés API. Ton abonnement Claude Code reste sur Claude Code.
Ça marche avec les modèles locaux ?
Oui. Tout ce qu'Ollama sait faire tourner, le harness peut l'utiliser.
Il y a des plugins ?
Oui, un store de plugins existe (cherche le topic dsh-plugin sur GitHub), mais tu n'en as pas besoin pour démarrer. L'outil de base suffit largement pour comprendre la mécanique et t'amuser avec.
Ce que je retiens
La valeur n'est plus dans le choix du modèle. Elle est dans la distribution du travail.
La vraie compétence en 2026, ce n'est pas d'utiliser Claude Code ou DeepSeek Harness. C'est de savoir quelle tâche part vers quel modèle, dans quel corps, au bon prix. Un design client part chez Claude. Une vague de deux cents emails à rédiger part chez le workhorse. Un prototype d'outil interne part dans le creator mode. Et le tout est supervisé comme un budget, pas comme un jouet.
C'est exactement le genre de chantier que je mets en place en entreprise : le routage multi-modèles, les agents sur les tâches à volume, la boîte à outils qui tourne sans qu'on y pense. Si tu veux voir à quoi ça ressemble concrètement chez toi, un audit offert de 45 minutes suffit pour repartir avec les trois premiers automatismes à brancher.
Voir aussi le glossaire IA
Parcourir tout le glossaire IAPassez à l'action : votre Audit IA Express offert (45 min)
45 minutes en visio pour auditer vos processus, chiffrer vos gains de productivité et identifier vos 3 premiers agents IA rentables.
Réservé aux dirigeants de PME (10 à 100 salariés) · Sans engagement · Propriété 100 % de vos livrables
Déployez vos agents IA en entreprise avec un expert dédié
Un Directeur IA externalisé vient dans votre PME de 1 à 10 jours par mois pour automatiser vos processus, concevoir vos agents et former vos équipes. Dès 990 € HT/mois, sans engagement au-delà de 30 jours.
Recevez notre synthèse IA hebdomadaire
Chaque vendredi, recevez notre sélection d'articles, études de cas et retours d'expérience terrain sur les Agents IA et l'automatisation B2B. Résumé 100% concis, sans spam.
Direction IA Externalisée en région


