Subagents : orchestrez une équipe d’agents IA sans payer un studio
Un agent IA seul ressemble vite à un freelance débordé. Je lui demande un audit de 40 pages, il attaque avec enthousiasme, puis sa mémoire de travail sature autour de la dixième URL. Il oublie le plan initial, mélange les conclusions, et je repars avec un rapport bancal à moitié inutilisable.
Les subagents changent la donne : au lieu d’un seul ouvrier épuisé, tu deviens chef d’orchestre d’une petite équipe spécialisée. Cet article montre le pattern pas à pas, un cas SEO complet, et le coût réel en tokens, chiffres honnêtes compris.
✨ Résumé Essentiel
- Un subagent est un agent secondaire doté de sa propre fenêtre de contexte, lancé et supervisé par un agent principal.
- Le pattern gagnant tient en trois rôles : un orchestrateur qui planifie, des ouvriers qui exécutent, une synthèse finale consolidée.
- Ça vaut le coup dès que la tâche se découpe : audits multi-pages, veille multi-sources, relecture multi-critères.
- Le coût en tokens grimpe vite : compte souvent un facteur deux à trois par rapport au mono-agent, en échange de fiabilité et de vitesse.
- Pas besoin d’infrastructure coûteuse : Claude Code gère les subagents IA en natif via de simples fichiers Markdown.
Depuis que je travaille en mode multi-agents, mes audits longs tiennent dans une seule session sans perte de fil. Ce n’est pas de la magie, c’est de l’organisation : je découpe, je délègue, je consolide. Et je n’ai embauché personne.

Le pattern chef d’orchestre et ses ouvriers
Le principe tient en une phrase : l’orchestrateur pense, les ouvriers font. L’agent principal reçoit ta demande globale, la découpe en sous-tâches autonomes, puis lance un subagent pour chacune. Chaque ouvrier démarre avec un contexte vierge, un prompt spécialisé et une consigne de livrable stricte.
La clé du pattern, c’est l’isolation des contextes. Un subagent qui audite la page 12 ne porte pas le poids mental des onze pages précédentes. Sa fenêtre de contexte reste légère, donc ses analyses restent précises jusqu’au bout de la série. L’orchestrateur, lui, ne reçoit que des synthèses condensées, jamais le détail brut.
Trois rôles suffisent dans l’immense majorité des situations d’orchestration agents IA :
- Le chef d’orchestre : comprend l’objectif, écrit le plan, distribue les lots, contrôle les retours.
- Les ouvriers spécialisés : un prompt étroit, des outils limités, un format de sortie imposé.
- Le consolidateur, souvent l’orchestrateur lui-même : fusionne les livrables en un document cohérent.
Ce pattern existe dans plusieurs outils du marché. Claude Code l’implémente nativement, Hermes Agent expose une fonction de délégation qui pilote ma stack de veille concurrentielle, et des frameworks comme CrewAI ou LangGraph le généralisent à grande échelle. Restons concrets avec l’implémentation la plus accessible.
Claude Code subagents : la mise en place en pratique
Avant de foncer, assure-toi d’avoir une base saine : mon guide d’infrastructure pour agents IA couvre l’installation et les fondamentaux. La suite suppose que Claude Code tourne déjà sur ta machine (documentation officielle).
Chez Claude Code, un subagent se déclare dans un simple fichier Markdown rangé dans le dossier `.claude/agents/` de ton projet. Le frontmatter décrit l’agent, le corps du fichier sert de prompt système. Voici un exemple réel tiré de mon arsenal :
« `markdown
Tu es auditeur SEO senior. Pour chaque URL fournie :
- Récupère la page et analyse title, meta description et structure Hn.
- Vérifie la présence et la pertinence du maillage interne.
- Rends un tableau à quatre colonnes : URL, constat, gravité, recommandation.
Ne traite que les URLs fournies. Aucune recommandation hors périmètre.
« `
Deux façons de déclencher l’agent. La délégation automatique d’abord : quand ta demande correspond au champ `description`, l’orchestrateur délègue tout seul. L’appel explicite ensuite, en nommant `audit-seo-page` directement dans ton instruction. Le champ `tools` limite les droits : un ouvrier d’audit n’a pas besoin de pouvoir écrire des fichiers.
Les erreurs de débutant que j’ai commises pour toi :
- Une description vague : l’orchestrateur ne sait pas quand déléguer, il garde tout pour lui et sature.
- Des ouvriers à tout faire : un subagent doit faire UNE chose. J’ai fusionné audit technique et audit sémantique une fois, le résultat était indigeste.
- L’absence de format de sortie imposé : impossible de fusionner dix rapports de styles différents sans y passer la soirée.
Exemple complet : un audit SEO multi-pages
Voici le workflow tel que je le fais tourner pour auditer une vingtaine de pages d’un site de niche. L’objectif : repérer les pages faibles avant une campagne de maillage interne.
Étape 1 : je prépare un fichier `urls.txt` avec les adresses à auditer, regroupées par thématique. Cinq minutes de copier-coller, rien de plus.
Étape 2 : j’instruis l’orchestrateur en une seule consigne. « Lis urls.txt, groupe les URLs par lot de cinq, et lance un subagent d’audit par lot. Chaque retour arrive sous forme de tableau normalisé. »
Étape 3 : les ouvriers bossent en parallèle, chacun sur son lot. Cinq contextes séparés, aucune contamination croisée entre les thématiques.
Étape 4 : l’orchestrateur fusionne les tableaux, trie par gravité et produit la synthèse finale. Pages rouges à retravailler en priorité, quick wins exploitables ce week-end, tendances globales du site.
Le gain ne se limite pas à la vitesse. C’est surtout la constance de la qualité, du premier lot au dernier. En mono-agent, mes audits de 20 pages produisaient des fiches bâclées en fin de course, symptôme classique d’un contexte saturé. Avec des subagents IA, la fiche numéro 20 est aussi nette que la numéro 1.

Coûts tokens : la partie honnête
Parlons argent, parce que peu de tutos osent. Chaque subagent possède sa propre fenêtre de contexte, donc son propre compteur. Ton prompt système se répète pour chaque ouvrier, et l’orchestrateur paie la relecture de toutes les synthèses qui remontent.
Ordre de grandeur observé sur mes sessions : une tâche découpée en subagents consomme souvent deux à trois fois plus de tokens que la même tâche menée en mono-agent. En contrepartie, tu achètes de la fiabilité sur les tâches longues et de la parallélisation sur les tâches découplables. Sur un audit qui conditionne des semaines de travail, la facture reste un détail.
Trois leviers pour contenir la dépense :
- Impose des livrables courts : un tableau limité à dix lignes plutôt qu’un « rapport détaillé » aux dimensions floues.
- Limite les outils de chaque ouvrier au strict nécessaire : moins d’outils déclarés, moins de tokens consommés à chaque appel.
- Réserve le multi-agents aux tâches qui le méritent : celles qui saturent un contexte unique ou se parallélisent proprement.
Quand les subagents valent le coup (et quand ils plombent la facture)
| Critère | Un seul agent | Équipe de subagents |
|---|---|---|
| Taille de la tâche | Quelques pages, un fichier | 20 pages, 50 fichiers, plusieurs sources |
| Contexte nécessaire | Tout tient dans une fenêtre | Ça déborde, la qualité chute en fin de course |
| Parallélisme | Séquentiel, une chose après l’autre | Lots indépendants traités simultanément |
| Budget tokens | Serré, prévisible | Confortable, ou tâche à forte valeur ajoutée |
| Mise en place | Immédiate | Quelques fichiers de config à maintenir |
Ma règle de décision en deux secondes : si je peux tout demander en un prompt sans dépasser la moitié du contexte disponible, je reste en mono-agent. Dès que la tâche sent le marathon, je découpe et je délègue.
Le mot de la fin
Une équipe de subagents ne remplace pas ton jugement, elle le décharge des tâches ingrates. Commence petit : un orchestrateur, deux ouvriers, un audit de dix pages. Si les livrables remontent propres, tu tiens une méthode d’orchestration agents IA qui grandit avec tes projets, sans embaucher ni souscrire à un studio d’automatisation.
Je documente mes prochains montages multi-agents dans la rubrique Labo, configs complètes comprises, réussites et plantages confondus.
FAQ : questions fréquentes sur les subagents IA
Quelle différence entre un agent et un subagent ?
Un agent travaille directement avec toi dans la conversation principale. Un subagent est lancé par cet agent pour exécuter une sous-tâche dans son propre contexte, puis il rend un livrable condensé à l’orchestrateur.
Faut-il payer plusieurs abonnements pour faire du multi-agents ?
Non. Chez Claude Code, les subagents tournent dans ta session existante : un seul abonnement ou compte API suffit. Ce qui augmente, c’est la consommation de tokens, pas le nombre de licences.
Combien de subagents peut-on lancer en parallèle ?
Techniquement plusieurs dizaines, mais la limite utile se situe bien plus bas. Quatre à huit ouvriers couvrent la plupart des besoins ; au-delà, le suivi devient difficile et la facture grimpe sans bénéfice évident.
Les subagents conviennent-ils aux débutants ?
Oui, à condition de commencer par un cas simple et un seul subagent spécialisé. Les Claude Code subagents restent le point d’entrée le plus simple : la difficulté n’est pas technique, elle tient à bien découper la tâche et à rédiger des prompts d’ouvrier étroits, avec un livrable défini.
Peut-on utiliser des subagents IA en dehors du développement ?
Absolument. Audit SEO, veille de marché, relecture multi-critères d’un article, tri de leads ou de candidatures : dès qu’une mission se découpe en lots homogènes, le pattern chef d’orchestre fonctionne.




Laisser un commentaire