TL;DR
Un « multi-agent » qui s'écrit des messages pendant trois heures sans livrer un artefact vérifiable, c'est un jouet cher. L'orchestration utile = objectif borné + local d'abord + preuve de fin + machine déjà mesurée. C'est la promesse de Maestro — aperçu public 0.7.1 — au-dessus de Local Cockpit.
En 2026 tout le monde a un essaim : Claude Code ici, Cursor là, un Hermes en local, un bot qui « critique », un autre qui « planifie ». Le sentiment de productivité monte. La preuve, elle, stagne.
Le multi-agent jouet, en trois symptômes
- Pas de critère d'arrêt — la boucle tourne jusqu'au plafond de tokens.
- Cloud par défaut — on paie pour que des agents se racontent l'état d'une machine qu'on n'a jamais scannée.
- Zéro gate — personne ne demande « le test passe ? le fichier existe ? le bench dit quoi ? ».
Ce n'est pas anti-agent. C'est anti-théâtre. Les bons setups power-user (Hermes local, Claude Code, Obsidian) marchent quand un humain fixe le cadre — ou quand un orchestre le formalise.
Ordre non négociable : machine → sessions
Avant d'orchestrer, il faut savoir ce que la machine tient. Sinon on « optimise » un workflow sur un PC qui n'a jamais sorti un 7B stable.
- Mesurer — Local Cockpit (scan, Ollama, tokens/s).
- Un modèle qui tient — pas le tweet du jour.
- Puis enchaîner des sessions avec objectif court et preuve.
Détail du duo : Local Cockpit + Maestro : machine puis orchestre.
Ce que « local d'abord » veut dire
- Le brouillon, la relecture de code locale, le RAG privé, le digeste de notes : local si la machine le permet.
- Le cloud (Claude, GPT, etc.) : quand le local plafonne — pas l'inverse « parce que c'est plus simple ».
- Mesurer le bascule : latence, coût, qualité sur votre cas, pas un leaderboard marketing.
Gates et « ce qui suffit »
Une session multi-IA utile se termine par une preuve : test vert, diff reviewable, rapport, fichier livré. Pas par un monologue d'agent satisfait.
Maestro, côté produit, vise exactement ça : arrangements de sessions, mesure interne, arrêt quand c'est suffisant. L'aperçu public 0.7.1 est sur /maestro. Les modules internes (juge, ladder, ForgeBench) restent hors citation publique.
Comparatifs utiles (pas de fan-fiction)
FAQ
C'est quoi un multi-agent jouet ?
Un essaim sans objectif borné, sans preuve de fin, souvent 100 % cloud. Ça brille en démo, ça s'effondre en prod personnelle.
Maestro est-il téléchargeable ?
Non. Teaser. Local Cockpit = produit machine en bêta.
Et le livre Dragon là-dedans ?
Même obsession : mesurer, ne pas se payer de récit. Page du livre (disponible sur Amazon).
Éditorial OutilsIA.fr. Maestro 0.7.1 est un aperçu public. Local Cockpit d'abord : télécharger.