Ensemble Exploration
Lancez plusieurs agents sur le même problème avec des instructions différentes, comparez leurs sorties et choisissez un gagnant.
Parfois, vous ne savez pas quelle approche est la meilleure — LRU vs LFU vs ARC pour un cache, trois stratégies de refactor différentes, deux choix de bibliothèques concurrentes. Ensemble Exploration lance plusieurs agents frais sur le même problème, chacun recevant une instruction différente sur la façon de l'attaquer, et vous laisse comparer les résultats côte à côte.
Cela se déclenche via MadoAgent — vous demandez à MadoAgent d'explorer des approches, et il décide quand une forme fork-and-compare convient mieux qu'une tâche unique. Chaque fork est lancé comme un tout nouveau tile avec son propre contexte indépendant, afin que les approches divergentes ne se contaminent pas mutuellement.
Ce que vous pouvez faire
- Lancer jusqu'à 5 forks sur le même problème — chaque fork reçoit le prompt partagé plus sa propre instruction de variante.
- Mélanger les types d'agents par fork — Claude, Codex ou Amp, afin d'opposer différents modèles à la même tâche.
- Comparer les forks côte à côte — la vue Compare du panneau Exploration affiche la dernière réponse de chaque fork dans une lane horizontale.
- Noter les forks avec l'auto-critique — un clic demande au critique de noter chaque fork de 0 à 10 sur la correction, la complétude, la clarté et l'exploitabilité, et de nommer un fork recommandé.
- Choisir un gagnant manuellement — le critique ne fait que conseiller ; sélectionner un gagnant reste toujours votre clic.
- Conserver les exécutions entre redémarrages — les exécutions récentes sont restaurées au redémarrage afin que le panneau survive à un relancement de l'application.
Comment l'utiliser
- Ouvrez MadoAgent avec Cmd+Shift+M (⌘⇧M).
- Demandez une exploration, par exemple « essaie trois stratégies de cache différentes pour ce bug et dis-moi laquelle gagne ».
- MadoAgent lance un tile par fork, chacun avec le prompt partagé plus sa propre instruction de variante. Le tiroir droit bascule automatiquement sur l'onglet Exploration afin que vous voyiez l'exécution dès qu'elle commence.
- Observez le point d'état de chaque fork dans le panneau Exploration —
running,done,cancelledoutimeout. - Lorsque les forks ont produit une sortie, cliquez sur Compare pour déployer une lane côte à côte de la dernière réponse de chaque fork.
- Optionnellement, cliquez sur Score forks pour lancer le critique. Le critique note chaque fork et met en évidence un fork recommandé.
- Cliquez sur Pick winner sur le fork de votre choix. L'exécution se clôt comme terminée et tout autre fork en cours dans cette exécution est marqué comme fait.
Cas d'usage courants
- « Essaie LRU, LFU et ARC pour ce cache et dis-moi lequel utiliser. » — trois forks, un gagnant, choisi après lecture de la vue Compare ou des notes du critique.
- « Refactor ce module de deux façons — extraire une classe vs diviser en modules — et compare. » — deux forks avec des stratégies de refactor différentes.
- « Oppose Claude et Codex sur la même tâche. » — deux forks, un par type d'agent, pour voir quel modèle gère le mieux la tâche.
Conseils et bonnes pratiques
- Plafonnez les forks à ce que vous pouvez réellement comparer. Trois à cinq est l'idéal ; au-delà de cinq, la vue Compare devient difficile à parcourir.
- Utilisez le critique comme départageur, pas comme décideur. Lisez la vue Compare vous-même avant de cliquer sur Pick winner — le critique peut se tromper.
- Les forks sans sortie sont ignorés par le critique, donc attendez que les forks aient produit quelque chose avant de les noter.
- Rejeter une exécution annule les forks encore en cours plutôt que de les laisser marqués
runningindéfiniment.
Fonctionnalités associées
- MadoAgent — le panneau depuis lequel vous déclenchez les exécutions d'ensemble.
- Tiroir droit — l'onglet Exploration où les exécutions et forks sont affichés.
- Orchestrator Mode — pour un worker headless unique plutôt que plusieurs forks.
- Paramètres — le fournisseur IA utilisé par le critique.
Limitations
- Les forks sont plafonnés à 5 par exécution. En demander plus rejette l'appel entier plutôt que de tronquer silencieusement.
- Le critique ne fait que conseiller — il ne fixe jamais un gagnant. MadoHub ne choisit pas automatiquement de gagnant.
- Le critique utilise le tier de modèle moins cher/plus rapide de votre fournisseur IA configuré ; son jugement n'est donc meilleur que ce modèle.
- Les exécutions d'ensemble persistent pendant les 7 derniers jours (plafonnées à 20 exécutions) — les exécutions plus anciennes disparaissent.