MadoHub Docs

Ensemble Exploration

在同一个问题上用不同指令生成多个 Agent,比较它们的输出,挑出胜出方案。

有时候你不知道哪种方案最好——缓存的 LRU vs LFU vs ARC、三种重构策略、两个竞争的库选择。Ensemble Exploration 在同一个问题上生成多个全新 Agent,每个带不同的指令去攻克,让你并排比较结果。

它通过 MadoAgent 触发——你让 MadoAgent 探索方案,它判断 fork-and-compare 比单任务更合适时就会用它。每个 fork 作为全新图块生成、带自己独立的上下文,所以分歧的方案不会互相污染。

你能用它做什么

  • 在同一个问题上跑最多 5 个 fork —— 每个 fork 拿到共享 prompt 加上自己的变体指令。
  • 每个 fork 混用 Agent 类型 —— Claude、Codex 或 Amp,可以让不同模型比拼同一个任务。
  • 并排比较 fork —— Exploration 面板的 Compare 视图在一条水平轨道里显示每个 fork 的最新响应。
  • 用自动 critic 给 fork 打分 —— 一次点击让 critic 在正确性、完整性、清晰度和可操作性上给每个 fork 打 0–10 分,并指定一个推荐 fork。
  • 手动选胜出者 —— critic 只建议;选胜出者始终是你的点击。
  • 跨重启保留 run —— 最近的 run 在重启后恢复,面板能撑过应用重启。

如何使用

  1. 用 Cmd+Shift+M(⌘⇧M)打开 MadoAgent。
  2. 请求一次探索,例如"针对这个 bug 试三种缓存策略,告诉我哪种最好"。
  3. MadoAgent 为每个 fork 生成一个图块,每个带共享 prompt 加自己的变体指令。右侧抽屉自动切到 Exploration 标签,run 一开始你就能看到。
  4. 在 Exploration 面板看每个 fork 的状态点——running、done、cancelled 或 timeout。
  5. fork 有输出后,点 Compare 展开并排轨道,显示每个 fork 的最新响应。
  6. 可选:点 Score forks 跑 critic。critic 给每个 fork 打分并高亮一个推荐 fork。
  7. 在你想要的 fork 上点 Pick winner。run 关闭为完成,该 run 中其他仍在运行的 fork 标记为 done。

常见用例

  • "为这个缓存试 LRU、LFU 和 ARC,告诉我用哪个。" —— 三个 fork、一个胜出者,读完 Compare 视图或 critic 打分后再选。
  • "用两种方式重构这个模块——抽成一个类 vs 拆成模块——并比较。" —— 两个 fork,不同重构策略。
  • "让 Claude 和 Codex 比拼同一个任务。" —— 两个 fork,每种 Agent 类型一个,看哪个模型处理得更好。

提示与最佳实践

  • fork 数量上限设在你确实能比较的范围内。三到五个是甜点;超过五个 Compare 视图就难扫了。
  • 把 critic 当平局打破者,而不是决定者。点 Pick winner 前自己读 Compare 视图——critic 也可能出错。
  • 还没输出 fork 会被 critic 跳过,所以等 fork 产出点东西再打分。
  • 关闭一个 run 会取消其中仍在运行的 fork,而不是让它们永远标着 running。

相关功能

  • MadoAgent —— 你触发 ensemble run 的面板。
  • Right Drawer —— 显示 run 和 fork 的 Exploration 标签。
  • Orchestrator Mode —— 用单个 headless worker 而非多个 fork。
  • Settings —— critic 使用的 AI provider。

局限

  • 每个 run 的 fork 上限为 5。请求更多会整单拒绝,而不是默默截断。
  • critic 只建议——它从不决定胜出者。MadoHub 不会自动选胜出者。
  • critic 用你配置的 AI provider 中更便宜/更快的模型档位,所以它的判断力取决于该模型。
  • ensemble run 保留最近 7 天(上限 20 个 run)——更老的 run 会老化掉。

On this page