GitHub HydraFusion:让多个模型互相审稿,成本比 Opus 5 低 67%

2026-09-18 AgentGitHub成本多模型

GitHub 9 月 4 日给 Copilot CLI 加了一个叫 HydraFusion 的研究预览。你选它跟选别的模型一样简单,但背后它会为每一次请求自动编排多个模型:能直接解就一个模型上,难一点就「便宜模型先起草、质量门判断要不要升级强模型」,或者「一个模型写、另一个家族的模型当独立审稿人、写完再改一版」。

三种模式对应的就是日常里你已经会做的事:自己写、找人 review、搞不定的再升级。HydraFusion 只是把它搬进了运行时。

为什么一人公司该盯这个:

  • 成本结构被重新打开。 在 TerminalBench 2.1 上,它比 Claude Opus 5 验证通过率高 4.9 个百分点,预估成本低 67%。代价是多了几跳模型调用,但省下的钱往往是数量级的。
  • 「该用哪个模型」不再是你每天要决策的事。 你只说要什么,它按推理深度、代码复杂度、调试难度、工具编排需求挑最划算的执行路径。
  • 失败有兜底。 它有明确的超时/取消、隔离审稿(审稿人不碰仓库)、校验失败不落补丁这几条原则,多模型编排第一次在仓库级工作里变得可控。

要泼的冷水:

  • 目前只在 Copilot CLI 的 /experimental 里,App 和 VS Code 是「九月跟进」的预期,现在还用不了。
  • 你没法指定它具体用哪些模型、排除哪些,阵容随评估浮动。需要精细控制的团队暂时拿不到旋钮。
  • 多跳编排会引入额外延迟,超短平 fast 任务用 Single 模式更划算,别无脑开。

我的建议:HydraFusion 本身是个产品功能,但它背后的思路人人能用——把「草稿→审稿→升级」做成你自己的默认工作流。哪怕你只是用便宜模型先出一版、再让强模型审一遍,往往就能在效果不掉的前提下把账单砍掉一大截。

原文出处 · 事实以此为准
GitHub Blog
阅读原文 ↗