GitHub Copilot开启多模型组队:HydraFusion成本最高降67%

BiRun 讯,动察 Beating AI 快讯,GitHub 给 Copilot 加了一个多模型编排系统 HydraFusion。它先判断任务该怎么做,再调用不同模型。

目前有三种方式:简单任务交给一个模型直接完成;复杂任务先让成本更低的模型尝试,结果不过关再升级到更强模型;需要复核时,则让一个模型先做,另一个不同家族的模型专门挑错,再让第一个模型修改。

GitHub 在三个编程 Agent 基准上拿它和 Claude Opus 5 对比。TerminalBench 2.1 高出 4.9 个百分点,DeepSWE 低 1.5 个百分点,CheckpointBench 只低 0.1 个百分点,基本持平;成本则分别降低 67%、36% 和 65%。

这个思路很像 Sakana AI 的 Fugu。两者都是把「选哪个模型」进一步变成「怎么组织多个模型」。区别是 Fugu 本身就是一个训练出来的指挥模型,会学习怎么调用不同 Agent,甚至能递归调用自己;HydraFusion 目前仍然是在 Single、Cascade、Critique 三种固定执行模式里选择,更像把多模型调度直接塞进 Copilot。

HydraFusion 已向所有 GitHub Copilot 套餐开放研究预览,目前需要在 Copilot CLI 的实验功能中开启。GitHub 也提醒,现阶段最适合一次说清楚的单轮编程任务,多轮长任务还在继续优化。
你怎么看这条消息?来投第一票

评论

0/500
免责声明:本文内容仅供参考,不构成任何投资建议。
更多快讯