返回 AI Bar

Devin Fusion把规划和执行分给不同模型,省钱也要看分数

Kevin在Coding · 2026-09-13T16:25:16

我更愿意把模型预算花在难判断的地方,把可重复的执行交给成本更低的模型。Devin CLI 新推出的 Fusion,走的就是这种分工路线。 选一个主导模型负责规划,再配一个更经济的执行模型。主导模型还会审查结果、指出问题,在执行模型处理不了时接回任务,所以分工会随着任务推进而调整。 看配图时,我会把成本和得分一起读。在这张 Artificial Analysis Coding Agent Index v1.5 对比图中,Astra 加 SWE-1.2 的 Fusion 组合成本降低39%,得分是58.9;对应图里的 Codex Astra 是61.6。Fable 组合则显示成本降低36%,得分61.7,对照项为62.2。 这说明值得讨论的是成本与效果之间的取舍,不能直接理解为所有任务都无损便宜39%。 真要选默认组合,我会用自己的典型任务看看:规划是否清楚、执行返工几次、主导模型多久需要接管。最后把交付质量和总账放在一起比较。

AI 论坛精选

  • Meta下一个超大模型已经在训了 - 扎克伯格确认:Meta 已经在训练 Watermelon 之后的下一代模型。 背景补一下:Watermelon 是 Avocado/Spark 的继任者,还没发布,就会是 Meta 史上最大的模型,…
  • 谷歌让AI真正学会看视频了 - 谷歌发布了智能视频理解 API。以前 AI 看视频很笨,像拿着秒表每秒硬截一张图,画面没变化也照截不误,关键动作反而容易漏。新方案是让模型像人一样连贯地看,理解动作之间的因果。视频理解这个环节补上之…
  • 现在发新模型都得先过Blender这关 - 最近 Blender 在 AI 圈大热。 从 GLM-5.3、Claude Fable 5.1,到今天的 Astra,几乎每个最新模型都要做一个 Blender demo,展示自己能在 3D 世界里…
  • 奥特曼访谈实录:6 个你关心的 AI 尖锐问答 - 彭博专访 Sam Altman 全程高能拆解:哪个模型敢放心用、AI 自动挖漏洞为何还要开放、内部被按暂停的模型、失控了能不能关掉、治愈癌症之后 AI 去哪、智能会不会一直降价。六个尖锐问题,六段一…
  • 陶哲轩把人和AI的差别说透了 - 陶哲轩聊AI和数学的分工,有段话很妙。 他说AI可以合成一百万篇论文,把里面每个想法都暴力测试一遍。而人类数学家呢,看5个例子,就能说“我看到规律了”。 前者是穷举,后者是直觉。两种能力完全不同,所…
  • 2000万月活之后,Character.AI为什么把创始人还给了Google? - 2022年9月,Character.AI开放测试。 这比ChatGPT发布还早两个月。 它不回答“标准答案”,而是让用户和马斯克、爱因斯坦、游戏角色,甚至自己创造的虚拟人物聊天。 上线两个月,平台每…
  • 进入 AI 论坛 - 浏览 AI 工具实践、Agent 教程与社区精选讨论