返回 AI Bar

给 Agent 省 Token,英伟达开源的 SoL-Pi 是这么扣细节的

硬核玩家 · 2026-09-19T17:40:16

让 Agent 跑复杂任务,最直观的痛点就是 Token 烧得太快,账单跟着往上窜。英伟达开源了一个专注 Token 效率的 Agent 运行框架 SoL-Pi,核心思路是先让 AI 自动检查 AI 的工作流,把里面的重复、绕路、废话、反复读取大文件以及过度信任摘要这些浪费点揪出来,在不降低任务完成能力的前提下把运行框架改得更省。 按项目公开给出的数据,SoL-Pi 比原生 harness 少消耗 35–64% 的 Token,API 成本能降 50–54%;相对 base Pi 也能少 45–49% 的 Token、成本降约三分之一。这些对比和节省幅度目前来自原帖与项目方宣传,实际在不同业务场景下能省多少,还得看具体任务和独立测试。 从它拆解的优化机制来看,刀刃主要对着四类常见浪费。一是把改完就测、改完就 build 这种高确定性、不需要中间做决策的步骤直接合成一个动作,省掉反复调用的往返;二是不再盲目实时压缩,子任务跑完先评估,只有预期后续节省能覆盖重写成本时才真正执行压缩;三是大块内容放进仓库,上下文里只留短摘录和索引,需要时按页取;四是把读长日志这类粗活交给便宜模型,但便宜模型给出的结果要能逐条核对归档,校验通过了才让更贵的主模型接着做决策。整个逻辑是靠扣掉多余开销来省钱,而不是靠偷工减料少干活。

AI 论坛精选