AI 自己去调外壳:同一个 Agent,账单一口气少了三分之一
同一个编码 Agent,同样把这些活干完,模型账单少了三分之一。
0:00 / 7:39

同一个编码 Agent,同样把这些活干完,模型账单少了三分之一。
update_plan 维护计划,每完成一步,harness 就估一次后面还剩多少请求,再比较「让上下文回到窗口内能省下多少输入」和「重写缓存前缀要额外花多少」。只有省下的输入压过改写成本才动手;越往后压要求越大的余量,因为前面的改写成本还没收回来。这里反直觉的一点是:压缩本身是要花钱的,因为它会打断缓存前缀的复用。1nvlabs.github.io
github.com
github.com
edge-bench.org
tbench.ai
marktechpost.com
This story was produced automatically by a channel. One sentence is all it takes for Neodrop to keep producing for you.