技术 · 熟练
一支子代理队伍,不该人人用全力
先能说出每个子任务要多少判断,再分档
最省钱的开关往往不是换模型,而是给「不需要想那么久」的那一步调低推理强度 —— 现在的 Agent 工具已经支持按子代理单独指定档位,也就是说同一支队伍里,做格式转换的那个可以用低档、做设计判断的那个才用高档。这一页给的不是「调哪个参数」,而是一套分档判据:先把子任务按「错了要不要重来」分成三档,再决定谁给高档;然后给一条防呆规则 —— 分不清档位的时候,宁可给高档(误伤一次复杂任务的代价,远高于多花一次推理钱)。关键动作只有一个:分档的依据必须写在任务分配的那一句里,而不是写在参数里。
方法 · 一图看懂
1
先按「错了要不要重来」分三档 — 可重跑无副作用 → 低档;结果被下游引用 → 中档;错了要推翻已完成的步骤 → 高档
2
把依据写在分工的那一句 — 「这一步只做格式转换,不需要额外推理」比在参数里写个 low 更有用
3
给相邻档留一条升级口 — 低档子任务发现输入不干净或有多解,必须能喊停交给上一级
4
同一条链里只调一个变量 — 分档和换模型不要同轮做,否则说不清是哪一层起了作用
5
留下每档的实际开销 — 记下每个档位的耗时与费用,下一次分档才有依据,而不是凭感觉
原理 · 为什么有效
为什么「分档」比「换更便宜的模型」更值得先做:换模型改的是能力,分档改的是每步该花多少力气,而大多数 agent 链条里真正浪费的不是能力不够,是力气用错了地方 —— 一个只做字段重排的步骤被要求「想清楚再做」,它会把预算花在解释自己为什么这么排上。反过来,把「这一步要不要推翻前面的结论」交给低档,省下的钱会在下游被成倍收回。一条更实用的判据:分不清档位时就给高档 —— 误给高档只是多花钱,误给低档可能让你在第四十步才发现前面全错。这与「按动作 / 范围 / 可逆性分别授予自主度」是同一件事在推理上的投影:预算跟着风险走,不跟着模型走。
适用场景
适用:链条里子任务性质差别大(既有格式转换又有判断)的 agent;单个任务跑起来又慢又贵、但删掉某些步骤结果没变差的人。
⛔ 不适用:链条只有一步、或者每一步都需要同样深度判断的场合 —— 分档在这两种情况下只是多一层配置。
⚠️ 前提:你能说出每个子任务「做错了会怎样」,说不出的先别分档。
自测 · 5 问
我能为每个子任务回答「这一步错了要不要重来」吗
我把分档依据写进了分工的那一句,还是只改了一个数字
低档的子任务,有没有一条「发现不对劲就喊停」的出口
这一轮我是不是同时动了分档和模型(那样就说不清是哪一层起的作用)
我有没有记下每档的实际耗时与费用,用作下次依据
怎么上手 · 验证步骤
第一次只改一个子任务的档位,挑最显然的那个 —— 通常是「把结果整理成表格 / 改个写法 / 转个格式」这一步。把它的依据补进分工描述里(「只做格式转换,不需要额外推理,遇到需要判断的先标出来交回」),跑一次,对比两件事:结果有没有变差、这一步的耗时降了多少。两样都记下来。结果变差 ⇒ 说明这一步其实含判断,该回中档,同时把它里面「含判断」的那一小段拆出来单独处理;结果没变 ⇒ 可以继续挑下一个。一次只动一个,动完至少跑两次再下结论。
自检动作:把每个子代理现在的档位写在一张纸上,旁边写一句话说明「为什么是这个档」。三个以上写不出理由的,说明你现在的分档不是分档,是随手设的。