通用方法 · 熟练
两套技能包都装,只会互相打架
先分清它是手术刀,还是整条流水线
技能包装完之后最常见的后悔不是「不好用」,而是「装了太多」。两组最主流的技能包加起来 55 万星,但它们的设计取向正好相反:一组是手术刀——一个技能只针对一个失败模式(先把你审问到说清楚、测试先行、系统化排错),小而可组合、换个模型也能用;另一组是整条流水线——从头脑风暴、写计划、测试、排错一路接管到验收,代价是它刻意有主见,如果你已经有自己的工作方法,它会跟你的习惯吵。这一页给三条选择判据,外加一条硬纪律:规划类技能重叠的两套包不要同时装——除了互相打架,还会让同一个技能在你的列表里出现两份。
方法 · 一图看懂
1
先问:我缺的是某个环节,还是整条流程 — 只在一个地方反复翻车(比如每次都急着写代码不写测试)⇒ 拿手术刀;完全没有工作流、每次都即兴 ⇒ 流水线才有意义
2
再问:我已有的方法愿不愿意被覆盖 — 流水线类技能包会替代你现有的规划习惯;如果你手上已经有一套跑得通的流程,装它等于主动请一个跟你吵的搭档
3
第三条硬判据:装完之后我还能说出「现在该用哪个」吗 — 技能的描述是它被触发的唯一依据;描述挤不进清单的技能等于没装(数量越多,越容易发生)
4
一条硬纪律:规划类重叠的包只装一个 — 两套主流技能包的规划技能高度重叠,同时装会出现同名技能两份,且行为取决于加载顺序
5
装完先做一次「静默检验」 — 挑三件你常做的活,什么都不说直接做,看它有没有自己触发;没触发的那些,要么描述不对,要么你根本不需要它
原理 · 为什么有效
技能包之间的差异不在功能多少,而在它把判断权拿走多少。手术刀式的技能只在你明确调用时介入,把「怎么问清楚需求」「怎么先写测试」这些具体动作固定下来,判断权仍在你手上;流水线式的技能包接管的是顺序 —— 它规定你先头脑风暴、再写计划、再实现、再验收,效率来自不再每次重新决定流程,代价是它与你的既有习惯必然冲突,而且前几次会话会明显变慢(因为它会先问一堆问题)。这解释了一个看似矛盾的现象:星标更高的那一套不一定更适合你 —— 星标衡量的是「这套方法对没方法的人有多大帮助」,不是「它对已有方法的人有多大帮助」。选之前唯一要回答的问题是:我这次想外包的是一个动作,还是一套顺序。
适用场景
适合先拿手术刀:已经有一套自己能跑的工作流、只在个别环节反复翻车、同时用多种 agent 工具(小而可组合的技能跨工具更稳)、或者手上的项目对「它擅自改了我的习惯」很敏感。
适合先拿流水线:刚开始用编码 agent、没有成型流程、愿意接受前几次会话变慢来换一个稳定的骨架、以及团队里多人多 agent 需要统一顺序的场景。
两类都要注意:装之前先数一遍你已经有的技能 —— 描述挤不进清单的技能不会被触发,装它只是让列表更长。
自测 · 5 问
我这次要外包的是一个动作,还是一套顺序?(答不出来就先别装)
我现有的工作流里,有哪几步是我不想被改掉的?装之前先把它们写下来
我装的两套包里,规划类技能有没有重叠?(重叠就只留一套)
装完之后,我能不看列表就说出「这个场景该用哪个技能」吗?
最近一周里,新装的技能有几次是自己触发的?一次都没有的,考虑卸载
怎么上手 · 验证步骤
下一轮从这里开始:先不要装任何东西,花十分钟做一件事 —— 写下最近两周里你被 agent 坑过的三件事(越具体越好,例如「它改了五个文件只为改一个常量」「它说测试通过了但测试没跑」)。然后拿这三条去对技能包的描述:哪一条能被某个技能直接覆盖,就先只装那一个。第二周再回来看触发次数——如果一个技能一周都没被触发,要么它的描述没写对你的说法,要么这件事你其实不需要外包。
自检动作:打开你的技能列表,只做一次减法 —— 把「最近两周一次都没被触发」的全部列出来,然后逐个问「它是不是被某个还在用的技能覆盖了」。如果一次减法能删掉超过三成,说明你下一次该做的不是找新技能,而是先把列表砍下来。判断依据不是技能好不好,是你还要不要它。