通用方法 · 熟练

提示词越写越长,模型反而更不听话?

把「怎么想」删掉,把「什么算完成」写进去
如果你还在提示词里写「仔细想想」「一步步推理」「务必彻底」「重要:」「必须:」,那套写法在最新的几个前沿模型上已经不是「没用」,而是「有害」。Opus 5.5、GPT-6 Astra、Gemini 3.8 在 2026 年 9 月前后都改成了常开思考 —— 它们自己会决定想多久,你再命令它「想清楚」等于在替它做一个它已经做得更好的决定。这一页换掉旧的提示词骨架,改成六个槽:目标(终态长什么样)· 范围(什么在范围内、什么必须不变)· 工具权限(何时搜、查、跑、调)· 动作边界(哪些自主做、哪些等你批)· 验证检查(它能自己跑的一条可执行测试)· 停止条件(什么证明任务完成)。一句话记住:你的提示词不是打气的话,是一份验收标准 —— 就按验收标准那样写。
方法 · 一图看懂
1
删掉「怎么想」那一类 — 常开思考的模型自己决定想多久;再命令它仔细、彻底、逐步推理,只会挤掉真正有用的约束
2
把「什么算完成」写进去 — 目标写终态(产出长什么样、放在哪),不写过程(先做 A 再做 B)
3
配一条能自己跑的验证 — 一条可执行测试胜过三句「请务必检查」;跑得过就是完成,跑不过就继续
4
划出三条边界 — 范围(什么不能改)· 工具(何时该调)· 动作(哪些要等你批)
原理 · 为什么有效
为什么要这么改:早期模型的推理是被提示词驱动的 —— 你不说「一步步来」,它就真的只给一个直觉答案;所以那时写「仔细想想」确实有效。而 2026 年 9 月前后,三家前沿模型都改成了常开思考(推理默认开启、由模型自己分配),并且都实测出沿用旧式「think harder」指令会变差。原因并不神秘:模型已经把推理预算花在解题上,你再插入一堆元指令(仔细 / 彻底 / 一步步 / 务必),占掉的正是它本来用来装「任务约束」的位置 —— 真正决定成败的「什么不能改」「什么算做完」反而被挤掉了。所以范式从「告诉模型怎么想」转向「说清成功的工作长什么样」,本质是把提示词从「过程指令」改成「验收标准」。
适用场景
适合:① 你手上还留着 2024~2025 年那套 CLAUDE.md / 系统提示词 / 自定义 agent 配置 —— 里面大概率塞满了「仔细」「彻底」「重要:」;② 你经常给长任务(几十分钟到几小时自治)下指令,中途忍不住追问、追加要求;③ 你要把同一份提示词交给不同模型跑,希望它对模型换代不敏感。
⛔ 不适合:一次性短任务(一句话能问完的),以及必须逐步确认的高风险动作 —— 那类要的是「动作边界」里的「等你批」,不是把步骤写完。
自测 · 5 问
提示词里还有没有「Think step by step / 仔细想想 / 一步步推理」——有就删,模型自己会做
「Double-check your work / 务必检查两遍 / Be thorough」是否已换成一条能执行的验证命令?
全大写的 CRITICAL / IMPORTANT / MUST 还在不在?换成正常的范围与边界描述
我有没有写上「什么必须不变」——没有的话,它很可能会顺手改掉不该动的地方
停止条件是不是可判定的?(「做完」不可判定 ·「测试通过且三处配置已更新」可判定)
怎么上手 · 验证步骤
上手顺序:先挑一条你最近失败过的提示词,把它按六个槽重写一遍 —— 目标 · 范围 · 工具权限 · 动作边界 · 验证检查 · 停止条件,其余全删。同一个任务用新旧两版各跑一次,对比「你需要补几次、改几轮」。心态上把提示词当验收标准来写:如果一份验收标准里出现「做得仔细一点」,你自己也会觉得它没用。
自检动作:把重写后的提示词交给一个从没看过你上下文的人(或直接问一遍模型「按这份说明,你会怎么判断自己做完了?」)—— 对方能准确说出「终点是什么、怎么证明到了」,说明这版提示词合格;对方说「大概是要做个分析吧」,说明你写的还是过程而不是终态。
[C级]DEV Community《Define Done States, Not 'Think Carefully'》(2026-10-08 · 转述 Addy Osmani 随 Opus 5.5 发布的 explainx.ai 提示工程 playbook · 含删改对照清单) [C级]Anthropic Claude Code 官方 changelog(2026-10-05 / 10-07 / 10-08 三版 · Agent 工具 effort 参数 · hooks 的 onFailure=block) [C级]Claude Code Daily Briefing 2026-10-09(GeekNews 转载 · 把目标与完成判据一次说清 · 六小时自治实验) [C级]AgentConn《Your AI Agent's Bottleneck Isn't the Model》(HN 同批讨论 · 提示词从「告诉它怎么想」转向「说清成功长什么样」) 同类:它说「做完了」,你敢不敢直接信? · AI需求规格化:一句话需求拆成可检查的规格
继续往下读
同级:AI需求规格化:一句话需求拆成可检查的规格 下一级:压缩一次,就少一条规矩 随机一篇