娱乐 · 深入

把裁决权从模型手里拿回来,靠的是三道闸

不是让它更听话,是让它根本碰不到不该碰的那一层
「让 AI 当 GM,骰子该由谁掷」解决的是玩法层的一个选择;这一页解决的是它下面那层工程问题:如果你要的不是一次休闲局,而是能跑几十轮、规则前后一致、且不联网也能开的长团,那就不能靠「在提示词里跟它讲道理」。2026-10-09 上线的离线 TRPG《The Return of Illunes》给了一个完整的样子 —— 语言模型随游戏发到本地跑(无联网 · 无订阅 · 无按次费),并且装了三道闸:① 玩家输入在到达模型之前先被过滤 ② 伤害 · 数值 · 难度 · 成长始终由游戏自身规则裁定 ③ 每一条生成文本在展示之前都被检查。它的招牌系统 Free Action 反而说明了这套设计的价值:输入菜单上没有的动作(「割断吊灯的绳子砸下去」)也能成立 —— 因为成败由规则判定,而不是由模型「愿不愿意」。
方法 · 一图看懂
1
先分清哪一层该被锁死 — 叙述层可以自由生成,数值与成败必须走规则
2
第一道闸 · 输入过滤 — 玩家输入到模型之前,先过一遍白名单与清洗
3
第二道闸 · 数值裁定 — 伤害 / 难度 / 成长由规则引擎算,不由模型说
4
第三道闸 · 输出检查 — 生成文本展示之前逐条核,与状态不符的不进叙事
5
本地化的取舍 — 离线换来的是可跑性与一致性,代价是模型规模与叙事上限
三道闸各挡什么(照这个顺序建)
① 输入过滤(挡提示注入) —— 玩家输入是唯一一条「外部文本直接进入模型」的通道,也是唯一能改写全员规则的地方。该做的不是「提示模型别听玩家的话」,而是让玩家的输入根本到不了规则层:把玩家文本当作「要判定的动作描述」,先做形态清洗(长度 · 特殊字符 · 指令样式的句子),再交给一个只负责「解析成结构化动作」的环节,解析不出来就不进入下一步。
② 数值裁定(挡偏好) —— 伤害 · 难度 · 成长 · 资源增减全部由规则算;模型拿到的只是已算好的结果,它的任务是把结果讲成故事。这一道最关键的效果是「它想给你放水都没权限」:模型偏好剧情张力,这在戏剧局里是优点、在长团里是致命伤,而把算术拿走之后这个偏好就无从生效。
③ 输出检查(挡不一致) —— 生成文本在展示前逐条核对:角色是否已死 · 道具是否还在身上 · 位置是否与上一轮相符 · 数值是否与规则引擎给的一致。不一致就重生成或降级成不涉及数值的叙述。这一道是最容易被省、也最容易看出差别的一道 —— 省掉它,前两道做的功会在这里漏掉。
本地模型换来了什么、又放弃了什么
离线 TRPG 把语言模型放进玩家机器,换来三样东西,也放弃三样。
换来的三样:① 零延迟与零费用 —— 没有按次计费,长团可以放心地跑几十上百轮;② 一致性可控 —— 模型版本不会在团跑到一半时被服务端换掉(这是线上产品最难解释的一类「今天它变笨了」);③ 隐私 —— 你的本子与角色设定不出本机。
放弃的三样:① 叙事上限 —— 本地能跑的模型规模有限,文笔与临场创造力不如云端大模型;② 内容广度 —— 本地模型的常识面更窄,冷门设定容易露怯;③ 更新速度 —— 想变强得等新版本发布,不能靠换服务端。
⇒ 取舍判据一句话:你要的是「一场精彩的演出」还是「一场能一直跑下去的局」。前者用云端大模型 + 轻规则;后者用本地模型 + 重规则壳。两种都能玩,混着用才难受 —— 用云端模型跑无规则的长团,前二十轮很爽,之后开始丢设定;用本地小模型跑短局,你会觉得它文笔平。
照着这张判据表评估任意一个 AI 跑团产品
把这四问对着任何一个平台问一遍,能立刻分出它是「演出型」还是「长团型」:
① 有没有机械层? —— 有没有骰子引擎 / 数值表 / 会话之外的存档。没有机械层的平台,它说「你掷出 17」的那个数字是生成的,不是抽样的。
② 记忆是按档位买的吗? —— 该平台的免费档与付费档,差的到底是模型数量还是上下文与记忆额度。若记忆是额度制,那么「长团跑丢」就不是你提示词的问题,是产品结构。
③ 规则与记忆能兼得吗? —— 两组实测给出的共同缺口正是这个:有规则的丢记忆、有记忆的没规则;「想要既能跑长团又有 5e 式规则的玩家,会被两家同时辜负」。看清这一条,你就不会在两个产品之间反复换而都不满意。
④ 判定权在谁手里? —— 成败由规则算,还是由模型叙述。前者可复现、可跟长团;后者适合一次性演出。
⇒ 四问的答案没有好坏,只有与你这一局的目标对不对得上;对不上时最省事的做法不是换产品,是自己把缺的那一层补上(例如自掷骰子当既成事实、或把规则压到三四个被跟踪的数字)。
原理 · 为什么有效
为什么「跟模型讲道理」在长团里一定会失效?因为叙事偏好是模型的默认输出,而不是它的失误:它的本质是预测下一个最像样的词,而「最像样」在故事语境里天然偏向张力与爽感 —— 于是一个本该失败的判定被叙述成「险之又险地成功」,一次本该扣血的命中被写成了「擦身而过」。这不是它不听话,是它在做它最擅长的事。
所以长团要的不是更好的提示词,而是把「不该由它决定的那一层」从它手里拿走:数值与成败交给确定性的一段,模型只负责把已定的结果讲好。这与工程上那条通用纪律是同一个道理 —— 判定放在能观测、可复现的一侧,不放在模型自述里。一旦这么做,你会得到一个反直觉的收获:模型在被拿掉裁决权之后,叙事反而更好,因为它不必再一边维持故事张力、一边偷偷替你把数字算圆。
适用场景
适用:想跑长团 / 连载型角色扮演的人 · 自己搭 AI GM 并希望规则前后一致的人 · 多人共用一个 AI 主持人、需要大家都认可判定结果的场合 · 在意隐私或按次费用而倾向本地模型的人 · 想评估某个 AI 跑团平台到底适不适合自己的人。
⛔ 不适用:一次性的休闲局 —— 那种局要的正是模型自由发挥的临场感,加重规则壳只会让它变钝。
⚠️ 前提:愿意先写下你这一局的「机械层」是什么(哪怕只有三四个数字),并承认它是给谁看的。
自测 · 6 问
我这一局里,有哪几个数字是被跟踪的?能不能立刻说出来?
判定成败的那一下,是我的规则算的,还是模型叙述的?
玩家能不能通过「说一句话」改掉规则?(能,就说明输入那道闸没建)
上一轮它说我已经用掉的那件道具,这一轮还在我身上吗?我是怎么查的?
如果今晚限电断网,这一局还能开吗?—— 不能,说明我依赖的那一层不在我手里。
我换过几次平台?每次换的理由是「规则不够」还是「记忆不够」—— 我分得清吗?
怎么上手 · 验证步骤
不需要先搭一套完整规则。只做一件最小的事:把你这一局的「被跟踪数字」压到三四个,并规定每轮结束时由你自己更新、由它只复述(不是由它替你加减)。跑三五轮,你会立刻感到差别 —— 之前是「它说多少就是多少」,现在是「数字在你手里、它只负责讲」。第二件事是加一道最便宜的闸:把你的输入先写成一个结构化动作再发出去(例如「动作:割断吊灯绳 | 目标:全体敌人 | 期望:造成伤害」),而不是直接丢一句自由文本。这一步就把「输入过滤」做掉了一半,而且不需要写代码。
自检动作:翻一遍最近一轮的记录,找出三处「结果由模型说了算」的地方(一次判定 · 一次数值 · 一次状态变更)。改不掉全部也没关系 —— 只把其中一件挪到你自己手里(例如从下一轮开始自己掷骰并把结果当既成事实敲进去)。能做到一件,说明这一层的边界你已经开始看见了;一件都挪不动,说明你其实还在用「演出型」的玩法,那就别为难自己去建规则壳。
[C级]14Dimension《The Return of Illunes》发行稿(2026-10-09 · 世界首款离线 TRPG · 内置为该作训练的 AI GM · 本地模型无联网无订阅无按次费 · 输入先过滤 · 数值由游戏规则裁定 · 生成文本展示前逐条检查 · Free Action 判定改变战斗结果) [C级]Arcanum RPGs《AI Dungeon vs AI Realm (2026)》(结构性缺口:AI Realm 有规则丢记忆 · AI Dungeon 有记忆没规则;句判「想要既能跑长团又有 5e 式规则的玩家,会被两家同时辜负」) [C级]Arcanum RPGs 引两家官方定价与档位(AI Realm:Free 不列消息数 · Bronze $7.99 500 条 · Platinum $14.99 起不限 · 额度每月重置不结转;AI Dungeon:免费 Wanderer 9 模型 4k 上下文 25 条记忆) 同类:让 AI 当 GM,骰子该由谁掷? · 你的 AI 跑团,世界里真的有别人吗?
继续往下读
同级:让 AI 当 GM,骰子该由谁掷? 随机一篇