先晒数据
改写法前后对比,同一个模型、同一个项目、同一个管家:
| 指标 | 散文式 | 结构化规则 | 全流程优化 |
|---|---|---|---|
| AI综合听懂率 | ~60% | ~85% | ~90-95% |
| 漏读/忽略规则 | ~25% | ~8% | ~3-5% |
| 需要纠偏频率 | 每改2次纠1次 | 每改5次纠1次 | 每改10次+纠1次 |
| 文件字符数 | 13,669 | — | 9,124 |
仅仅改写法,听懂率提了 20 个百分点。 没换模型、没改代码、没加算力——就是把"散文"写成了"电报"。
我的 AI 管家,不听我的话
去年开始玩 Hermes Agent,给皮蛋(我家 AI 管家的名字)写了一堆规则。大概长这样:
“当系统出现异常的时候,如果连续两次都是异常的话,那你就要通知姜老师。还有晚上11点之后早上8点之前要保持安静,除非是紧急情况才通知。另外每天要检查一下网关进程是不是在运行,磁盘空间还够不够用。”
注意:作者当时写这句话用了一分钟,但AI读懂它用了不知道多少token。
结果呢——跑起来全是问题:
- 凌晨 2 点,手机响了。皮蛋推了一条消息:“磁盘空间不足”。我说你凌晨 2 点推什么消息?规则里不是写了 23 点到 8 点要安静吗?
- 回复说:“紧急情况可以通知,磁盘不足属于紧急。” 我:连续两次异常才叫紧急,第一次只是提醒。
- 然后它沉默了,也不知道听没听懂。
- 还有一次它自己做了个决定没问我。规则里明明写了"不确定→问我"。它觉得"这不算不确定"。
- 另一次连续两次异常该通知那次,它没通知。原因:规则里"连续两次"和"通知"隔了两句话,它没把这两个条件连起来读。
后来复盘,这三个问题本质是同一个:给 AI 写散文式规则,等于给它出阅读理解题。
阅读理解题,AI也不擅长
我试过很多方案。
一是加粗强调——"必须通知姜老师"。结果不太行。
二是反复写——同一个意思写三遍。更糟了,模型不知道哪一遍是对的。
三是画流程图——给模型流程图图片。没用,它根本看不懂。
直到有一天翻 Reddit,看到有人说:模型对关键字的响应权重,远高于自然语言。
特别是这几个词:NEVER、IF、CHECK、ELSE。把这四个词放在句子开头,模型读到的时候权重明显更高。
按这个思路改了。
改前(散文式):
不能泄露隐私,不确定就问姜老师。不要执行破坏命令,rm记得用trash。每天检查网关进程、磁盘、端口。
改后(结构化):
NEVER: 泄露隐私 | 执行破坏命令(先问!) | rm(用trash)
IF 不确定: 问我
CHECK: 网关进程 | 磁盘 df -h / | 端口16688/6688
同样的意思,用 NEVER/IF/CHECK 写出来,模型的反应完全不一样。
皮蛋的反馈: 以前读规则像在读作文理解题,现在像在读表格——一眼扫完就记住了。
完整方案:六个写法
我把这个思路做成了一个完整的方法包,包含六个结构化写法和三个平台适配文件:
六个写法
| # | 写法 | 用途 | 示例 |
|---|---|---|---|
| 1 | 主题拆解 | 把长散文拆成独立主题 | 隐私/安全/健康/行为 各一主题 |
| 2 | NEVER/IF/CHECK | 行为约束用关键词开头 | NEVER: rm(用trash) |
| 3 | 一意一行 | 每行一个规则,不跨行 | 见上表 |
| 4 | 去虚词 | 删"当…时候"、“可以”、“应该” | IF: 磁盘>85% → 通知 |
| 5 | 模板+校验 | 规则模板+自动校验脚本 | 写后自动检查违规 |
| 6 | 三平台适配 | Hermes/Claude Code/Codex CLI各一份 | 同一结构,不同文件名 |
三平台适配
├── SKILL.md → Hermes / OpenClaw
├── CLAUDE.md → Claude Code
└── .codex/instructions.md → Codex CLI
代价和限制
说说不好的部分。
- 有学习成本。 从散文转结构化,大概需要 2-3 次练习才能自然写出来。
- 不适合复杂逻辑。 如果你有跨多个文件的条件判断(“A文件被改时检查B文件”),结构化也救不了——那得写代码。
- 不保证 100%。 剩下那 5% 是模型本身的理解天花板,不是写法能解决的。
- 跨文件的效果依赖去重。 如果两个文件写了冲突的规则,结构化了也白搭。
信任公式:专业度 = 具体能力展示 × 诚实承认局限。
写在最后
如果你也在跟你的 AI 较劲,可以试试这个方法。
结构化规则不是为了省 token(虽然顺带省了 33%),是为了让 AI 少犯错。
准确率从 85% 到 95% 的那 10 个百分点,靠的不只是写法,还有跨文件去重、模板和自动校验。但 60% 到 85% 的 20 个百分点,仅仅是改写法。
这套技能已发布在虾评市场,免费试用:
你给你的 AI 写过什么让它理解不了的规则? 评论区聊聊,我看看谁家的 AI 最不听话。