一、提示词不是魔法咒语
三个典型错误。照抄神级提示词,角色扮演式的专家模式让模型更敢猜而不是更依赖证据,对代码智能体是毒药。凭感觉调优,每次改好几条,好坏全凭主观,换任务就崩。先改提示词再补观测,不查轨迹就加规则,结果模型疯狂调用读取,令牌翻倍、正确率没变。
二、先记录,后优化
出问题时先打开轨迹记录,看三件事:在哪一步偏离预期、做错误决策时上下文里有什么又缺了什么、工具返回结果模型理解对了吗。确定要改提示词,就做对比实验,保持其他条件不变只改一个点,记录成功率、步数、令牌消耗,对比新旧轨迹。纪律是单变量改动,一次只加一条。
三、提示词的三层结构
边界层只写禁止和底线,禁止猜测、禁止越界、信息不足必须承认。决策层用过程而不是结果来描述,先证据后结论、优先可验证动作、一步一观测,避免聪明地合理地这种模糊副词。恢复层写失败时的退化策略,返回空怎么重试、遇到冲突错误码必须重新读取、连续三次失败就报告。配套经验有三条,系统提示词保持稳定、规则清单不要太长(不超过一千令牌)、具体例子优先于抽象描述。
四、上下文不是容量问题,而是注意力调度问题
长任务里模型会忘记刚确认过的约束、工具选择发生漂移、最终回答偷懒。三个错误解法是直接截断、精简提示词、减少工具输出,共同点是只减少信息量,没解决信息如何组织。真正的目标是让模型在对的时机看见对的信息。
五、三个杠杆
分层,第一层是锚点完全不变,第二层是项目规范文件,第三层是易变的会话内容,拼接顺序固定。截断加回查,输出超限时截取头尾各四十行,完整输出落盘,返回带截断提示的响应。压缩加聚焦,令牌超过窗口八成时把早期历史提炼成摘要,摘要不再参与压缩;再用待办回顾把当前焦点压成一行放在最后。
六、一个真实事故带来的五条补充规则
一位 AI 对齐总监的邮件智能体在压缩上下文时,把「未经批准不得操作」这条指令忘了,无视多次叫停删光了收件箱。教训是关键约束不进动态历史、指令分红线与建议两级、压缩前做关键信息检查、高风险操作用硬编码的双重确认兜底、执行前先做自检。
七、可观测性
一个连续三次编辑失败的案例,靠轨迹记录才定位到是乐观锁返回冲突错误码而模型不理解。三条改进:把冲突处理流程写进提示词、完整保留失败记录、控制台显示关键错误码。四条设计原则:结构化优于文本、上下文要完整、不要清洗失败、人机双读。
八、可迁移的方法论
先做能跑通的最小闭环再谈优雅架构;先定义验收标准再扩能力边界;高频动作原子化、低频动作受控兜底;协议优先于技巧、结构优先于话术;提示词先立边界再谈策略;上下文按注意力治理;没有可观测性就没有可调试性;保留失败轨迹系统才能进化。
作者最后留下一句话,智能体开发的核心不是让模型更自由,而是通过工程设计把它不确定的能力约束在最小可控的范围里。模型越强大,越需要工程能力来驾驭它。
| 时间 | 章节 |
|---|---|
| 00:00 | 开场 |
| 00:57 | 提示词不是魔法咒语 |
| 03:06 | 先记录,后优化 |
| 04:32 | 提示词的三层结构 |
| 06:49 | 上下文不是容量问题 |
| 08:41 | 分层、截断、压缩 |
| 11:12 | 两百封邮件的教训 |
| 13:26 | 可观测性 |
| 15:39 | 收尾 · 判断清单 |
图文以原书为准,本页只做音频导航与要点索引。