一、到期契约必须用生产日志裁决。
这周按开关生命周期规范,把三个”再观察一段时间”的开关拉出九批生产日志,一次性结案:该杀的杀,该物理删除的删除,该转正的转正(转正了默认也还是关,放量另说)。以前这类开关最容易的下场,是”临时方案”悄悄变成永久方案。这次立下的硬动作:核验数字写进提交记录,默认值跟着裁决走,死代码直接删,不留”万一以后有用”的降级层——那种层最后都会变成没人敢动的遗迹。AI 编程的留痕在这时候特别值钱:当时为什么加、证据是什么,翻记录就能对上。
二、规则一定会漏,漏的代价要主动选成”可逆”。
确认护栏把「执行」排在「行」前面、列表项跳过重复检测、附件改写默认走可控灰度——这几件事的共同点一样:都承认规则会漏,但把漏的方向翻成可逆。误拦截了,重新澄清一次就行;漏了重复行,成本接近零;改写不对,开关一键回滚。比继续往词表里加词强得多。
反面教材也在同一周:AI 编程跑的一个修复循环,九轮自判成功,被独立评审直接拦下——没有端到端测试兜底、评审人不是写代码的人,变量隔离做得再漂亮也不能自称”已修”。自测通过和被修好,是两件事。
三、把非决策型输出移出模型热路径。
一个体验优化的本质收获:那些”不需要思考”的输出——固定的加载话术、机械的确认回复——不该进大模型的调用路径。收敛成规则加固定话术池之后,验收标准也从”话术自不自然”换成了更硬的:”失败模式可枚举、随时可回滚”。先画清确定性的边界,把模型留给真正需要语义判断的地方。