Skip to main content

证据纪律

大多数 AI 的失败并不是戏剧性的幻觉,而是「看起来合理的中间结果被升级成更强结论」:
  • 命令退出码为 0,Agent 就说系统修好了;
  • 文件被改了,Agent 就说功能可用了;
  • 本地构建通过,Agent 就说部署已经上线;
  • 搜索没有结果,Agent 就说「不存在」;
  • 你随口说的前提,Agent 当成「已独立核实的事实」复述。
Myrm 的证据纪律技能通过给默认智能体(builtin-economy)的每一个回答套上「结论对证据契约」,让这些失败变得罕见。

它做什么

技能按证据类型区分结论,并按结论强弱施加对应层级的证明义务

安全契约

除了标注证据,技能还堵住 Agent 常见的「温和撒谎」方式:
  • 绝不声称访问了任务中实际不可用的资源。
  • 绝不把「计划」或「尝试过的动作」说成「已经发生的动作」。
  • 绝不把工具报错、空结果、部分同步或不可访问的数据重新解释成「验证成功」。
  • 绝不为了拿到更强证据而做无关的破坏性操作。
  • 否定性结论(如「不存在」)只限于真正检查过的范围。

内置的过度谨慎平衡

证据纪律是一把双刃剑,所以技能同时防止走向另一个极端:
  • 不要滥用 UNKNOWN。 当证据合理可得时就去验证——别拿谨慎当跳过检查的借口。
  • 先自查再询问。 能自己检查证据的话,先查,再请用户重复信息。
最终效果:一个对自己不知道的事情诚实、能验证的就主动验证、从不把自己的作业推给用户的 Agent。

如何使用

零配置。 技能默认绑定在通用内置智能体(builtin-economy)上,在每一次对话中生效——包括 Web 会话、定时任务和渠道。 你还可以:
  • 设置 → 技能中查看它,它和其他预置技能并列展示。
  • 把它绑定到任意新建智能体,或从不需要它的智能体上移除。
  • 在智能体自定义提示词里加强触发,例如「回答前先证明重要结论」。

验证与契约测试

技能的行为契约由 33 项架构契约测试守护——逐条断言每一条行为条款都存在、frontmatter 版本号保持合法,技能不会悄悄漂移或退化。完整管线(同步 → 绑定 → 可见性)由无 mock 的集成测试覆盖。

相关