OpenClaw 接入知识库以后,最容易出现的误区是“能搜到就能引用”。实际生产里,Agent 搜到的内容可能来自旧 SOP、临时讨论、草稿文档、过期公告,甚至是已经被替换的客户口径。
引用白名单的作用,是先规定哪些来源可以直接支撑回答,哪些来源只能作为线索,哪些来源不允许进入客户可见输出。它应该和 知识库陈旧内容巡检、证据包、回放对照 一起配置。
先定义可信来源
白名单不是只写几个文件夹名字。要按业务场景定义可信来源:产品问题优先官方文档和最新发布说明,合同问题优先合同原文和法务确认记录,客服口径优先已发布 SOP 和客户成功确认稿。
同一个资料源在不同场景里的可信度也不同。会议纪要可以作为背景线索,但不一定能直接支撑价格、赔付或合同承诺。
禁用来源要写清楚
除了白名单,还需要明确禁用来源。草稿、已归档制度、个人临时笔记、未审批话术、测试数据、旧版本接口文档,都不应该被 Agent 直接引用。
如果这些内容不能从知识库里删除,就要打上状态标签,让检索层和生成层都知道它们不能用于正式回答。这比在提示词里反复提醒“注意资料准确”更可靠。
过期标记要触发降级
白名单资料也会过期。每个可信来源最好保留更新时间、责任人、适用版本和复核周期。超过复核周期后,不一定立刻禁用,但应该触发低置信度提示或人工复核。
这可以和 质量门禁 连起来:当回答依赖过期资料、冲突资料或低等级资料时,Agent 不应直接外发。
发布前做样本回放
白名单配置完成后,要用历史问题跑一组样本,检查 Agent 是否真的只引用可信来源,是否能识别禁用来源,是否在资料冲突时转人工。
如果回放发现某些高频问题只能命中低可信资料,就说明不是 Agent 的问题,而是知识库本身需要补官方口径。这里可以接上 人工复核抽检,让负责人优先处理高影响缺口。
总结
OpenClaw 引用白名单的重点,是把“能搜到”变成“能引用”。只有可信来源、禁用来源、过期标记和复核规则都清楚,Agent 的回答才不会被低质资料带偏。