





演示会上,员工输入完整型号和标准问题,企业知识库很快给出正确答案。真正使用时,销售只问“这款能不能装在室外”,接着追问“沿海地区呢”,系统却把上一轮没有说明的材料等级当成既定条件。AI知识库上线验收若只准备几道标准题,测到的往往是资料能否被找到,而不是回答在真实对话里是否可靠。
验收题不应直接从产品手册标题复制。可以先从销售聊天、售后记录和内部搜索词中抽取问题,再去除客户身份信息,保留口语、省略和错别字。每个问题卡至少写明使用角色、已知条件、允许引用的资料、期望动作和风险等级。比如“某系列能否用于高湿环境”,期望结果未必是一句肯定答复,也可能是要求补充具体型号、温度范围与防护等级。
同一个知识点要设计成一条对话链。第一问故意缺少型号,第二问补充使用场景,第三问改变前提,第四问要求给出处。这样可以观察系统是否继承了不该继承的条件,能否纠正前文,以及引用是否仍指向当前版本。若企业已按适用型号与售后边界整理知识单元,测试卡应直接引用其中的型号范围和禁用条件,不再另写一套答案。

只用“回答正确”一个状态,很多问题会被误判。建议把结果分成直接回答、补充追问、明确拒答、转交人工和引用失败。涉及公开参数时可以直接答;缺少选型条件时应追问;客户专属价格、未发布图纸或无法确认的兼容性,需要拒答或转给相应岗位。验收人应记录实际回答、引用文件、资料版本和登录角色,而不是只在表格里打勾。
权限也要作为题目变量。同一问题分别用访客、销售、技术支持和管理员身份测试,确认公开入口不会引用内部报价,销售账号也看不到无关客户的附件。已有报价资料公开回答权限划分时,可把资料分级表直接转成验收矩阵:行是问题,列是角色,单元格写允许回答、仅显示摘要或禁止引用。这样权限调整后能重复执行,而不是依赖验收人的印象。
资料有效期同样不能靠人工记忆。测试时准备一份现行手册、一份已失效版本和一条尚未审核的更新记录,检查系统引用哪一份。若回答混入旧参数,应定位到索引未更新、文件状态缺失还是多个来源冲突。不能因为最终句子碰巧正确,就忽略引用了过期资料;下一次换个问法,错误仍可能出现。
验收发现问题后,不要直接在提示词里追加一句限制便结束。修正单应保留问题编号、完整对话、登录角色、期望行为、实际行为、引用片段和发生时间,再判断责任落在资料、权限、检索、提示规则还是转人工流程。资料缺字段就补资料,权限映射错误就改访问范围,只有表达方式失控时才调整提示规则。
每次修正后,要重跑原失败题及其相邻题。修复“未给型号时必须追问”,可能让所有简单问题都被多问一轮;加强拒答,也可能挡住本可公开的安装说明。回归清单应同时保留正常题、边界题和高风险题,并记录知识库版本与测试日期。连续两次结果一致,引用地址可访问,转人工信息带上原问题和已有条件,才算该项通过。
上线后的新问题也应进入同一题库。客服转交记录、员工点踩和无结果搜索词可以按周归类,但不能见到一个问题就立刻改系统。先确认它是资料缺口、问法变化还是权限异常,再补一张验收卡。题库负责人还应记录处理人和复测期限,避免失败问题只停留在讨论群里。这样题库会留下真实使用中的判断依据,知识库更新后也能回答一个更实际的问题:改动解决了什么,又有没有破坏原来正确的回答。