答得出处

坐下 4 / 5

脚注指向文档,句子里的数字仍可能是编的。

模型答:「住宿上限每晚 450 元,超标须事前申请。去年共批准例外 128 次。」末尾挂了 policy-v3。打开第 12 页,前两句在,128 不在。引用系统若只检查「有没有贴上一个 doc id」,这句假数字会过关。数字要单独过一遍,不能跟整段答案打包签字。

一条链,四截

把回答拆成 claim,每一句可核对的事实单独走:

claim「一线城市住宿上限 450 元/晚」→ span「住宿费限额:一线城市 450 元/晚」→ chunk travel-cn#v3#p12-c2 → 文档 doc:travel-cn 版本 3,哈希 a19c…,as-of 今天。

缺任何一截都不算有出处。只有 chunk 没有 span,你无法证明 450 来自哪一行,切块一改历史引用全断。只有文档没有版本,v2 作废之后你还在用旧数字。span 对不上当前哈希,说明引用的是一份已经变过的快照。

怎么查一句

生成后不要只看流畅。对每个带数字、带义务、带人名的句子问:检索记录里有没有一段字面覆盖它。覆盖可以是同义改写,但数字必须同源。450 写成「四百五十」可以;编出 128 不行。

「可申请」写成「自动批准」属于说歪:span 还在,意思翻了。这类要用对照,不能靠检索分数。冲突的两段同级制度同时进上下文,应把冲突摆出来,不要私自挑一段。引用列表里出现检索从未返回的 doc id,那是生成模型在点名,直接丢掉这一句。

无答案也是一种出处状态。检索为空,或命中的都过期、都无权限,应拒答或追问。空结果仍然生成,是最常见的假引用来源:模型用训练记忆补全,再随手挂一个刚才看到的 doc id。改切块以后,旧的 chunk id 会失效,所以引用要落到文档版本加 span 偏移,不能只存「当时的 chunk-17」。抽查时专门盯带数字的句子:金额、天数、条款号、人数。这些最容易被流畅的生成补上。

这次检索留下的卡片

query: 中国区差旅住宿怎么报
as-of: 2026-07-17
chunk: travel-cn#v3#p12-c2
span: 「住宿费限额:一线城市 450 元/晚。超标须事前书面申请,事后报销不补。」
doc: travel-cn @ v3 hash=a19c…
未命中: 例外次数、平均处理天数

下面三句是模型写的。点出哪一句在这张卡片上没有 span。

三句回答,标没有 span 的那句

自己对过

句 C。128 和 2.3 检索记录里没有。A、B 都能指回第 12 页那两句。