标题与文件错位时,先不要改标题,而要用“唯一标识”把两边重新对齐:在文件侧找到稳定且不随展示变化的字段(如文件名、外部ID、发布时间戳),在页面侧找到同一字段的可见或可读位置,逐条比对。只有当两侧都存在同一个唯一值时,错位才能被可靠修复;如果文件本身没有唯一标识,或导入时该字段被丢弃,那么任何按顺序、按标题相似度的对齐都只是猜测。
两种错位的原因不同,核对方式也不同。
区分方法:先取三条记录,检查标题与正文是否属于同一主题。如果正文与标题主题一致,只是位置不对,属于顺序错位;如果正文与标题明显无关,属于内容错位。这个判断决定下一步是重排还是重映射。
可靠的核对需要一个两侧都存在的稳定值。优先顺序如下:
如果以上都没有,标题本身不能作为唯一标识:同批内容里出现相同或近似标题时,按标题匹配会把两条记录指向同一文件。此时应先在导入流程中补一个唯一字段,再重新执行导入,而不是在结果页上逐条手改。
一个假设例子:假设一批文件名为 a01.html 到 a10.html,页面侧字段记录了来源编号。若发现第 4 条页面显示的是第 7 个文件的内容,可以取第 4 条页面的来源编号,在文件列表中定位该编号对应的文件,确认两者是否一致。若一致,说明是导入映射错误;若不一致,说明文件侧编号本身写错,需要回到文件生成环节修正。
有一种情况会让核对失效:文件与页面的排列顺序完全一致,但两者都基于同一个错误来源。例如导入脚本按文件名排序,而文件名在生成时就与内容错配。此时逐条比对顺序会全部通过,错位却仍然存在。
因此,顺序一致只能排除“排序导致的错位”,不能证明对应关系正确。要排除这个反例,需要至少抽查一条记录,验证标题、正文、唯一标识三者指向同一来源。
确认错位类型和唯一标识后,下一步动作是修正导入映射或排序规则,然后重新导入受影响的记录。如果直接在结果页修改标题或正文,下一次导入会再次覆盖,错位会重复出现。
重新导入后,再抽查同一组记录,确认标题、正文、唯一标识三者一致。若仍不一致,说明问题在文件生成阶段,而不是导入阶段,需要回到上游检查文件命名或字段写入。这样处理的结果是:错位被定位到具体环节,后续同类导入可以复用同一套核对方法,而不是每次依赖人工比对。