当词库流程中的某个步骤确实无法执行时,文章不该停在那里,也不该假装那一步可以跳过,而应给出可替代的动作,并说明替代后结果会差在哪里。判断标准很简单:替代路径必须让读者仍然能完成本轮任务,同时明确知道哪些结论因此变得不可靠。若替代动作只是把同一个步骤换个说法,或者需要读者自行补齐关键条件,那它就不是替代路径,只是把问题推回给读者。
步骤无法执行通常分三类原因,替代方向完全不同。第一类是权限或工具缺失,例如无法导出站内搜索记录,或没有访问日志的权限。第二类是数据本身不存在或太稀疏,例如某个栏目只有几条查询,根本不足以形成词簇。第三类是步骤依赖前一步的产物,而前一步产出质量不够,例如词表里大量词义重复、指向不清,导致无法继续分组。把原因写清楚,替代路径才有依据;如果只写“此步可跳过”,读者不知道跳过之后该拿什么继续。
常见的两种替代是:用更小范围的样本先跑通流程,或者改变这一轮的目标,从“整理完整词库”降级为“验证几个方向”。它们成立的条件不同。
如果两种都看似可行,优先选能让读者拿到“可继续加工的半成品”的那一种。半成品比空结论更有价值,因为它保留了后续修正的入口。
假设某站栏目查询极少,编辑决定用相邻栏目的词来填充,理由是“语义相近”。这一步在表面上让词库看起来完整了,但会让后续的分组和内容映射全部建立在错误归属上。一旦按这些词去安排文章,就会出现内容与栏目意图不符的情况,而这种偏差很难在后期靠人工逐条纠正。反例说明:当替代动作引入了新的错误归属,而不是仅仅缩小范围时,它就不再是替代路径,而是制造了新的问题。此时正确做法是保留空缺,并标注空缺原因,而不是强行补位。
文章在给出替代路径时,至少要让读者知道:替代后能完成什么、不能完成什么、下一步该做什么。可以用一个简短的假设例子说明。假设无法导出站内搜索数据,替代做法是手动记录一周内出现的查询词。这个动作能产出一个小样本,但不能代表整体分布;下一步应先用它验证分组规则是否可用,而不是直接据此确定选题。这样写,读者拿到的是可执行的动作和明确的边界,而不是一句“视情况而定”。
替代路径执行完,必须回到原流程的某个确定位置。如果替代动作产出的是样本,就回到分组或验证环节;如果产出的是假设,就进入验证环节,并明确验证通过后才继续。若验证不通过,应回到原因判断,而不是重复同一个替代动作。这样,替代路径才真正接得上原来的工作,而不是另起一条无法汇合的支线。