先判断变化属于哪一种:如果旧格式仍被接受,只是新增了格式,改输入规范的重点是“补充分支”;如果旧格式已被拒绝或结果明显不可比,就必须“切换主格式并重做基线”。两种情况的动作和风险完全不同,下面分别给出可核对的依据。
不要只看工具提示,要拿同一批对象做对照。选三到五个此前有明确结论的对象,分别用旧写法和新写法各跑一次,记录三件事:是否被接受、返回结果是否完整、同一对象两次结论是否一致。如果旧写法仍被接受且结论一致,说明是新增格式,可以并行;如果旧写法报错、字段缺失或结论与历史明显不同,说明是替换,必须停用旧规范。
这里有个常见误判:请求量或抓取量下降,并不能单独证明格式处理正确。它也可能是对象本身减少、访问频率被限制、或上游数据源变化。要排除这些解释,至少换一个时间段重跑同一批对象,看下降是否只出现在格式变化之后。
适用条件是旧写法仍能返回完整结果,且新格式带来的是覆盖面扩展,而不是结论口径变化。此时不要整体重写规范,而是在原有条目后追加分支,并标注优先级。
动作的结果会直接影响下一步:如果并行跑一周后,新格式对同一对象的结论与旧格式一致,就可以把它提升为默认;如果结论不同,说明差异来自口径而非格式,此时应先统一口径,再谈输入规范。
适用条件是旧写法已无法提交、返回错误,或返回内容缺少此前依赖的字段。这时最大的风险不是改规范本身,而是拿新格式的结果直接和旧结果比较。两者口径不同,比较会得出错误结论。
可执行的做法是:先冻结旧数据,标记为“历史口径,不可与新结果混用”;再用新格式对一批对象重跑,形成新基线;之后所有判断都只在新基线内部比较。假设某团队此前用旧格式记录了二十个对象的结论,切换后应重新跑这二十个,而不是把新结果直接拼进旧表。这只是说明比较方法的假设例子,不代表任何真实项目数据。
如果确实需要跨口径对照,就单独建一张映射说明,写清哪些字段含义变了、哪些字段消失、哪些是新增的,供人工判断时参考,不用于自动汇总。
多个角色对同一事实理解不同,通常不是谁记错了,而是各自依据的格式和口径不同。与其争论结论,不如把分歧拆成可核对项:对象标识是否同一、输入格式是否同一、工具版本或规则是否同一、结果字段是否同一。四项里只要有一项不同,结论就不可直接比较。
建议在规范里固定一张核对清单,每次格式变化后逐项确认,并把确认结果和规范一起归档。这样下一次再出现“结果对不上”时,先查清单,而不是先改结论。
如果工具由外部提供,且具体支持哪些格式、是否保留旧格式、字段含义是否变化,都需要以该工具当前的官方说明或实际返回为准,不能凭经验推断。规范里应写明“格式支持范围以核对结果为准”,并指定一名负责人定期复核。
还有一种例外:对象本身不规范,导致新旧格式都返回不完整结果。这时改输入规范解决不了问题,应先修正对象,再判断格式是否需要调整。区分方法是看同一格式下,规范对象是否稳定返回完整结果——如果稳定,问题在对象;如果不稳定,问题才可能在格式或工具。