可对照的交付表不是把双方指标折中成一个数字,而是把甲方关心的业务结果拆成乙方可控制的动作,再为每个动作约定可复核的证据、时间窗和判定口径。做不到这一步时,双方往往都在报“完成”,却无法判断同一件事是否真的做完。
甲方说“排名没上来,等于没交付”,乙方说“约定的页面和内容都做了,任务已完成”。这类冲突通常不是谁在说谎,而是两套指标层级不同:甲方盯的是结果,乙方盯的是过程。结果受竞争、需求波动、站点历史等因素影响,过程则相对可清点。把两者混在一张表里,就会互相否定。
更麻烦的是,双方各自记录的时间点不同。甲方按自然月看流量,乙方按批次看上线,中间的延迟、回滚和重复修改没有被记录,于是同一周在两份表里呈现完全不同的状态。
如果甲方要的是询盘量,乙方交付的是页面、内链和内容更新,那么直接比较两者永远不公平。此时正确做法是建立三层对照:业务结果层、可观测中间层、执行动作层。业务结果层只做趋势参考,中间层用于判断方向,动作层用于验收。假设某月询盘量下降,但索引覆盖、目标页面点击率、有效咨询入口曝光都在上升,就不能单凭询盘一项判定外包失败。
如果双方看的是同一类数据,却得出不同结论,问题多半出在统计口径:时间范围、去重方式、是否包含品牌词、是否剔除内部访问。此时换指标没用,应该先统一口径,把差异写进交付表的判定栏。能区分这两种解释的证据是:把同一时间段的原始记录并排看,如果数字本身一致而结论不同,是层级问题;如果数字本身对不上,是口径问题。
每个交付项至少写清四件事,缺一项都会在验收时产生争议。
其中“时间窗”最容易被省略,也最容易引发误判。动作完成当天就去查结果,几乎必然得出“没效果”的结论;反过来,无限期等待又会让验收失去意义。
假设甲方按季度考核询盘量,乙方按周交付内容与页面调整。交付表可以这样写:动作是“每周完成2个目标页面优化”,证据是修改记录与页面地址清单,时间窗是“上线后满8周再评估该批页面”,判定是“该批页面的有效咨询入口点击不低于上线前基线”。若8周后未达标,先核对基线是否被同期改版污染,再决定是继续优化还是调整页面选择。这个例子里的数字只是说明比较方法,不代表任何真实项目的预期。
建议在第一次对账时,先不动指标,只做一件事:让双方各自标出“我能直接控制的”和“我只能间接影响的”。标完后,把间接影响项移到参考区,把直接控制项放进验收区。这个动作的结果会直接决定下一步——如果验收区剩下的大多是内容与页面动作,那么后续争议应集中在动作质量与覆盖范围;如果甲方坚持把业务结果放进验收区,就需要同步约定基线、对照方式和归因边界,否则交付表只是把冲突推迟到结算日。
需要说明的是,索引量、抓取量或某项统计归零,并不能单独证明乙方处理正确或错误,它也可能是站点改版、抓取预算变化或统计工具调整造成的。把这类现象写进交付表时,应同时记录同期发生的其他变更,再作为判断依据。