工序刻度 / 01 — 12
12 道工序,把一场比赛变成可对照的条目
爱体育看台的资料库里,每场比赛都以同一种结构存放:先列首发与轮换,再列射门、传球与控球指标, 最后给出同联赛与跨联赛的对照位次。这种一致性不是自然形成的,它来自一套固定执行的工序—— 三个阶段、12 道工序,每一道都有明确的输入、交付物和确认方式。下面把整条链路逐条摊开, 方便你判断一条记录在什么条件下可以被引用、被比较。
- 01 赛前名单入库
- 02 基础事件采集
- 03 指标首轮录入
- 04 轮换结构标注
- 05 字段完整性核对
- 06 关键指标复算
- 07 赛季区间挂接
- 08 对照位次生成
- 09 首轮归档发布
- 10 赛季区间维护
- 11 修订版本留痕
- 12 长期一致性巡检
把赛场上的东西先收进来,不急着下判断
这个阶段处理的是原始输入:联赛公布的名单、比赛过程中产生的事件、赛后公报里的统计数字。 采集的动作只有一件事——把能拿到的东西照着统一的字段位放好。缺的项不猜测、不推算, 只在对应位置标注缺在哪里、为什么缺。四道工序按时间先后咬合,前一道没确认,后一道不启动。
-
01
赛前名单入库
开赛前 90 分钟收齐两队首发与替补名单,按联赛官方发布口径录入姓名、位置、号码与出场状态。 两队先后公布时以最终版为准,早先的版本留在草稿层备查,不覆盖、不删除。
- 交付物
- 首发名单草稿,含出场名单与替补席共 22 项基础字段
- 确认方式
- 两名整理员分别独立录入,逐项比对差异后再合并成一份
-
02
赛后基础事件采集
终场哨响后 30 分钟内,按时间轴录入门球、射门、射正、角球、越位、黄牌与红牌等基础事件。 每个事件绑定发生的分钟数与涉及球员的位置编号,事件顺序以分钟为准,不以公报列举顺序为准。
- 交付物
- 单场事件流表,按分钟排序,含事件类型与位置编号
- 确认方式
- 事件总数与联赛公报逐类核对,对不上的项回看录像判断
-
03
指标字段首轮录入
赛后 24 小时内完成首轮归档,录入射门次数、射正率、传球成功率、控球率与换人节点等主要指标。 每项指标连同它的样本量一起写入,样本量不足的项标明原因,不用估算值填空。
- 交付物
- 首轮归档条目,32 项字段中的主要指标已完成录入
- 确认方式
- 按指标工程给出的取值区间过滤异常值,越界项进入二次复核
-
04
轮换结构标注
把换人节点与阵型变化对应起来,标出首发与轮换的关系:哪些位置属于常规轮换、 哪些是因为伤停或红牌造成的被动调整。这层标注直接决定后续复盘条目怎么写。
- 交付物
- 轮换标注表,含换人分钟、下场位置与阵型前后对比
- 确认方式
- 与首发名单、换人节点做时序交叉复核,顺序矛盾即刻退回重标
让字段能被互相对照,而不是各说各话
能对照的前提是口径一致。这个阶段做三件事:把 32 项字段一项不落地过一遍、对关键指标做独立复算、 把条目挂到正确的赛季区间与轮次上。工序 08 结束之后,一条记录才真正具备横向比较的资格—— 在那之前它只是素材。
-
05
字段完整性核对
32 项字段逐项检查,记录缺口、缺口持续时间与可能来源。缺失不等于错误, 但要写清楚为什么缺——是联赛没有公布,还是采集窗口内确实没拿到。
- 交付物
- 字段缺口清单,逐项标注缺口原因与影响范围
- 确认方式
- 清单中每一行都要写明补录来源与预计补录窗口,写不出来不通过
-
06
关键指标复算
射正、传球成功率与跑动分布三类指标,由第二个人独立复算一遍,与首轮数值并列摆放看差多少。 重点不是谁对谁错,而是差值有没有超出允许范围。
- 交付物
- 复算差值表,含首轮值、复算值与差值三列
- 确认方式
- 差值越过阈值即进入偏差评审,评审结论写进条目备注备查
-
07
轮次与赛季区间挂接
把每场条目挂到所属联赛的赛季区间与具体轮次上,保证同一支球队在一个赛季里的条目顺序 与真实赛程顺序一致。这一步做错,后面生成的位次会整片错位。
- 交付物
- 赛季区间索引,按联赛—赛季—轮次三级排列
- 确认方式
- 检查轮次连续性与前后场次的时间顺序,出现倒挂立即退回重挂
-
08
对照位次生成
同联赛位次按联赛内部统计口径排出;跨联赛位次额外标注口径差异,比如不同联赛对射正的判定松紧、 对控球率的统计方式是否一致。跨联赛数字只作参考线索,不作结论。
- 交付物
- 对照位次表,分同联赛与跨联赛两栏并列
- 确认方式
- 同联赛位次与联赛内部口径核对一致;跨联赛位次必须附带口径差异说明
条目上线之后,还要在赛季里站得住
发布不是终点。条目上线之后要随着赛季推进接受维护:新赛季要接得上、口径调整要留痕、 跨赛季的同名字段要保证说的是同一件事。这四道工序决定资料库能不能被长期信任, 也决定你去年存下的对照记录今年还能不能继续用。
-
09
首轮归档发布
赛后 72 小时内补齐全部 32 项字段,把条目正式发布,同时写入所属赛季区间、轮次与路径编号, 并打上口径标签,标明这条记录用的是哪一版统计定义。
- 交付物
- 上线条目,字段齐全,带赛季区间、轮次与口径标签
- 确认方式
- 发布前跑一遍字段数与口径标签检测,任一不通过即暂停发布
-
10
赛季区间维护
新赛季开赛前先把区间骨架搭好:哪些字段沿用、哪些字段新增、哪些字段停用, 都在骨架里写明理由。骨架落地之后再往里填条目,避免赛季进行到一半再动结构。
- 交付物
- 新赛季区间框架与字段对照说明
- 确认方式
- 与上一赛季区间逐字段对照,新增项与停用项都要写明依据
-
11
修订与版本留痕
出现口径调整或数据更正时,改的是新值,留的是旧值。修订记录写明改了什么、依据是什么、 影响哪些场次,读者可以对照前后两版看到差异,而不是只看到最后的结果。
- 交付物
- 修订记录,含原值、新值、修订依据与受影响的条目编号
- 确认方式
- 修订记录可在动态中心查到,并能反查回具体场次
-
12
长期一致性巡检
每个赛季结束前做一次全库巡检,重点看跨赛季同名字段的定义是否仍然一致、 有没有在几次小修订中被悄悄改变了含义。巡检结果直接决定下一赛季的字段骨架怎么定。
- 交付物
- 巡检报告与下一赛季的字段调整建议
- 确认方式
- 巡检覆盖全部 32 项字段,跨赛季定义不一致的项必须给出处理结论
异常与返工
出了偏差,流程往哪里走
工序再固定,也会遇到对不上的情况。下面三类是最常出现的,每一类都有约定的判断依据和处理路径, 处理结果一律写回条目,不做无声修补。
-
A 指标缺失 处理路径
判断依据:该项指标在联赛公开公报中未发布,或在采集窗口内未能取得可靠来源。
处理路径:先标记为缺项并写明原因;若存在口径接近的替代统计,仅登记为参考值并与本站口径并列显示,不做换算、不做推算。
影响范围:通常只落在单场条目的个别字段上,不影响该场的其余指标与位次。
-
B 轮次错位 处理路径
判断依据:条目被挂到了错误的轮次或错误的赛季区间,导致该队条目顺序与赛程顺序不一致。
处理路径:由校对方发起重挂,重挂完成后重新生成受影响的对照位次;已发布的位次同步更新,并留下一条修订记录。
影响范围:涉及该轮相关球队的位次,以及引用这些位次的跨赛季对照。
-
C 口径调整 处理路径
判断依据:某项统计的定义发生变化,或同一名称在不同赛季的实际算法并不相同。
处理路径:新旧口径并行一段时间,条目同时展示两版数值并标注版本号;在赛季结束前完成取舍,统一后的结论写入下一赛季的字段骨架。
影响范围:可能覆盖多个赛季的多条记录,调整期间位次表会显示双版本。
流程之后
知道资料怎么来的,接下来看哪里
流程说明解决的是「能不能信」的问题,剩下的是「怎么看」的问题。第一次来的读者可以从上手指引开始, 已经用了一段时间的读者更适合直接翻动态中心和能力矩阵。