口径 · 版本 · 检索

同一场比赛,两次读到的射门数为什么不一样

博尊体育赛场把一场常规比赛拆成固定字段归档,半场比分与射门统计都在其中。字段名一致,读法未必一致。这一页把字段口径、取数版本、检索方式和口径演进摊成四张对照表,最后按身份给出选择路径。

表内数字均可与档案逐条核对,结论句请以定稿字段为准。

夜色球场俯视视角,对角线与网格线在深色底上交错延伸

对照之前,先记住四个基准数字

  • 14 每场固定统计字段 从半场比分到换人次数
  • 48,600 半场比分与射门统计样本 1998 年以来收录场次
  • 15 射门统计刷新间隔 单位:分钟,比赛进行中
  • 1998 档案回溯起点 至今跨 28 个赛季

字段口径对照

同一列字段名,记的东西、由谁记、什么时候落定,并不总是相同。下表把常用字段按归档职责拆开,逐项写明边界。

字段名相同不代表读法相同,差异集中在采集来源与落定时间两列
字段 记录内容 采集来源 落定时间
半场比分 上下半场各自的进球数,以及两半场结束时的时钟刻度 现场观察员双人记录,与官方计时表核对 半场与终场哨响后 3 分钟内
射门 全场射门次数,含被封堵与击中门框的尝试 观察员逐次打点,赛后回看补录 比赛进行中每 15 分钟刷新
射正 需要门将做出扑救,或越过门线的射门 由射门明细派生,不单独采集 随射门字段同步刷新
射门转化 进球数除以射门次数,保留一位小数 由进球与射门两个字段计算得出 终场定稿,晚于射门字段
控球率与传球成功率 控球时长占比;成功传球数除以总传球数 逐回合计时与传球打点 与射门字段同节奏刷新
角球与任意球 角球总数;任意球含直接与间接两类 观察员逐次打点 与射门字段同节奏刷新
越位与犯规 被判罚的次数,不含未吹罚的疑似动作 主裁手势记录,赛后对照比赛报告 终场后定稿
黄牌与红牌 出示张数,两黄变红计为一张红牌 主裁手势记录 随比赛报告录入
补时时长 上下半场各自的补时分钟数,取第四官员举牌显示值 举牌时刻与终场哨时差 半场与终场哨响后 3 分钟内
换人次数 双方各自换人次数,含中场休息时的换人 第四官员记录 随比赛报告录入
环形刻度与柱状条组合的抽象数据图,示意统计字段的层级关系
字段分为比分类、过程类与纪律类三层,图形版本只呈现其中两层。

要在前瞻里引用某个数字,先看它是否已经落定:比赛进行中的刷新值适合描述场面,写进结论句的应当是定稿值。字段的逐条定义与所属版本号,可在数据标准与资质体系中按条款核对。

取数版本对照

底层是同一批归档数据,按三种方式取用,能拿到的粒度、响应形态与使用成本并不相同。把鼠标停在某一列上,可以纵向看清该版本的整列条件。

基础档案版、进阶图表版与开放接口版的六项能力差异
比较项 基础档案版 进阶图表版 开放接口版
回溯深度 1998 年起,28 个赛季全量 2014 年图表化之后的赛季 1998 年起,按场次单条取用
字段承载 各字段的文字与数值,不含图形 各字段另加射门分布与控球曲线 各字段原始值,不含派生图形
更新节奏 半场比分哨响后 3 分钟更新,战报在终场后 20 分钟内上线 射门统计按时序刷新,图形随之重绘 按请求返回当前值,中途不缓存
导出格式 页面浏览与打印视图 页面内图形,可整块截取 JSON 与 CSV 两种
纠错窗口 每场开放 48 小时,纠正写入版本日志 同一窗口,重绘后保留旧图对照 同一窗口,返回体携带版本号
适合谁 写前瞻与复盘、需要连续轮次的作者 需要现场讲解与图面表达的编辑 批量比对与自建可视化的研究者

如果只是查一场比赛的比分与射门数,基础档案版足够;要把差异讲给别人听,图表版的曲线更直观,但引用数值时仍需回到字段行。需要把几十场放到自己表里跑的人,走开放接口版更省事。三种版本的具体入口与更新承诺,见数据服务矩阵

同一个问题,沿赛季走和沿区域走会得到两种形状的结果。选错轴,往往会拿到一份看起来完整、实际对不上问题的样本。

口径版本演进对照

口径不是一次成型的。早期简明口径留下的一批记录仍在归档里,与当前时间轴口径放在一起比大小时,最容易出问题。

早期简明口径与当前时间轴口径的字段差异
比较项 早期简明口径 当前时间轴口径
字段规模 8 项核心字段,其余靠文字补充 14 项固定字段,逐场结构一致
半场比分记法 只记 1-0 形式的比分结果 比分与两半场结束时的时钟刻度并列
补时时长 并入比赛总时长,不单独成列 上下半场分列,已覆盖 21,400 场
控球与传球 只有控球率一项 控球率与传球成功率并列
纪律类判罚 越位与犯规合并为一项统计 越位、犯规分列,另计牌面
样本可比性 与当前口径直接比大小容易误读 需按版本号分段取样本再合并
多层线框与时间刻度叠加的抽象构图,示意统计口径的版本堆叠
早期口径的记录仍可调阅,但默认视图统一走当前口径,跨版本取数需显式指定版本号。

做长周期比较时,把版本号当成筛选条件而不是备注,是最省事的做法。规则解释与典型案例的成篇写法,收在前瞻与战报内容档案里,可配合本表阅读。

按身份选路径,以及四个常见误读

四张表看下来,选择其实归结为一句话:先确定你手里的结论要经受多严的核对。

  1. 01

    写前瞻与复盘的作者

    取基础档案版配合赛季轴检索。你需要的是连续轮次的定稿字段,图形层反而会拖慢取数速度。

  2. 02

    做批量比对的研究者

    取开放接口版配合双轴组合。JSON 与 CSV 能直接进你自己的表,返回体里的版本号顺手就成了样本边界。

  3. 03

    需要当面讲解的编辑

    取进阶图表版配合区域轴。区域轴让横向差异一眼可见,图形可整块截取,但引用数字仍要回到字段行确认。

  4. 04

    核对定义的写作者与研究者

    先查规则条款再回来用表。对照表只负责把差异摆出来,字段的最终定义不在这一页。

四个常见误读

  1. 把平滑曲线当作原始采样值。图表版的线条经过抽稀,逐场数值只存在字段行里。
  2. 把接口返回的当前值当作终场终值。比赛进行中的数字会继续变化,终场定稿才算数。
  3. 跨版本直接比较补时时长。早期口径把补时并入比赛总时长,两者不在同一测量方式上。
  4. 用单一区域的样本推断整体。六个区域分组的赛事密度与样本量并不相同。