KAIYUN 体育 数据指挥台

口径 90 分钟 + 补时 · 比赛日每 15 秒刷新

按 / 或 ⌘K 唤起索引

数据准则 · 站点自述

12 项指标的定义边界与复核方式

开云体育官方主站只登记 12 项指标,并把这些指标的口径、纳入条件与排除情形写在同一个页面里。你在这里能看到数字从哪来、由谁校对、出错之后按什么顺序改。

本页同时作为站内其他栏目引用数字时的口径出处。若你在别处看到与本页不一致的统计,先核对版本号与批次,再通过客服邮箱提交纠错。

档案起点
2019
登记指标
12
编辑与数据团队
26
数据面板版本
v3.7

01 / 沿革

从号码档案到 v3.7 面板

  1. 2019 先建档案,再做面板 展开 收起

    站点在第一年没有铺开指标数量,而是以球衣号码作为最小记录单位建档,同时上线数据面板 v1。入选 v1 的指标都满足一个条件:当时的采集手段能稳定拿到原始记录,也能被别人复核。

  2. 2021 字段拆分与历史对齐 展开 收起

    面板进入 v2,主客场与定位球两类统计被拆成独立字段,覆盖范围扩展到 38 个联赛与杯赛。这一阶段的主要工作量不在新增,而在把早期条目重新对齐到同一套字段命名上。

  3. 2023 复核岗独立成编制 展开 收起

    6 个复核岗从采编工作中分离出来,机器抓取、双人复核、抽样回溯三步固定成文;更正条目开始标注更正类型与影响范围,便于引用者判断哪些结论被改动过。

  4. v3.1–v3.7 号码索引与补时时长交叉检索 展开 收起

    自 2019 年起累计的 6.4 万条球衣号码记录,现在可以和补时时长放在一起检索。最近几次版本迭代集中在检索响应速度与字段命名的统一,没有增加新的指标数量。

02 / 取舍

为什么不做更多指标

指标越多,口径越容易在细节上分叉。同一场比赛里,一家记“射正”,另一家记“射门被门将触及”,两个数字都能自洽,但放在一起比较就会失真。我们选择把 12 项指标长期追踪,让每一年的数据能和前一年对齐。

这个取舍有代价:一些看起来热闹的字段不会出现在面板里,能覆盖的场景比综合型数据站窄。换来的是每条记录都能回溯到纳入口径,出现分歧时也有统一的裁定依据。

指标数量固定,边界就要写得足够细。下一节的表格逐项列出统计范围与不计入的情形,这也是站内其他栏目引用数字时直接对照的那份底稿。

米白色号码索引卡片分层叠放的俯拍,卡片边缘有轻微磨损
档案以卡片编号与电子条目一一对应,更正后保留原编号不覆盖。

03 / 定义表

12 项指标的统计范围与排除情形

夜色球场边线与角旗的特写,画面上方留出大块暗部
主场地图以球场分区坐标记录,不包含观众数量与任何个人身份信息。
指标以赛季为单位维护,口径版本为 v3.7;同一指标跨赛季比较前请确认版本号一致。
序号 指标 类别 统计范围 不计入的情形
01 射手榜 进攻 按球员号码归档的全部进球,跨场次累计 点球大战中的罚球不计入
02 助攻分布 进攻 最后一次传球后直接得分的传递,按区域归类 造成乌龙球的传球不计入
03 主场地图 档案 以球场分区坐标记录场地与看台区域 不含观众数据与任何个人身份信息
04 定位球效率 进攻 角球、任意球与界外球形成的射门及转化 快发后未形成射门的进攻不计入
05 角球数 进攻 按比赛与批次逐日累计的角球次数 因越位或犯规提前终止的角球不计入
06 控球区间 时间 以 15 分钟为一段的控球时间占比 补时段单独成段,不并入第 90 分钟段
07 射门质量 进攻 结合射门位置与防守密度给出的分级标签 被封堵的射门仍计一次,但作降级处理
08 扑救分布 防守 门将扑救的方向与区域分布 击中门框后弹出的球不计入扑救
09 跑动热区 防守 按区域统计的全队跑动累积 不含赛前热身与赛后加练数据
10 换人影响 时间 换人前后各一段时间内的攻防数据变化 不追溯赛前名单变更与临时伤退
11 伤停补时时长 时间 只统计计入比赛时间的补时,单位到分钟 中场休息与场外处理时间不计入
12 球衣号码索引 档案 按号码归档的球员条目,可交叉检索 号码变更按变更前后分别建条目

04 / 校验

一条记录要过三道关

暗光房间内多屏数据界面的背影剪影,屏幕冷光映在墙面
比赛日的复核在夜间进行,屏幕亮度统一调低以保持长时间比对时的辨识度。

第一道

机器抓取

采集程序从计时与事件记录中提取原始条目,写入待复核队列。抓取只负责搬运事实,不做判断,也不覆盖已有条目。

比赛日每 15 秒同步一次

第二道

双人复核

两名复核岗各自比对一遍队列中的条目,结论一致才放行;出现差异的条目不直接改写,而是转入待裁定队列等待三方核对。

比赛结束后 5 分钟内完成归档核对

第三道

抽样回溯

按批次抽检已放行条目,回到原始时间点重新比对。回溯不追求覆盖面,而是检查同一类错误是否重复出现,重复出现就调整字段定义。

按批次抽检,非比赛日集中执行
  1. 01 收到纠错邮件并登记工单
  2. 02 定位条目与所属批次、版本
  3. 03 双人复核原始记录
  4. 04 更正并标注影响范围
  5. 05 回复提交者,工单闭环

年度纠错工单约 1,900 条,平均 22 小时闭环。更正不会删除原条目,而是在条目中标注更正类型与影响范围。

05 / 分工

团队构成与复核节奏

26

编辑与数据团队总人数,其中复核岗 6 人,独立于采编环节,不参与条目产出。

团队按职能分为四类:采编负责比赛日的同步与终场归档,口径维护负责定义文档与字段命名,复核岗负责比对与差异裁定,档案整理负责号码索引与历史条目对齐。同一个人可以跨职能,但复核结论必须由复核岗出具。

比赛日采用轮班制,覆盖全天赛程:一班盯实时同步与临场校正,另一班负责归档核对。非比赛日处理纠错工单、抽样回溯与历史条目对齐,这段时间的工作量通常高于比赛日的信息搬运。

采编
同步与归档
口径维护
定义与字段命名
复核
比对与差异裁定
档案整理
索引与历史对齐

06 / 术语与节奏

几个会被反复问到的词

引用站内数字时,最常被追问的是补时时长只统计计入比赛时间的补时分钟数,中场休息与场外处理不计入;单条记录精确到分钟。的算法边界。需要说明的是,这里的时长不是某一机构公布的补时牌数字,而是按本站纳入口径整理的比赛时间数据。

另一个高频问题是版本。数据面板的口径版本从 2019 年的 v1 起算,当前为 v3.7;口径调整时版本号递增,旧条目保留原版本标记。引用时应同时给出批次编号内容笔记与测试版转会动态按比赛日批次归档,同一天可能出现两个批次。和版本号,否则两处数字不一致时无法判断谁先谁后。

当实时数据固化为可引用的条目后,这个动作称为归档终场后把实时数据固化为条目,归档完成后数字不再随刷新变动,可按批次复核。。归档之前,同一场比赛每隔数秒就可能出现不同的中间值,这是正常的。

最后是校验。所有条目都要经过三级校验机器抓取、双人复核、抽样回溯三步依次执行,任一步发现问题即回退到前一步。,任一环节发现疑点都会回退,不会带着疑问放行。

07 / 合规信息

站点指定服务地区为黑龙江,界面与内容语言为 zh-CN。下列信息为站点公布的联系渠道与备案信息,可在此页与页脚两处对照查看。

邮箱为站点客服邮箱,工作日 9:00–18:00(北京时间)内回复。如需合作或提交数据纠错,请在邮件标题注明“KAIYUN数据合作/纠错”,正文写清条目编号、批次与版本号。

08 / 纠错与合作

发现口径差异之后

如果你在两个栏目看到不同的数字,先记录该条目所属的批次编号与版本号,再说明你认为正确的取值和依据。信息越具体,工单越容易在第一次回复时就定位到问题条目。

数据合作、内容引用授权与来源标注方式,统一走商务合作通道;口径本身的疑问可以先在常见问答里找对应条目。

09 / 延伸阅读

接着看哪一页