每一轮都单独留档
出场时间、首发变化、换人时刻,全都挂在产生它的那一轮下面。你看到的赛季合计,可以一轮一轮翻回去看它是怎么攒起来的。
2018 年至今 · 赛季数据记录
乐竞赛事从 2018 年的一支现场记录小组起步,如今把 26 个联赛从揭幕战到收官战的每一轮都留了下来。你拿到的每一个出场时间、每一次换人、每一段补时,都能回到产生它的那一场比赛。
起点
最早的那批记录只有几场固定关注的比赛。谁首发、踢了多久、什么时候被换下,三条信息写在纸面上,赛后手工整理进一张表。字段结构从那时起就没怎么变过,变的是它后面跟着的联赛数量和赛季跨度。
今天同样的三条信息,覆盖到 26 个联赛的每一个轮次。9 个赛季跑下来,累计沉淀了 5,200 轮赛后复盘,每一轮都保留着原始记录。你要查一个球员某个赛季的总出场时间,可以一路拆到具体是哪一轮、哪一分钟。
轮次记录 · 原始稿
发展节点
每一次升级都对应一个具体的问题:字段太散、补时没人单独统计、转会信息跟不上窗口期。下面这些节点,就是这些问题被解决的时间。
坐标网格 · 数据标注层
先把记录方式固定下来:上场名单、出场时长、换人时刻三条信息,从这一年起逐轮留存。不依赖临场记忆,也不在赛后凭印象补写。
散在表格里的记录变成了一张可以翻阅的卡片,一轮一页。字段顺序不再随整理的人变化,媒体编辑拿到手就能直接引用。
把每轮的补时时长单独拆出来,按轮次和联赛两个方向并排看,也能跨赛季拉出同一条曲线。26 个联赛全部覆盖。
球员流向与合同年限开始按窗口期记录,库内已收录 1,860 名球员。同一时间开放接口,日均调用约 38 万次,产品团队可以把数据直接接进自己的看板。
同一支球队、同一个字段,可以拉到不同赛季并排比较。想看清楚一支队伍三年里的首发轮换是怎么变的,一屏就能读完。
赛前 · 记录准备
团队分工
38 个人分成四个小组,各管一段。采集组负责把现场变成字段,复核与字段组负责判断记得对不对、该记在哪一栏,产品与技术组负责让你查得到,内容与运营组负责把数字讲成人话。
四个组之间没有交接单,但有一条硬规则:任何一条记录进入公开数据之前,必须经过采集组之外的人看过一遍。
逐轮抓取现场记录,把上场名单、出场时长、球衣号码和换人时刻填进固定字段。26 个联赛的轮次由这个组按赛程排班覆盖。
现场 · 逐轮填写对采集结果做二次确认,处理新出现的情况该归到哪一栏。新字段加入之前,先定下名字和取值方式,再回头把历史轮次补齐。
二次确认 · 字段命名把字段变成你能用的东西:按日期、轮次、主客场筛选的赛程视图,跨赛季对比,CSV 与 JSON 导出,以及每天约 38 万次调用的开放接口。
筛选 · 导出 · 接口品牌专栏每周更新 3 至 5 篇,分赛程观察、复盘笔记、转会窗口三个系列。同时负责与媒体平台、俱乐部分析人员的日常对接。
专栏 · 对接记录方式
判断一份赛事数据好不好用,看的不是它给了多少总数,而是总数能不能一路拆到某一轮。我们把这件事拆成三个环节来做。
出场时间、首发变化、换人时刻,全都挂在产生它的那一轮下面。你看到的赛季合计,可以一轮一轮翻回去看它是怎么攒起来的。
出场时间就叫出场时间,不会一会儿写成上场时长,一会儿写成登场分钟。字段名一旦定下就不再改,新字段进来也照这个规矩办。
每轮记录公开之后,都会由采集组之外的人再看一遍。发现偏差就改,改完的内容会同步到引用它的地方,不留旧版本在外面跑。
常用字段,点开看具体记什么
球员从登场到离场的净比赛时间,含补时阶段,不含中场休息。替补登场按实际登场时刻计算。
本轮首发名单相对上一轮的变化数量,包含位置调整与人员替换。赛季首次出场按满额变化计。
该轮次登记的号码。号码变更在下一个轮次生效,历史轮次保留当时的号码,不回溯改写。
上下半场各自公布的补时分钟数之和。支持按轮次与按联赛两个方向查看,也可以拉出跨赛季曲线。
换人发生的比赛分钟数,含补时阶段发生的调整。同一轮多次换人按时间先后逐条记录。
服务区域
团队落在贵州,服务范围早就跑出了省界。目前有 24 个省份的体育媒体编辑、俱乐部分析人员、球迷社群和数据研究者在持续使用这些数据。
合作形态主要有两种。一种是数据互通:与 6 家数据服务机构互相校对同一批轮次,发现差异当天就能对上。另一种是内容合作:与 11 家媒体内容平台长期共用赛程信息,对方在稿件里引用我们的复盘记录。
对俱乐部分析人员,我们提供按赛季打包的字段明细;对球迷社群和内容创作者,赛程与复盘按轮次开放查阅;对产品团队,接口能直接接进现有看板。