跳至正文
江南看台 赛事观察席 · 数据看球

方法自述 · 记录先于结论

把每个赛季记成可以复查的样子

江南看台 · 归档自 2018 赛季 · 7 个完整赛季 · 累计 6,412 场

夜间球场俯瞰全景,看台与草皮在冷调灯光下形成明暗层次,画面中没有人物
取景位置决定读法:站在看台高处往下,一场比赛才能被拆成可以逐行写下的单位。
01

观察席做的事,和解说席不一样

江南看台把自己安在看台上,而不是话筒前。这里只做两件事:把一场比赛的统计按统一口径收进归档,把字段怎么读讲清楚。凡是需要下判断的部分——谁更强、下一轮会怎样、某支队伍是否值得押注——都不在站点的产出范围内,页面里也不会出现这类结论。

每场比赛按赛季、阶段、轮次、单场四级结构落位,常规轮次与杯赛阶段分开编号,因此同一场比赛在任何入口打开时,它的位置都是唯一且可回查的。传球、控球与射门三条统计主线在同一页面里逐场对齐,读者不必在几个入口之间来回拼凑。

  • 6,412 累计归档场次
  • 7 完整赛季
  • 3 统计主线
  • 4 归档层级
02

三个阶段,从一张表走到跨赛季对照

  1. 阶段 01

    v1 → v2

    先把一场比赛记成一张查得到的表

    起步阶段解决的是一致性问题。三类字段被固定在同一张表里的固定列上,录入端不给自由填写的位置;随后表格上叠加了分档条,传球成功率与控球率不再只显示一个数字,而是落到所在区间,跨球队看的时候能立刻对上位置。

    新增视图
    分档条,按固定区间着色
    解决什么
    同一数值在不同场次可以直接比位置
  2. 阶段 02

    v3 → v4

    把一轮比赛放进同一根轴里

    表格读单场够用,读一轮就会散。轮次轴把整轮比赛沿着同一根时间线排开,同一轮里哪几场数值接近、哪几场偏差明显,一眼能扫出来。同一阶段引入每 90 分钟效率,射门与进球类字段按出场时间折算,出场差异不再直接扭曲排序结果。

    新增视图
    轮次轴与每 90 分钟换算
    解决什么
    整轮横向对比与出场时间折算
  3. 阶段 03

    v5

    把七个赛季放进同一张对照里

    跨赛季对比的前提不只是数据齐,更是口径齐。进入 v5 之后,每个赛季的字段定义、分档区间与单位被逐一比对,口径发生变化的字段会带标注,读者能区分「数值真的变了」和「尺子换了」。每个赛季结束时同步发布一份归档索引,含球队分档分布与跨赛季变化。

    新增视图
    跨赛季对比与口径标注
    解决什么
    区分数值变化与口径变化
由极细线条与等距网格构成的抽象纹理,同色阶明度差为主,没有具体图形
版本推进的坐标参考:横向是轮次,纵向是字段,网格密度对应归档颗粒度。
03

12 个人分成四类角色

  • 5

    数据录入

    按四级结构逐场落表

    单轮结束后 2 小时内完成初录,一场比赛拆到传球、控球、射门三类字段,逐项写入固定列。

  • 3

    校对与审核

    对照原始记录逐项复核

    在 24 小时内完成二次校对,处理边界值、口径歧义与字段缺项,确认后写入修订版本号。

  • 2

    产品与前端

    维护视图与读取路径

    负责分档条、轮次轴与每 90 分钟效率这几类视图的呈现,保证数值列在长表里仍然对齐。

  • 2

    内容与栏目维护

    撰写字段说明与轮次记录

    把口径变化、版本迭代与常见误读写成可检索的说明文字,并维护栏目之间的引用一致性。

数据归档工作台俯拍,桌面上有表格清单、索引卡与键盘,画面中没有可辨识人脸与具名标识
录入与复核共用同一套索引方式:先按轮次归堆,再逐场对齐字段。
04

每条字段都留了来路,也留了改路

可信度不靠声明,靠流程里能被检查的环节。下面六条是站内长期执行的固定动作,任何一条被跳过,对应场次就不会进入发布队列。

  1. 01

    双人复核

    录入完成后由第二位成员对照原始记录逐项比对,不是抽样,而是整场。出现分歧时以原始记录为准,并在该场次上留下比对痕迹。

  2. 02

    固定的时间窗

    单轮比赛结束后 2 小时内完成录入,24 小时内完成二次校对并写入修订版本。时间窗是硬约束,不因轮次密集而放宽。

  3. 03

    修订留痕

    任何字段调整都保留版本编号与修订时间,历史值不被覆盖。读者看到的永远是一个带版本号的当前值,而不是被悄悄改过的结果。

  4. 04

    口径随值一起出现

    每个字段在页面上带单位与分母说明,样本量随数值一同呈现。一个百分比脱离了样本量就不具备可比性,这一点不靠读者自己猜。

  5. 05

    分档区间固定

    分档区间的边界值在赛季内保持不变;跨赛季对比之前,先确认两个赛季的分档定义一致,不一致的地方单独标注。

  6. 06

    不产出预测

    站内不提供赛事结果预测、投注参考与球员评价。统计只描述已经发生并被记录下来的部分,不延展到尚未进行的比赛。

05

归档之外的三类协作

归档数据不是凭空长出来的。围绕采集与校验,站点长期与三类角色打交道,各自承担不同的检查职责,互不越位。

  • 4 家

    赛事数据源

    提供赛程与基础事件记录,用于交叉核对轮次编号与比赛起止顺序,避免轮次错位。

  • 3 家

    场地统计服务

    提供场地层面的采集口径,用于校对射门位置归属与禁区内外的划分边界。

  • 2 家

    高校体育统计研究小组

    以教学与研究为目的使用归档数据,并把读表歧义、分档争议反馈回来,构成外部的一层检查。

口径说明

合作仅围绕数据采集与校验展开,不涉及赛事结果、排名判定与商业推广。合作方名称不在站内公开呈现。

06

被引用之后,口径更要站得住

自 2019 赛季起,站点的归档统计连续六个赛季被省内体育媒体引用为赛事统计参考来源。被引用意味着数字会离开这个页面,出现在别的叙述里,因此引用时一并带出字段口径与样本量的做法,被固定了下来。

站点内容也入选了省内体育数据应用案例集,属于自主整理的材料,用于说明这类归档在赛事复盘与校园统计研究中的实际用法,不代表任何机构授予的资质或认证。

  • 连续引用赛季 6 自 2019 赛季起,赛季不间断
  • 归档场次 6,412 2018 赛季至 2024 赛季,7 个完整赛季
  • 模块版本 5 从 v1 表格视图到 v5 跨赛季对比

继续往下读

字段怎么读、每一轮更新了什么、发现数值对不上该找谁,分别在下面几个入口里。