它衡量的不是结果,而是机会的好坏。理解了这个前提,很多看似矛盾的数字就能对齐。

1、它怎么被算出来
每一次射门会依据位置、角度、身体部位、助攻方式与防守压力等因素,被赋予一个进球概率。把全场所有射门的概率相加,就是这场比赛的预期进球。它回答的是:这样的机会平均能进几个。
2、第一个用途:判断运气成分
如果一支球队连续几场实际进球明显低于预期进球,通常说明它把握机会的能力暂时不佳,而不是创造机会的能力有问题。这类偏差往往会在后续比赛中向均值回归。
3、第二个用途:暴露防守问题
防守端的预期进球失球,比单纯失球数更能说明后防是否给了对手机会。有的球队失球不多但对手预期进球长期偏高,这类队伍往往在下半程出现滑坡。

4、最常见的三种误用
其一,用它评价传球手,而它只统计射门;其二,用它评价门将,而它衡量的是来到门前的机会质量;其三,用单场数据下结论,样本量太小,噪声远大于信号。
5、它从哪里来
预期进球的思路并不神秘:把海量历史射门按位置、角度、身体部位与助攻方式分类,统计每类的进球频率,再套回当次射门。模型越新,考虑的要素越多,因此不同公司的结果差异会持续存在。
6、它不能做什么
它不评价射手个人能力差异,也不考虑比分与时间压力。因此对点球主罚者或常在比赛末段获得机会的球员,预期进球会系统性偏差。把它当参照而不是判决书,才是正确用法。
另一个容易被忽略的细节是时间分布:「第一个用途:判断运气成分」的成效通常在下半场前十几分钟最先显现,而「最常见的三种误用」往往要到最后阶段才见分晓。把这两段时间的表现放在一起比较,比笼统统计全场数据更能说明问题,也更接近教练组赛后复盘的顺序。
如果把「最常见的三种误用」单独拿出来看,它更像一面镜子:球队在没有球时的选择,往往比有球时更能说明训练质量。因为跑位可以临时提醒,而丢球后的第一反应只能靠长期训练建立,这也是为什么同一支球队在不同阶段的表现会差距明显。
把「数据看板」近几期的同类内容连起来看,会发现真正反复出现的矛盾只有两个:控制风险与制造威胁难以同时最大化。本栏目之所以坚持逐场拆解而不是只报结论,就是希望读者能把这些片段拼成一套自己的判断方法。
如果要给普通观众一个可操作的观察方法,那就从「它从哪里来」入手:先确认无球状态下的站位是否合理,再看有球时能否保持推进方向。顺序换一下,你对「预期进球到底是什么:一个数字为什么改变转会市场」这类话题的判断会稳很多,也不容易被一时的比分带走。
把「它怎么被算出来」与「第二个用途:暴露防守问题」放在一起看,会发现它们是同一件事的两个方向:前者决定球队能不能把比赛推进到危险区域,后者决定推进到位之后能不能真正形成威胁。只盯其中一项,很容易对一场比赛得出片面结论,这也是我们做同类选题时坚持两条线都写的原因。
本篇的线索可以收成四句:它怎么被算出来;第二个用途:暴露防守问题;最常见的三种误用;以及它不能做什么。四句话背后是同一个判断标准——能不能在对手针对之后仍然保持结构完整。这也是我们评价一场比赛时最常用的坐标。
写给读者
下次看到有人拿这项数据争论,先问一句:你说的是这场还是整个赛季?问完这句话,一半的口水仗就没必要打了。