返回报告库

AI / Technology

盘古气象快速、准确的三维高分辨率全球天气预报模型

从三维大气到一周预报的总览

图 1(规划):输入三维大气状态,经 3D Earth-Specific Transformer 与分层时间聚合,输出逐小时至一周预报。

  1. 大气不是一叠互不相干的地图。 模型把 13 个气压层连成三维数据体,直接学习不同高度之间的联系。
  2. 长预报不必每次只往前挪一小步。 四个模型分别跨越 1、3、6、24 小时,系统优先用大步长,减少反复调用。
  3. 快并不等于已经可靠地覆盖所有天气。 常规指标和台风路径表现突出,但极端强度仍常被低估。

二维切片与三维大气的差别

图 2(规划):左侧展示彼此分离的二维气压层,右侧展示层间相互作用的三维大气体。

早期数据驱动模型多把天气压成二维地图。这样处理方便,却弱化了不同气压层之间的联系。另一道难题是滚动误差:若一个短时模型被连续调用很多次,每一步的小偏差都会进入下一步。论文以 FourCastNet 为主要 AI 对照,指出其分辨率已经达到 0.25°,但中期预报精度仍落后于业务 IFS。来源:第 1、2.3、2.4 节;参考文献 14

三维地球专用 Transformer

图 3(规划):高空与地表变量经过分块、三维窗口注意力、地球特定位置偏置,再恢复为未来天气场。

3D Earth-Specific Transformer(3DEST)先把大网格切成较小的数据块,再通过编码器和解码器提取关系。它沿用 Swin Transformer 的局部窗口和错位窗口注意力,同时加入“地球特定位置偏置”:同样大小的地图格子在不同纬度并不对应同样的实际距离,天气模式也随纬度和高度改变。模型因此按绝对纬度与气压层学习不同关系,而不是假设所有位置都一样。来源:第 3.3 节;参考文献 40、41

四种时间步长如何接力

图 4(规划):1、3、6、24 小时模型按目标时长组合;对比固定小步滚动产生的更多迭代。

系统分别训练 1、3、6、24 小时模型。需要预测某个时点时,它用贪心策略尽量选择较长步长,从而用更少的模型调用拼出目标时长。直观地说,预测一周时优先连续走 24 小时的大步,而不是反复走 1 小时小步。论文把这称为“分层时间聚合”,目的不是增加时间分辨率,而是减少误差被一次次带入下一步。来源:第 3.4 节

证据与限制放在同一张图里

图 5(规划):左侧概括常规预报和台风路径证据,右侧列出极端强度、数据与比较口径三类限制。

论文把预报出的海平面气压、近地风、厚度和涡度交给一套规则来定位台风眼,并在 IBTrACS 的 2018 年命名热带气旋上与 ECMWF-HRES 比较。作者报告盘古气象的平均路径误差更小;个案中也更早给出 Kong-rey 和 Yutu 的正确走向。不过,模型基于 ERA5 训练,而 ERA5 本身会低估热带气旋强度,所以论文明确承认最低气压和最大风速常被低估。这里能支持的是“路径跟踪有潜力”,不是“极端天气强度已经解决”。来源:第 4.2.2 节;图 10—12

研究附录

官方源标题: Pangu-Weather: A 3D High-Resolution Model for Fast and Accurate Global Weather Forecast
作者: Kaifeng Bi、Lingxi Xie、Hengheng Zhang、Xin Chen、Xiaotao Gu、Qi Tian
论文: arXiv:2211.02556(2022 年 11 月提交)
阅读提示: 下文解释的是 arXiv 初版论文中的主张与实验,不代表今天的业务系统表现。

核心结论

盘古气象把全球大气看成一个有经度、纬度和高度的三维体,再用不同时间跨度的模型接力预测。这样既能让上下气压层互相“看见”,又能少走许多容易累积误差的小步。论文报告称,它在 ERA5 留出数据上,以 0.25° 分辨率完成逐小时、最长一周的预报,并在作者比较的变量和时效上超过业务 IFS。这个结论很有分量,但范围只覆盖论文的特定数据、指标和比较设置。来源:摘要;第 3.3、3.4、4.1 节

记住这三点

  1. 大气不是一叠互不相干的地图。 模型把 13 个气压层连成三维数据体,直接学习不同高度之间的联系。
  2. 长预报不必每次只往前挪一小步。 四个模型分别跨越 1、3、6、24 小时,系统优先用大步长,减少反复调用。
  3. 快并不等于已经可靠地覆盖所有天气。 常规指标和台风路径表现突出,但极端强度仍常被低估。

问题

数值预报准确,但算得重

传统数值天气预报从当前大气状态出发,用物理方程逐步模拟未来。网格越细、集合成员越多,计算量越大。论文把业务 IFS 视为当时的强基线:它准确,但高分辨率全球预报需要昂贵的超级计算资源,更新频率和集合规模也受到限制。来源:第 1、2.2 节

早期 AI 预报快,却漏掉“高度”和“长距离”

早期数据驱动模型多把天气压成二维地图。这样处理方便,却弱化了不同气压层之间的联系。另一道难题是滚动误差:若一个短时模型被连续调用很多次,每一步的小偏差都会进入下一步。论文以 FourCastNet 为主要 AI 对照,指出其分辨率已经达到 0.25°,但中期预报精度仍落后于业务 IFS。来源:第 1、2.3、2.4 节;参考文献 14

方法

先把全球天气装进三维数据体

输入来自 ERA5 小时级再分析数据。模型使用 13 个气压层上的 5 类高空变量——位势、比湿、温度以及水平风的两个分量;地表还包括 2 米温度、10 米风的两个分量和海平面气压。地形、海陆和土壤类型作为固定信息加入。训练使用 1979—2017 年数据,2019 年用于验证,2018、2020、2021 年用于测试。来源:第 3.2 节

再让模型理解地球不是平面

3D Earth-Specific Transformer(3DEST)先把大网格切成较小的数据块,再通过编码器和解码器提取关系。它沿用 Swin Transformer 的局部窗口和错位窗口注意力,同时加入“地球特定位置偏置”:同样大小的地图格子在不同纬度并不对应同样的实际距离,天气模式也随纬度和高度改变。模型因此按绝对纬度与气压层学习不同关系,而不是假设所有位置都一样。来源:第 3.3 节;参考文献 40、41

最后用四种步长接力

系统分别训练 1、3、6、24 小时模型。需要预测某个时点时,它用贪心策略尽量选择较长步长,从而用更少的模型调用拼出目标时长。直观地说,预测一周时优先连续走 24 小时的大步,而不是反复走 1 小时小步。论文把这称为“分层时间聚合”,目的不是增加时间分辨率,而是减少误差被一次次带入下一步。来源:第 3.4 节

证据与局限

常规预报:广覆盖的胜出比单个漂亮数字更重要

作者以 2018 年为主要比较年份,用纬度加权 RMSE(越低越好)和 ACC(越高越好)评估最长一周的确定性预报。论文报告,盘古气象在所比较的高空和地表变量、各个预报时效上均优于业务 IFS,并且相对优势通常随预报时长增加。它还支持 0.25° 全球网格和逐小时输出;整套网络约 2.56 亿参数。来源:摘要;第 4.1.1、4.1.2 节

台风路径:能找眼,不等于能报准强度

论文把预报出的海平面气压、近地风、厚度和涡度交给一套规则来定位台风眼,并在 IBTrACS 的 2018 年命名热带气旋上与 ECMWF-HRES 比较。作者报告盘古气象的平均路径误差更小;个案中也更早给出 Kong-rey 和 Yutu 的正确走向。不过,模型基于 ERA5 训练,而 ERA5 本身会低估热带气旋强度,所以论文明确承认最低气压和最大风速常被低估。这里能支持的是“路径跟踪有潜力”,不是“极端天气强度已经解决”。来源:第 4.2.2 节;图 10—12

读结果时必须带上的三个限制

  • 基准不是纯观测真值。 ERA5 是观测与数值模型经数据同化形成的再分析资料;它是高质量基准,但并非无偏的真实大气。
  • 部分对照数据不完整。 论文因 ECMWF 服务器与下载问题缺少部分月份或变量;一些 IFS、FourCastNet 数字来自 WeatherBench 报告值或论文图表提取,因此比较存在口径和读图误差。
  • 训练和消融都受算力限制。 作者称四个模型训练到 100 个 epoch 时仍未完全收敛,也没有穷举网络配置;更深网络、更多输入时刻以及完整 4D 建模仍是设想,而非本论文已验证结果。来源:第 3.3、3.4、4 节脚注与第 5 节

实际意义

它把 AI 天气预报从“快速替身”推向可竞争方案

这篇论文最重要的意义,不是某一条误差曲线,而是把三件事放在同一个系统里:全球 0.25° 网格、最长一周的多变量预报,以及很快的神经网络推理。对实际工作而言,快速推理可以让团队更频繁地更新结果,也更容易运行大量集合成员来观察不确定性。论文的集合实验只是初步尝试,不能直接等同于成熟的概率预报系统。来源:第 4.1.5、4.3 节

更现实的定位是补充,而不是无条件替代

论文证明了一个清晰方向:把大气的空间结构和预报时长写进模型设计,能显著提高数据驱动天气预报。但业务部署还要检验实时观测输入、分布变化、极端事件校准、物理一致性和故障兜底。因而更稳妥的落地方式,是先把它作为传统数值预报旁边的高速候选和集合成员,再用独立年份、地区与灾害类型持续验证。这一段是基于论文证据的实践解读,不是作者已经完成的部署结论。

研究脉络与核查入口

  • 直接前序方法: FourCastNet 提供了 0.25° 全球 AI 预报、递归预测和集合实验的重要对照;盘古气象改用三维结构和多步长模型来处理其暴露出的精度与累积误差问题。参考文献 14;第 1、2.4、3.4、4.3 节
  • 架构来源: 3DEST 采用 Vision Transformer/Swin Transformer 的图像分块、窗口注意力、错位窗口和编码器—解码器思路,再针对经纬度与气压层改造位置偏置。参考文献 40、41;第 3.3 节
  • 数据与评测脉络: WeatherBench 为数据驱动全球天气预报提供基准与低分辨率对照;本文沿用 ERA5 和相关评测方式,同时把分辨率提高到 0.25°。参考文献 10;第 3.2、4.1.2 节

还值得追问什么?

  1. 在完全一致的初始条件、后处理和测试时段下,它与业务数值预报的差距还剩多少?
  2. 对训练集中罕见或从未出现的极端事件,路径和强度误差会怎样变化?
  3. 加入多时刻输入、物理约束或更高分辨率数据后,收益是否足以覆盖训练成本?
  4. 大规模集合预报如何校准概率,而不只是降低平均 RMSE?

关于这篇论文的三个关键问题

盘古气象:快速、准确的三维高分辨率全球天气预报模型 解决了什么问题?

传统数值天气预报从当前大气状态出发,用物理方程逐步模拟未来。网格越细、集合成员越多,计算量越大。论文把业务 IFS 视为当时的强基线:它准确,但高分辨率全球预报需要昂贵的超级计算资源,更新频率和集合规模也受到限制。来源:第 1、2.2 节

盘古气象:快速、准确的三维高分辨率全球天气预报模型 的核心结论有哪些证据?

作者以 2018 年为主要比较年份,用纬度加权 RMSE(越低越好)和 ACC(越高越好)评估最长一周的确定性预报。论文报告,盘古气象在所比较的高空和地表变量、各个预报时效上均优于业务 IFS,并且相对优势通常随预报时长增加。它还支持 0.25° 全球网格和逐小时输出;整套网络约 2.56 亿参数。来源:摘要;第 4.1.1、4.1.2 节

阅读 盘古气象:快速、准确的三维高分辨率全球天气预报模型 时最需要注意什么局限?

图 5(规划):左侧概括常规预报和台风路径证据,右侧列出极端强度、数据与比较口径三类限制。

今天还可免费读 2 篇新报告订阅 Pro 后无限阅读,并获得每月 10 篇新论文生成额度。升级 Pro