Skip to content

Nowcast3D: Reliable precipitation nowcasting via gray-box learning

Status: completed

Authors: Huaguan Chen, Wei Han, Haofei Sun, Ning Lin, Xingtao Song, Yunfan Yang, Jie Tian, Yang Liu, Ji-Rong Wen, Xiaoye Zhang, Xueshun Shen, Hao Sun

Venue / Year: arXiv preprint, 2025;本文核验版本为 v4(2026-01-25)

Affiliations: Renmin University of China;China Meteorological Administration 及其 Earth System Modeling and Prediction Center、State Key Laboratory of Severe Weather、Shanghai Typhoon Institute、Chinese Academy of Meteorological Sciences;Nanjing University of Information Science and Technology;Chinese Academy of Sciences;University of Chinese Academy of Sciences;Henan University

Version checked: arXiv:2511.04659v4;截至 2026-08-23 未检出正式会议或期刊版本

Links: arXiv · PDF v4 · HTML v4 · Code · DOI

Tags: [[precipitation-nowcasting]] [[3D-weather-radar]] [[gray-box-learning]] [[diffusion-model]] [[physics-informed-ML]] [[uncertainty-quantification]]

版本说明:arXiv 历史为 v1(2025-11-06)、v2(2025-11-10)、v3(2025-12-22)、v4(2026-01-25)。以下结论以最新 v4 的 TeX 源文、主图和 Extended Data 图为准;论文多次引用的 Supplementary Notes、Supplementary Figures 与视频不在 v4 e-print 包中,无法据此独立核验。

One-Sentence Summary

Nowcast3D 的真实技术定位是:以原生三维雷达体为状态,学习一个平流—各向异性扩散—源项的灰箱时间推进器,再用二维条件扩散分别精化结构与强度残差;它把三维物理表征、三小时临近预报和概率集合组织得很有吸引力,但尚不能据现有证据称为严格守恒、端到端联合三维概率生成或可唯一恢复真实大气风场的模型。

1. 问题、动机与核心主张

1.1 问题定义

对三维雷达反射率体

RtRD×H×W, \mathbf R_t \in \mathbb R^{D\times H\times W},

给定历史序列

RT0:0={RT0,,R0}, \mathbf R_{-T_0:0} = \left\{ \mathbf R_{-T_0},\ldots,\mathbf R_0 \right\},

预测未来

R1:T={R1,,RT}. \mathbf R_{1:T} = \left\{ \mathbf R_1,\ldots,\mathbf R_T \right\}.

论文主文只以 T0,TT_0,T 表示帧数。当前公开演示配置采用 10 个历史体和 30 个未来体;结合每步 6 min,可推得演示任务为过去 60 min 预测未来 180 min。这个数值来自公开仓库,不能误写成 v4 主文明确报告的统一训练配置。

1.2 为什么三维很重要

传统雷达临近预报往往把体扫压成柱状最大反射率二维图。这样虽然方便,但会丢掉:

  1. 对流单体的垂直发展、倾斜和高度依赖运动;
  2. 不同高度层的生成、消散与相变信号;
  3. 从回波运动反演三维 hydrometeor motion 的可能性;
  4. 高层结构对低层后续发展的先验信息。

Nowcast3D 的动机不是简单把 2D 卷积替换为 3D 卷积,而是把三维雷达作为动力状态,并显式分配三个演化机制:运动、随机扩散、强度源项。

1.3 论文的主要 claims

  • 原生三维雷达输入比二维柱状最大值更能保持对流结构。
  • 可学习平流、各向异性布朗扩散和微物理源项构成可解释的确定性核心。
  • 无风场标签也能从反射率演化中恢复有物理意义的三维速度场。
  • 结构与强度残差双分支条件扩散能形成更可靠的概率集合。
  • 在华南训练、华北跨区域测试以及茂名 0.01° 独立年份测试中,模型优于 pySTEPS、SimVP、NowcastNet。
  • 160 名业务气象专家在事前和事后判断中更偏好 Nowcast3D。

这些 claims 中,模型结构和案例图的证据较直接;“可靠”“校准”“物理一致”“泛化”等强结论则缺少统计区间、完整样本数、严格对照和全量可复现实验支持。

2. 数据、划分与预处理

2.1 数据域

论文使用中国气象局三维雷达拼图,共 24 个 constant-altitude levels,高度覆盖 0.5–16 km,原生水平分辨率最低 0.01°。

用途时间经纬度范围分辨率与 patch说明
华南训练2024110.00–120.24°E, 23.96–34.20°N0.04°, 256×256256\times256, 10.24×10.2410.24^\circ\times10.24^\circ论文称使用所有 eligible radar volumes
华北测试2025110.00–120.24°E, 33.96–44.20°N0.04°, 256×256256\times256与训练域在空间和年份上不重叠
茂名微调2024109.64–112.20°E, 20.39–22.95°N0.01°, 256×256256\times256, 2.56×2.562.56^\circ\times2.56^\circ城市尺度微调
茂名测试2025同上0.01°, 256×256256\times256独立年份事件

2.2 缺测处理

数据预处理包括:

  1. 构建缺测 mask;
  2. 只在缺测区域利用高层反射率进行非学习式填补;
  3. 对动态范围进行归一化;
  4. 训练和评估时保留有效区 mask。

但填补公式、阈值和缺测统计被放在缺失的 Supplementary Notes 1.2–1.4 中。主文也没有报告训练、验证、测试的窗口数、事件数、滑窗步长、缺测比例及事件级隔离规则。因此“跨区域、跨年份”这个大方向成立,而数据泄漏和样本代表性仍无法被第三方完整审计。

2.3 灾害背景事实核验

  • 2024 年梅州暴雨“超过 16 万人受影响”有新华社直接支持;论文的“55 人死亡或失踪”可由同期平远、蕉岭、梅县的县区通报在不同时间点合计重建,并非同一时刻的一张统一统计表。
  • 2025 年北京暴雨“30 人死亡”可由新华社和北京市政府通报核实,但严格表述应加上“截至 2025-07-28 24:00”,不能默认是最终统计。

这些事实支持研究动机的重要性,却不构成模型性能证据。

3. 方法总览

3.1 完整数据流

RT0:0ΘbackboneFthree decoders(φ,ψ,κ,s)gray\mboxbox solverR1:Tdetdual conditional diffusionE1:T. \mathbf R_{-T_0:0} \xrightarrow{\Theta_{\mathrm{backbone}}} \mathbf F \xrightarrow{\mathrm{three\ decoders}} \left( \boldsymbol\varphi, \boldsymbol\psi, \boldsymbol\kappa, \mathbf s \right) \xrightarrow{\mathrm{gray\mbox{-}box\ solver}} \mathbf R_{1:T}^{\mathrm{det}} \xrightarrow{\mathrm{dual\ conditional\ diffusion}} \mathcal E_{1:T}.

其中 backbone 是带时空嵌入的 3D U-Net 与 Transformer 混合编码器;三个 decoder 分别负责运动势、各向异性布朗扩散和强度源项。确定性核心滚动推进未来三维反射率,Diff-Gen 再产生结构样本和残差样本。

3.2 三个解码分支

论文把主干特征映射为

(φ,ψ)=DecoderMotion(Backbone(RT0:0)), \left( \boldsymbol\varphi, \boldsymbol\psi \right) = \mathrm{Decoder}_{\mathrm{Motion}} \left( \mathrm{Backbone} \left( \mathbf R_{-T_0:0} \right) \right),
κ=DecoderAnisoBrown(Backbone(RT0:0)), \boldsymbol\kappa = \mathrm{Decoder}_{\mathrm{AnisoBrown}} \left( \mathrm{Backbone} \left( \mathbf R_{-T_0:0} \right) \right),
s=DecoderIntensity(Backbone(RT0:0)). \mathbf s = \mathrm{Decoder}_{\mathrm{Intensity}} \left( \mathrm{Backbone} \left( \mathbf R_{-T_0:0} \right) \right).
  • φ\boldsymbol\varphi:标量势函数;
  • ψ\boldsymbol\psi:向量势函数;
  • κ\boldsymbol\kappa:论文记为局地各向异性扩散张量;
  • s\mathbf s:回波生成、增强、衰减、消散等未解析微物理过程的净源项。

架构层面的重要优点是强 inductive bias:网络不直接吐出任意下一帧,而要通过可解释的推进算子产生结果。代价是这些中间量未必可识别,后文会详细讨论。

4. 数学细节:物理核心

4.1 连续方程

论文从反射率演化方程出发:

Rt=vR+(κR)+s. \frac{\partial \mathbf R}{\partial t} = -\mathbf v\cdot\nabla\mathbf R +\nabla\cdot \left( \boldsymbol\kappa\nabla\mathbf R \right) +\mathbf s.

三项依次是:

  1. 非守恒形式的平流 vR-\mathbf v\cdot\nabla\mathbf R
  2. 位置依赖、可能各向异性的扩散 (κR)\nabla\cdot(\boldsymbol\kappa\nabla\mathbf R)
  3. 净源项 s\mathbf s

要注意,R\mathbf R 是雷达反射率表征,不是严格守恒的质量密度,所以使用源项有物理动机;但这也意味着“physics-conserving”不应被自动推出。

4.2 Helmholtz 速度参数化

速度通过势函数分解为

v=φ+×ψ. \mathbf v = \nabla\boldsymbol\varphi +\nabla\times\boldsymbol\psi.

梯度部分可有散度,旋度部分无散度:

(×ψ)=0, \nabla\cdot \left( \nabla\times\boldsymbol\psi \right) =0,
×(φ)=0. \nabla\times \left( \nabla\boldsymbol\varphi \right) =0.

这是有意义的参数化,但论文没有给出边界条件、势函数的 gauge 约束或 Helmholtz 分解唯一性条件。更关键的是,只观察一个标量场 R\mathbf R 的时间变化,通常不足以唯一恢复三维 v\mathbf vκ\boldsymbol\kappas\mathbf s

4.3 半拉格朗日平流

论文定义

AΔt[Rt](x)=Rt(xvt(x)Δt). \mathcal A_{\Delta t} \left[ \mathbf R_t \right] \left( \mathbf x \right) = \mathbf R_t \left( \mathbf x -\mathbf v_t \left( \mathbf x \right) \Delta t \right).

它沿预测速度反向追踪 departure point,再通过插值读取上一时刻反射率。半拉格朗日方法允许较大时间步且数值稳定,但它一般不保证质量守恒;边界外采样和插值方式也会实质影响结果,论文主文没有说明。

4.4 布朗扩散

论文把扩散写成局地高斯扰动的期望:

DΔt[Rt](x)=EηN(0,2κtΔt)[Rt(x+η)]. \mathcal D_{\Delta t} \left[ \mathbf R_t \right] \left( \mathbf x \right) = \mathbb E_{\boldsymbol\eta\sim \mathcal N \left( \mathbf 0, 2\boldsymbol\kappa_t\Delta t \right)} \left[ \mathbf R_t \left( \mathbf x+\boldsymbol\eta \right) \right].

数值上用 MM 个 Monte Carlo 样本:

Rt+1(x)1Mm=1MRt(xvt(x)Δt+ηt(m)(x))+st(x)Δt, \mathbf R_{t+1} \left( \mathbf x \right) \approx \frac{1}{M} \sum_{m=1}^{M} \mathbf R_t \left( \mathbf x -\mathbf v_t \left( \mathbf x \right) \Delta t +\boldsymbol\eta_t^{(m)} \left( \mathbf x \right) \right) +\mathbf s_t \left( \mathbf x \right) \Delta t,

其中

ηt(m)N(0,2κtΔt),M=8. \boldsymbol\eta_t^{(m)} \sim \mathcal N \left( \mathbf 0, 2\boldsymbol\kappa_t\Delta t \right), \qquad M=8.

该式把平流、扩散和源项压成一次可微推进。它直观、易和神经网络连接,但“与原 PDE 等价”需要额外条件。

4.5 PDE 与随机算子的关键差距

κ\boldsymbol\kappa 随空间变化,对局地高斯期望作小时间展开,主要得到

E[R(x+η)]=R(x)+Δti,jκijijR+O(Δt3/2). \mathbb E \left[ \mathbf R \left( \mathbf x+\boldsymbol\eta \right) \right] = \mathbf R \left( \mathbf x \right) +\Delta t \sum_{i,j} \kappa_{ij} \partial_{ij}\mathbf R +\mathcal O \left( \Delta t^{3/2} \right).

而论文 PDE 中的散度形式为

(κR)=i,jκijijR+i,j(iκij)jR. \nabla\cdot \left( \boldsymbol\kappa\nabla\mathbf R \right) = \sum_{i,j} \kappa_{ij}\partial_{ij}\mathbf R +\sum_{i,j} \left( \partial_i\kappa_{ij} \right) \partial_j\mathbf R.

局地零均值高斯扰动缺少第二项

i,j(iκij)jR. \sum_{i,j} \left( \partial_i\kappa_{ij} \right) \partial_j\mathbf R.

因此,只有当 κ\boldsymbol\kappa 在局部近似常数,或随机过程加入相应 drift correction 时,两者才可近似一致。论文没有陈述这个条件。

此外,一个合法协方差要求

κ=κ,aκa0for all a. \boldsymbol\kappa = \boldsymbol\kappa^\top, \qquad \mathbf a^\top\boldsymbol\kappa\mathbf a \geq 0 \quad \mathrm{for\ all}\ \mathbf a.

主文没有说明如何保证对称半正定。当前公开代码只输出三个轴向尺度,更接近对角扩散,而不是一般的 full anisotropic tensor。

4.6 算子分裂误差

若严格先做平流再做扩散,则

DΔt[AΔt[Rt]](x)=Eη[Rt(x+ηvt(x+η)Δt)]. \mathcal D_{\Delta t} \left[ \mathcal A_{\Delta t} \left[ \mathbf R_t \right] \right] \left( \mathbf x \right) = \mathbb E_{\boldsymbol\eta} \left[ \mathbf R_t \left( \mathbf x+\boldsymbol\eta -\mathbf v_t \left( \mathbf x+\boldsymbol\eta \right) \Delta t \right) \right].

论文最终 Monte Carlo 式使用的是

vt(x) \mathbf v_t \left( \mathbf x \right)

而不是

vt(x+η). \mathbf v_t \left( \mathbf x+\boldsymbol\eta \right).

这相当于冻结局地速度,是额外的一阶近似。论文没有量化这一误差,也没有比较不同 operator splitting 顺序。

4.7 守恒与可识别性

平流项是

vR, -\mathbf v\cdot\nabla\mathbf R,

而守恒输运通常写作

(vR)=vRRv. -\nabla\cdot \left( \mathbf v\mathbf R \right) = -\mathbf v\cdot\nabla\mathbf R -\mathbf R\nabla\cdot\mathbf v.

由于

v=Δφ \nabla\cdot\mathbf v = \Delta\boldsymbol\varphi

一般不为零,论文形式并不守恒。与此同时,对于任意候选 v\mathbf vκ\boldsymbol\kappa,源项都可写成

s=Rt+vR(κR). \mathbf s = \frac{\partial\mathbf R}{\partial t} +\mathbf v\cdot\nabla\mathbf R -\nabla\cdot \left( \boldsymbol\kappa\nabla\mathbf R \right).

这说明仅靠重建损失时,s\mathbf s 能吸收运动或扩散的误差,三个机制不具结构可识别性。模型输出的“风场”更稳妥地称为对预测有用的 hydrometeor motion proxy,而非被唯一恢复的真实大气风。

5. 训练目标与概率扩散

5.1 物理核心的分阶段监督

论文对平流后、平流加扩散后、完整预测后的结果都使用 L1 监督。记

R^t+1adv=AΔt[Rt], \widehat{\mathbf R}_{t+1}^{\mathrm{adv}} = \mathcal A_{\Delta t} \left[ \mathbf R_t \right],
R^t+1diff=DΔt[R^t+1adv], \widehat{\mathbf R}_{t+1}^{\mathrm{diff}} = \mathcal D_{\Delta t} \left[ \widehat{\mathbf R}_{t+1}^{\mathrm{adv}} \right],
R^t+1pred=R^t+1diff+stΔt. \widehat{\mathbf R}_{t+1}^{\mathrm{pred}} = \widehat{\mathbf R}_{t+1}^{\mathrm{diff}} +\mathbf s_t\Delta t.

对应损失可写为

Ladvt=R^t+1advRt+11, \mathcal L_{\mathrm{adv}}^t = \left\| \widehat{\mathbf R}_{t+1}^{\mathrm{adv}} -\mathbf R_{t+1} \right\|_1,
Ldifft=R^t+1diffRt+11, \mathcal L_{\mathrm{diff}}^t = \left\| \widehat{\mathbf R}_{t+1}^{\mathrm{diff}} -\mathbf R_{t+1} \right\|_1,
Lpredt=R^t+1predRt+11, \mathcal L_{\mathrm{pred}}^t = \left\| \widehat{\mathbf R}_{t+1}^{\mathrm{pred}} -\mathbf R_{t+1} \right\|_1,
Lphys=t=0T1(λadvLadvt+λdiffLdifft+Lpredt). \mathcal L_{\mathrm{phys}} = \sum_{t=0}^{T-1} \left( \lambda_{\mathrm{adv}} \mathcal L_{\mathrm{adv}}^t +\lambda_{\mathrm{diff}} \mathcal L_{\mathrm{diff}}^t +\mathcal L_{\mathrm{pred}}^t \right).

深监督有助于稳定训练,但它也把完整 truth 同时作为“只平流”和“平流加扩散”的目标;于是运动与扩散分支可能被迫解释本应由源项承担的生成消散,削弱物理可分解性。论文没有报告 λadv\lambda_{\mathrm{adv}}λdiff\lambda_{\mathrm{diff}} 或敏感性实验。

5.2 确定性背景与强度残差

将三维确定性结果取单层或二维柱状最大投影,记为

R1:T2D,det. \mathbf R_{1:T}^{\mathrm{2D,det}}.

真实二维序列为 Rtruth\mathbf R_{\mathrm{truth}},强度残差定义为

rtruth=RtruthR1:T2D,det. \mathbf r_{\mathrm{truth}} = \mathbf R_{\mathrm{truth}} -\mathbf R_{1:T}^{\mathrm{2D,det}}.

Diff-Gen 有两个条件扩散分支:

  • structure branch 直接生成未来雷达结构;
  • residual branch 生成相对确定性背景的强度残差。

5.3 v-parameterization 的完整公式

令扩散步

τUnif{0,,N1},ϵN(0,I), \tau \sim \mathrm{Unif} \left\{ 0,\ldots,N-1 \right\}, \qquad \boldsymbol\epsilon \sim \mathcal N \left( \mathbf 0,\mathbf I \right),

并定义

ατ=1βτ,αˉτ=j=0ταj. \alpha_\tau = 1-\beta_\tau, \qquad \bar\alpha_\tau = \prod_{j=0}^{\tau}\alpha_j.

结构分支的 noisy state 是

xτstruct=αˉτRtruth+1αˉτϵ, \mathbf x_\tau^{\mathrm{struct}} = \sqrt{\bar\alpha_\tau} \mathbf R_{\mathrm{truth}} +\sqrt{1-\bar\alpha_\tau} \boldsymbol\epsilon,

v-target 为

vτstruct=αˉτϵ1αˉτRtruth. \mathbf v_\tau^{\mathrm{struct}} = \sqrt{\bar\alpha_\tau} \boldsymbol\epsilon -\sqrt{1-\bar\alpha_\tau} \mathbf R_{\mathrm{truth}}.

其训练目标为

Lstruct=Eτ,ϵ[vθstruct(xτstruct,τ,RT0:02D,R1:T2D,det)vτstruct22]. \mathcal L_{\mathrm{struct}} = \mathbb E_{\tau,\boldsymbol\epsilon} \left[ \left\| \mathbf v_\theta^{\mathrm{struct}} \left( \mathbf x_\tau^{\mathrm{struct}}, \tau, \mathbf R_{-T_0:0}^{\mathrm{2D}}, \mathbf R_{1:T}^{\mathrm{2D,det}} \right) -\mathbf v_\tau^{\mathrm{struct}} \right\|_2^2 \right].

残差分支对应

xτres=αˉτrtruth+1αˉτϵ, \mathbf x_\tau^{\mathrm{res}} = \sqrt{\bar\alpha_\tau} \mathbf r_{\mathrm{truth}} +\sqrt{1-\bar\alpha_\tau} \boldsymbol\epsilon,
vτres=αˉτϵ1αˉτrtruth, \mathbf v_\tau^{\mathrm{res}} = \sqrt{\bar\alpha_\tau} \boldsymbol\epsilon -\sqrt{1-\bar\alpha_\tau} \mathbf r_{\mathrm{truth}},
Lres=Eτ,ϵ[vθres(xτres,τ,RT0:02D,R1:T2D,det)vτres22]. \mathcal L_{\mathrm{res}} = \mathbb E_{\tau,\boldsymbol\epsilon} \left[ \left\| \mathbf v_\theta^{\mathrm{res}} \left( \mathbf x_\tau^{\mathrm{res}}, \tau, \mathbf R_{-T_0:0}^{\mathrm{2D}}, \mathbf R_{1:T}^{\mathrm{2D,det}} \right) -\mathbf v_\tau^{\mathrm{res}} \right\|_2^2 \right].

总扩散损失可概括为

LDiff\mboxGen=Lstruct+Lres. \mathcal L_{\mathrm{Diff\mbox{-}Gen}} = \mathcal L_{\mathrm{struct}} +\mathcal L_{\mathrm{res}}.

论文没有在主文报告扩散步数 NN、噪声 schedule、训练与采样步数、classifier-free guidance、分支权重或条件注入细节。

5.4 三类集合成员

对每次随机采样,论文定义

S1=Sstruct, \mathbf S_1 = \mathbf S_{\mathrm{struct}},
S2=R1:T2D,det+Sres, \mathbf S_2 = \mathbf R_{1:T}^{\mathrm{2D,det}} +\mathbf S_{\mathrm{res}},
S3=Sstruct+αSres. \mathbf S_3 = \mathbf S_{\mathrm{struct}} +\alpha\mathbf S_{\mathrm{res}}.

若每类各采 KK 次,则名义上得到 3K3K 个成员。论文没有报告 KKα\alpha、三类成员的权重、是否去重、CRPS 计算使用多少成员,因而无法判断“calibrated ensemble”是否来自概率校准,还是来自成员类型混合。

5.5 “三维概率生成”的准确边界

Diff-Gen 明确在二维雷达场上训练和运行:既可作用于柱状最大投影,也可逐高度层独立运行后堆叠为三维。逐层独立采样并不建立跨高度联合协方差,也不保证垂直连续性。因此最准确的表述是:

三维确定性灰箱核心 + 二维条件扩散精化;可逐层组成三维样本,但不是一个联合建模全部高度层的三维扩散过程。

6. 实验设计与结果

6.1 Baselines 与信息公平性

论文比较:

  • pySTEPS:光流外推与随机集合;
  • SimVP:纯数据驱动视频预测;
  • NowcastNet:二维物理条件生成模型。

所有方法来自同一三维雷达源,但 Nowcast3D 直接接收 24 层体数据,baselines 接收柱状最大反射率二维投影。于是比较同时改变了输入信息量和模型结构:

performance gap=3D information gain+architecture gain+training budget effects. \mathrm{performance\ gap} = \mathrm{3D\ information\ gain} +\mathrm{architecture\ gain} +\mathrm{training\ budget\ effects}.

论文没有提供等信息量 3D baseline、Nowcast3D 的 2D 输入版本、统一参数量或统一算力预算,不能把全部优势归因于灰箱设计。主文还称“all baseline models are trained”,但 pySTEPS 同时被称为 parameter-free;更准确的说法应是学习模型被训练或微调,pySTEPS 用固定配置运行。

6.2 指标

指标目标审计意见
Neighborhood CSI阈值事件的空间命中Methods 列 20/30/40/50 dBZ,Figures 2–3 用 30/40 dBZ,Figure 4 用 35/45 dBZ;neighborhood radius 未报告
PSD空间尺度与谱能量能展示过度平滑,但未报告频段、谱斜率拟合方法和数值表
LPIPS感知相似性使用 AlexNet;未说明通道映射、归一化和 mask 处理
CRPS概率集合质量只在茂名结果出现;Methods 未定义,ensemble size 和 calibration protocol 缺失
专家偏好业务可用性160 位专家、每人 23 个案例;缺少 unique case 数、聚合单位、CI 和专家间一致性
风速相关 / 风向 MAE推断运动场合理性缺站点数、匹配阈值、样本数、数值表和 CI

多数主指标在柱状最大反射率投影上计算,所以主要证明二维投影质量。Figure 3f 提供 Nowcast3D 自身逐高度 CSI/LPIPS,但 baselines 没有三维对应结果。

6.3 主图能支持什么

Figures 2–4 的曲线和案例一致支持以下较克制结论:

  • Nowcast3D 在中长时效的结构保持通常优于三个 baselines;
  • 强回波和细尺度结构衰减更慢,PSD 更接近观测;
  • 0.01° 茂名案例中,概率集合的 CRPS 随 lead time 的增长更缓;
  • 45 dBZ、180 min 等极难设置下,所有方法的 absolute skill 都较低,不能只强调相对排序;
  • 极短时效部分阈值上 NowcastNet 可持平或略高,论文优势主要在中长时效。

主图没有提供完整数值表、随机种子方差、bootstrap CI 或显著性检验,所以不能据曲线间距判断统计显著。

6.4 可精确读取的专家与 LPIPS 结果

Figure 4b 的专家偏好比例为:

模式Nowcast3DNowcastNetpySTEPSSimVP
Posterior / 事后0.570.270.150.02
Prior / 事前0.510.300.150.04

事后模式允许专家看未来验证雷达,因此更像 retrospective diagnosis;事前 0.51 更接近真实运行决策。四舍五入后行和可能不严格等于 1。

Figure 4a 汇总 LPIPS:

分辨率Nowcast3DNowcastNetpySTEPSSimVP
0.04°0.200.250.220.55
0.01°0.260.320.300.50

较低更好。两个单案例图的 LPIPS 分别为:

  • Figure 2:0.18 / 0.25 / 0.20 / 0.49;
  • Figure 3:0.27 / 0.41 / 0.37 / 0.60;

顺序均为 Nowcast3D / NowcastNet / pySTEPS / SimVP。单案例数值只能说明示例,不等同总体效应。

6.5 风场验证

论文把每 6 min 的网格位移换算为 m/s,并在 wind-profiler 周围的水平半径和垂直容差内平均。Extended Data Figure 5 从图上约读出:风速相关约为 0.67,风向 MAE 随 lead time 从约 11° 增长到约 43°。由于没有数值表,这些只能标为近似读图值。

论文自己承认:

  • 模型推断更接近 hydrometeor motion;
  • 无回波区的速度不可靠;
  • 没有独立验证垂直速度。

所以风场结果是很有潜力的辅助证据,不是无监督恢复真实三维大气风的充分证明。

6.6 Figure 3 的严重日期冲突

同一个茂名案例出现三套互相冲突的信息:

  1. Figure 3 caption:2025-06-17 13:54;
  2. 正文结果段:2025-08-16;
  3. Figure 3 图内:2025-06-16 05:24:00 UTC。

这不是普通排版瑕疵,而会改变事件身份、时区解释和测试集可定位性。正式发表前必须给出唯一 case ID、时区和初始时刻。它是本文证据审计中优先级最高的可复现性问题。

6.7 消融与统计缺口

主文把单物理项、直接速度预测、去除概率精化等关键消融放到 Supplementary Note 5.1–5.2,但 v4 源包没有这些附件。现有材料还缺少:

  • 每个 split 的样本量、事件数和案例列表;
  • 多随机种子结果;
  • 均值、标准差或置信区间;
  • paired significance test;
  • 2D/3D 等信息量控制;
  • 计算成本、显存、训练时间、推理延迟;
  • 扩散集合规模和 reliability / spread-skill 分析。

7. Claims → Evidence 映射

Claim类型主要证据强度主要风险
原生三维 gray-box 框架方法Methods、Figure 1、Extended Data Figure 1概率精化本身是 2D
平流、扩散、源项能分离物理机制方法 / 解释方程与中间监督三分支不可识别,源项可吸收其他误差
三维输入改善预报经验Figures 2–4baseline 仅获 2D 投影,信息不公平
跨区域、跨年份泛化经验华南 2024 训练、华北 2025 测试无样本数、事件清单、CI
城市尺度高分辨率有效经验茂名 0.01° 案例与汇总曲线Figure 3 日期冲突;公开 512 变体域尺寸不同
风场具有物理意义解释 / 经验profiler 案例与 Extended Data Figure 5中偏弱匹配阈值、样本数、数值表缺失;不是可识别真实风
概率集合可靠且校准概率CRPS、专家偏好中偏弱KKα\alpha、CRPS protocol 与校准图缺失
优于三个 baseline经验CSI、PSD、LPIPS 曲线无统计检验;输入信息量和预算不对称
完整可复现工程GitHub 与 demo无训练脚本、全量数据、最佳权重、完整评测脚本

8. 理论与数学严谨性结论

8.1 成立的部分

  • 把回波变化分成 transport、diffusion、source 是合理的灰箱归纳偏置。
  • 半拉格朗日采样和 Monte Carlo 扩散可微,适合端到端学习。
  • Helmholtz 势参数化比无结构直接回归速度更有解释框架。
  • 用 residual diffusion 修补确定性骨干的局地随机变化,与近年的二维 nowcasting 谱系一致。

8.2 尚未成立或需限定的部分

  1. 不是严格守恒模型。 平流使用非守恒形式,源项自由,插值与边界也未作守恒控制。
  2. 随机扩散不严格等于所写 PDE。 空变 κ\boldsymbol\kappa 时缺少 κ\nabla\boldsymbol\kappa 引起的 drift,速度还被局地冻结。
  3. 扩散协方差约束不清。 没有说明对称半正定参数化。
  4. “确定性核心”含随机 Monte Carlo。 M=8M=8 时若 seed 或确定性 quadrature 不固定,同一输入可有微小变化。
  5. 中间物理量不可识别。 单一反射率标量无法唯一决定三维速度、扩散和源项。
  6. 二维逐层扩散不等于三维联合分布。 垂直相关性和连续性没有被概率模块显式约束。
  7. 反射率变量语义模糊。 方程中的 R\mathbf R 究竟是 dBZ、线性反射率因子还是归一化变量会影响加法、扩散和源项的物理含义。

因此,最稳妥的理论描述不是“物理定律求解器”,而是“受 advection–diffusion–source 结构约束的可学习灰箱预测器”。

9. 物理 claim 再审:它究竟把什么放进了模型内部

2026-08-23 补充:本节针对线下讲座中“不只加 physics loss,而是把平流方程、一阶近似和质量守恒放进模型内部”的说法逐项核验,并与 PhyDNet 对照。

9.1 结论先行

讲座表述判断精确版本
不只是加 physics loss正确速度、扩散和源项进入 forward 的显式状态推进;loss 只是另外监督中间状态
把平流方程放进模型内部基本正确放入的是反射率的现象学 advection–diffusion–source ansatz,不是完整大气动力学
把一阶近似放进模型内部部分正确有冻结速度、operator splitting 和 source Euler-like 更新,但 v4 没给 truncation-order 证明
把质量守恒放进模型内部按 v4 不成立方程是非守恒平流形式,速度不保证无散,有自由源项,RR 也不是质量密度
因此实际业务可靠不能推出物理结构是 inductive bias;业务可靠还需校准、极端事件、缺测、延迟和失效回退验证

最准确的标签是:

三维 gray-box neural numerical operator,含显式物理结构和物理诊断,但不是已证明严格守恒、稳定、边界完备的 PDE solver。

9.2 为什么它不只是 physics loss

若只是普通 physics-loss 方法,forward 可完全自由:

R^1:T=fθ(RT0:0), \widehat{\mathbf R}_{1:T} = f_\theta \left( \mathbf R_{-T_0:0} \right),

训练时再加

L=Ldata+λLPDE residual. \mathcal L = \mathcal L_{\mathrm{data}} +\lambda \mathcal L_{\mathrm{PDE\ residual}}.

去掉 LPDE residual\mathcal L_{\mathrm{PDE\ residual}} 后,推理图没有结构变化。

Nowcast3D 不同。网络先预测

(φ,ψ,κ,s), \left( \boldsymbol\varphi, \boldsymbol\psi, \boldsymbol\kappa, \mathbf s \right),

再构造

v=φ+×ψ, \mathbf v = \nabla\boldsymbol\varphi +\nabla\times\boldsymbol\psi,

最后必须经过

RtAΔtRtadvDΔtRtadv+diff+stΔtRt+1. \mathbf R_t \xrightarrow{\mathcal A_{\Delta t}} \mathbf R_t^{\mathrm{adv}} \xrightarrow{\mathcal D_{\Delta t}} \mathbf R_t^{\mathrm{adv+diff}} \xrightarrow{+\mathbf s_t\Delta t} \mathbf R_{t+1}.

这条 operator chain 是 forward graph 的一部分。它改变了 hypothesis class,也决定梯度如何回传到运动、扩散和源项 decoder。

同时,所谓 physics loss 不是典型 PINN residual:

Rt+vR(κR)s2. \left\| \frac{\partial R}{\partial t} +\mathbf v\cdot\nabla R -\nabla\cdot \left( \boldsymbol\kappa\nabla R \right) -s \right\|^2.

论文实际监督的是显式算子产生的三个状态:

A[Rt],D[A[Rt]],Rt+1. \mathcal A[R_t], \qquad \mathcal D[\mathcal A[R_t]], \qquad \mathbf R_{t+1}.

因此准确表述是:

物理形式主要通过模型内部的状态推进结构实现;训练目标再对算子中间态做深监督。

9.3 “一阶近似”有四种可能含义

讲座中的“一阶”容易混淆:

  1. 时间 PDE 是一阶。
Rt=F(R). \frac{\partial R}{\partial t} = \mathcal F(R).

这只描述时间导数阶数,不是数值精度。

  1. 平流项含一阶空间导数。
vR. -\mathbf v\cdot\nabla R.

扩散项却含二阶空间导数,所以整个 PDE 不是“只有一阶”。

  1. 冻结速度的 departure-point 近似。

精确特征线回溯要求沿轨迹积分速度。论文使用

xdepxvt(x)Δt, \mathbf x_{\mathrm{dep}} \approx \mathbf x -\mathbf v_t \left( \mathbf x \right) \Delta t,

这相当于在一步内冻结速度,可视为局地低阶回溯。

  1. Lie–Trotter 式 operator splitting 与 source Euler。
Rt+1DΔtAΔtRt+stΔt. \mathbf R_{t+1} \approx \mathcal D_{\Delta t} \mathcal A_{\Delta t} \mathbf R_t +\mathbf s_t\Delta t.

A\mathcal AD\mathcal D 不对易,

exp[Δt(LA+LD)]exp(ΔtLD)exp(ΔtLA). \exp \left[ \Delta t \left( \mathcal L_A+\mathcal L_D \right) \right] \neq \exp \left( \Delta t\mathcal L_D \right) \exp \left( \Delta t\mathcal L_A \right).

最简单的顺序分裂通常是全局一阶,但 v4 没有给出 local truncation error、commutator 分析或 grid refinement convergence。公开代码还把 Δt\Delta t 吸收到 learned displacement 和 source 的数值尺度里。

所以可以说“内部用了低阶离散近似”,不应说“论文证明了一个一阶精度求解器”。

9.4 质量守恒为什么不成立

RR 是一个守恒标量,标准 conservative transport 应写成

Rt+(Rv)=(κR)+s. \frac{\partial R}{\partial t} +\nabla\cdot \left( R\mathbf v \right) = \nabla\cdot \left( \boldsymbol\kappa\nabla R \right) +s.

Nowcast3D v4 使用

Rt=vR+(κR)+s. \frac{\partial R}{\partial t} = -\mathbf v\cdot\nabla R +\nabla\cdot \left( \boldsymbol\kappa\nabla R \right) +s.

两种平流形式相差

(Rv)=vRRv. -\nabla\cdot \left( R\mathbf v \right) = -\mathbf v\cdot\nabla R -R\nabla\cdot\mathbf v.

只有当

v=0 \nabla\cdot\mathbf v =0

时,二者才相同。但

v=φ+×ψ \mathbf v = \nabla\boldsymbol\varphi +\nabla\times\boldsymbol\psi

给出

v=Δφ, \nabla\cdot\mathbf v = \Delta\boldsymbol\varphi,

论文没有要求 Δφ=0\Delta\boldsymbol\varphi=0

对有限域 Ω\Omega 积分:

ddtΩRdx=ΩRvndS+ΩRvdx \frac{\mathrm d}{\mathrm dt} \int_\Omega R\,\mathrm d\mathbf x = -\int_{\partial\Omega} R\mathbf v\cdot\mathbf n\,\mathrm dS +\int_\Omega R\nabla\cdot\mathbf v\,\mathrm d\mathbf x
+ΩnκRdS+Ωsdx. \qquad +\int_{\partial\Omega} \mathbf n\cdot \boldsymbol\kappa\nabla R\,\mathrm dS +\int_\Omega s\,\mathrm d\mathbf x.

要让全域积分不变,至少需同时满足:

  • 无净平流边界通量;
  • 无净扩散边界通量;
  • v=0\nabla\cdot\mathbf v=0
  • Ωsdx=0\int_\Omega s\,\mathrm d\mathbf x=0

论文没有这些约束;而 ss 本来就表示增长、衰减和相变,因此一般不应为零。

9.5 反射率也不是水凝物质量

雷达线性反射率因子近似对应粒径分布的高阶矩:

ZiNiDi6, Z \propto \sum_i N_iD_i^6,

而液态水质量更接近 D3D^3 矩。dBZ 又是

dBZ=10log10Z. \mathrm{dBZ} = 10\log_{10}Z.

所以即使保持

Zdx \int Z\,\mathrm d\mathbf x

dBZdx, \int \mathrm{dBZ}\,\mathrm d\mathbf x,

也不等于保持水凝物质量。

当前公开代码确实先把归一化 dBZ-like 值转到线性 ZZ 空间,对 M=8M=8 个 Brownian 样本求平均,再转回 dBZ-like 空间;但随后在归一化 dBZ-like 状态上直接加 source。这个实现没有构成质量预算。

9.6 半拉格朗日也不是守恒格式

代码使用 nearest grid sampling、border padding:

Rn+1(xi)=I[Rn](xi+di). R^{n+1} \left( \mathbf x_i \right) = \mathcal I \left[ R^n \right] \left( \mathbf x_i+\mathbf d_i \right).

这类 backward semi-Lagrangian 方法常有良好稳定性,却通常不保持离散总和:

iRn+1(xi)iRn(xi). \sum_i R^{n+1} \left( \mathbf x_i \right) \neq \sum_i R^n \left( \mathbf x_i \right).

border padding 还会在域外回溯时复制边缘值。若要严格离散守恒,通常需 conservative semi-Lagrangian remapping 或 finite-volume flux update,并显式核算边界通量。

9.7 旧版本为何可能造成讲座印象

Nowcast3D v1 和 v2 的摘要正文曾使用 “conservative advection operator” 表述;v3 将该句注释掉,最新版 v4 不再保留。

更关键的是,v1/v2 的实际方程仍为

vR -\mathbf v\cdot\nabla R

AΔt[Rt](x)=Rt(xvt(x)Δt), \mathcal A_{\Delta t} \left[ R_t \right] \left( \mathbf x \right) = R_t \left( \mathbf x-\mathbf v_t(\mathbf x)\Delta t \right),

没有 conservative flux、boundary flux 或离散守恒证明。因此即使引用旧摘要,也不应把措辞升级成已验证的质量守恒。

9.8 与 PhyDNet 的真正关系

层级PhyDNetNowcast3D
物理状态学习潜状态 hp\mathbf h^p三维雷达反射率 RR
PDE广义 derivative basis指定 advection–diffusion–source
内部 forwardEuler-like h+Φ(h)\mathbf h+\Phi(\mathbf h)semi-Lagrangian + Brownian + source
训练约束moment loss 让卷积核近似导数中间状态 L1 让三个算子都接近 truth
弹性分支ConvLSTM residualconditional diffusion refinement
守恒保证
物理语义latent,无单位较强,但仍欠定

PhyDNet 的物理来自两处:

h~t+1=ht+Φ(ht) \widetilde{\mathbf h}_{t+1} = \mathbf h_t+\Phi \left( \mathbf h_t \right)

是 forward 结构;

Lmoment=M(w)Δ \mathcal L_{\mathrm{moment}} = \left\| \mathbf M \left( \mathbf w \right) -\boldsymbol\Delta \right\|

是训练软约束。两者并存,不是二选一。

Nowcast3D 比 PhyDNet 更接近 neural numerical solver,因为状态和算子有直接雷达语义;但这也意味着它必须承担 PhyDNet latent prior 可以回避的问题:物理单位、边界、守恒形式、扩散张量合法性和真实场可识别性。

9.9 从“物理合理”到“业务可靠”缺什么

物理 operator in the loop 可能提高样本效率、长时结构和 OOD 行为,但不能单独证明业务可靠。至少需要:

  1. 数值收敛。 改变 Δt\Delta t、空间分辨率、Monte Carlo 样本 MM 和插值方法,检查结果是否收敛。
  2. 极限测试。 分别令 v=0\mathbf v=0κ=0\boldsymbol\kappa=0s=0\mathbf s=0,验证每个分支的可控行为。
  3. 物理预算。ZZ、dBZ 和质量 proxy 上分别报告 source、boundary flux、divergence 与全域积分变化。
  4. 三维验证。 报告 echo-top、storm volume、vertical centroid、跨层相关和层间连续性,而不只看 column maximum。
  5. 风场验证。 按站点、高度、回波强度和天气型分层,报告 sample count、CI、radial velocity 与 profiler 对照。
  6. 概率校准。 reliability diagram、rank histogram、spread–skill、threshold Brier score、极端尾部 coverage。
  7. 数据故障。 雷达延迟、整层缺测、beam blockage、attenuation、ground clutter 和异常传播。
  8. 失效回退。 OOD detector、NWP / pySTEPS fallback、人工接管和告警稳定性。
  9. 决策价值。 在 prior real-time 条件下评估漏报成本、误报成本、提前量和 warning utility。

因此讲座中“把物理放进模型内部”是一个真实且重要的架构事实;“所以可靠”则仍需独立的数值、物理和业务证据链。

10. 领域定位

方法主要表征与时效相对 Nowcast3D 的关系
pySTEPS, GMD 20192D 光流外推与随机集合快、透明、易部署;缺生成消散与垂直结构
DGMR, Nature 20212D 条件生成,约 5–90 min概率生成和专家评估成熟;无显式三维物理核心
NowcastNet, Nature 20232D 物理条件生成,最长 3 h最直接的二维 gray-box 前身;Nowcast3D 增加垂直结构和扩散项
PreDiff, NeurIPS 2023潜空间扩散与知识对齐扩散先验强,但主要仍是二维表征
DiffCast, CVPR 2024确定性骨干 + residual diffusion2D 框架模块化;Nowcast3D 的物理状态空间更丰富
DIFF-3DRformer, Remote Sensing 20263D 平流、连续性、扩散,2 h与 Nowcast3D 方法学接近,更强调连续性与散度约束
EchoCast-3D, npj 2026原生 3D Mask Diffusion Transformer,短时滚动直接联合三维生成并强调缺测鲁棒;缺 Nowcast3D 的显式灰箱动力和 3 h 证据

需要注意时间顺序:DIFF-3DRformer 与 EchoCast-3D 出现在 Nowcast3D v4 同期或之后,不能反向要求 v4 在原始实验中比较所有后续工作;但截至 2026-08-23 做领域判断时,它们已经改变了竞争格局。

Nowcast3D 仍是从二维 gray-box nowcasting 走向三维物理表征的重要桥梁,尤其是三小时、跨区域和风场 proxy 的组合很有研究价值。但由于没有统一数据集或 head-to-head 实验,不宜宣称它无条件优于所有三维方法。

11. 审稿人视角

11.1 Strengths

  1. 研究问题重要,原生三维雷达比二维投影更贴近对流天气结构。
  2. 平流、扩散、源项三分解简洁而有解释力,容易形成可诊断中间量。
  3. 跨区域与跨年份测试比随机窗口划分更有说服力。
  4. 同时覆盖 0.04° 区域尺度和 0.01° 城市尺度。
  5. 专家事前 / 事后双模式评估比单纯图像指标更接近业务判断。
  6. 风场 proxy 为雷达预测之外提供了可复用的科学输出。
  7. 已发布代码、演示数据和 checkpoint,虽不完整,仍优于完全闭源。

11.2 Major concerns

  1. Figure 3 的日期与事件身份三重冲突。
  2. 数据规模、事件列表、超参数、运行成本和统计区间没有完整报告。
  3. Nowcast3D 用 3D 输入,baselines 用 2D 投影,模型优势与信息优势混杂。
  4. 论文所写空间可变扩散 PDE 与局地高斯 Monte Carlo 算子并不一般等价。
  5. 物理中间量不可识别,风场不应被直接等同于真实 atmospheric wind。
  6. 概率精化是二维的,不能无条件称 full 3D joint generative model。
  7. 专家实验缺聚合单位、unique case 数、置信区间和 inter-rater agreement。
  8. 代码、最佳 checkpoint、训练数据和训练 / 评测脚本不足以复现论文全套结果。

11.3 Minor concerns

  • caption 中出现 “13:54:00 pm” 等时间格式问题;
  • Figure 3 中 “Guandong” 应核对为 Guangdong;
  • 正文有 “evalution” 拼写错误;
  • “No other external data are used” 应改成 “No other external data are used for training”,因为风场验证使用外部 profiler;
  • 不同图使用不同 CSI 阈值,应说明选择原则;
  • calibrated 一词缺 reliability diagram、coverage 或 spread-skill 证据。

11.4 推荐

Major Revision,约 5/10。

我不建议直接 Reject,因为核心方向、系统设计和案例证据都有明显价值;也不建议当前 Accept,因为关键 case identity、统计报告、输入公平性、数学一致性和复现链条仍有实质缺口。

接受前最低要求:

  1. 固定 v4 对应代码 commit、配置和 checkpoint;
  2. 修正 Figure 3 的唯一时间、时区与事件 ID;
  3. 发布训练 / 评测脚本、完整超参数、seed、硬件与 runtime;
  4. 报告所有 split 的事件数、窗口数和完整数值表;
  5. 加入 bootstrap CI 或 paired test;
  6. 加入 2D/3D 信息量控制和等预算 baseline;
  7. 给出 profiler 站点、匹配阈值、有效样本量与具体 correlation / MAE;
  8. 解释方程与实际扩散实现、单位和边界条件。

12. 创新、严谨性与影响评分

  • Innovation: 7.5/10。 不是发明新的基础 PDE 或 diffusion objective,而是把原生三维雷达、灰箱动力、风场 proxy 和双分支残差扩散形成了有辨识度的组合。
  • Novelty: ★★★★☆ 4/5。 三维 gray-box 组织方式新颖,单个组件多来自已有谱系。
  • Rigor: ★★★☆☆ 3/5。 经验覆盖较广,但数学等价性、统计报告和复现材料明显不足。
  • Impact: ★★★★☆ 4/5。 若补齐评测和业务验证,可能推动三维雷达从输入数据变成可学习动力状态。

13. 可复用思想与后续研究

13.1 值得复用

  • 用势函数参数化运动,再由可微数值算子推进状态;
  • 把大尺度可预测部分与局地随机残差拆开;
  • 对物理中间步骤施加监督,但需配合可识别性正则;
  • 跨区域、跨年份、业务专家三类证据共同评价。

13.2 更严谨的改进方向

  1. PSD 扩散参数化。 学习下三角矩阵 L\mathbf L,令
κ=LL+εI,ε>0. \boldsymbol\kappa = \mathbf L\mathbf L^\top +\varepsilon\mathbf I, \qquad \varepsilon>0.
  1. 补偿空变扩散 drift。 让随机微分过程与目标 Fokker–Planck 方程严格匹配。
  2. 守恒式 transport。 比较 tR+(vR)\partial_t\mathbf R+\nabla\cdot(\mathbf v\mathbf R) 与当前非守恒式,并显式处理边界 flux。
  3. 机制可识别正则。s\mathbf s 的空间稀疏、时间平滑、与热力学 proxy 的相关性作约束;对速度加入 profiler 或 NWP 弱监督。
  4. 联合三维概率模型。 用 3D latent diffusion、factorized vertical attention 或多层 copula 建模跨高度相关。
  5. 集合校准。 同时报告 CRPS、rank histogram、reliability、coverage、spread-skill 与极端阈值 Brier decomposition。
  6. 表示公平实验。 构造 2D-Nowcast3D、3D-SimVP、相同参数量和相同训练预算的 factorial design。
  7. 极端天气压力测试。 按对流类型、地形、季节、雷达缺测率和 lead time 分层报告结果。

13.3 跟进决策

值得跟进,优先级中高。最值得复现的不是完整大模型,而是三个可证伪子问题:

  • 空变各向异性扩散算子是否真的优于对角常扩散;
  • 三维输入的收益在等信息量 baseline 下还剩多少;
  • 风场 proxy 加入少量独立观测监督后,能否同时提高预报与物理可解释性。

14. 参考来源

原论文与代码

直接相关工作

  • Ravuri et al., Skilful precipitation nowcasting using deep generative models of radar, Nature, 2021.
  • Zhang et al., Skilful nowcasting of extreme precipitation with NowcastNet, Nature, 2023.
  • Pulkkinen et al., pySTEPS: an open-source Python library for probabilistic precipitation nowcasting, GMD, 2019.
  • Yu et al., DiffCast: A Unified Framework via Residual Diffusion for Precipitation Nowcasting, CVPR, 2024.
  • Gao et al., PreDiff: Precipitation Nowcasting with Latent Diffusion Models, NeurIPS, 2023.
  • Le Guen and Thome, Disentangling Physical Dynamics from Unknown Factors for Unsupervised Video Prediction, CVPR, 2020.
  • DIFF-3DRformer, Remote Sensing, 2026.
  • Generative machine learning for skilful 3D radar nowcasting / EchoCast-3D, npj Climate and Atmospheric Science, 2026.

Code Verification

核验范围:作者当前公开仓库静态审计,HEAD 41a097a(2026-07-31)。该 commit 晚于 arXiv v4,因此以下只能判断“当前公开实现与论文叙述的对应关系”,不能断言它就是 v4 实验的原始实现。

CV.1 公开内容

仓库提供两个演示分支:

  • 1024_4:24 层、256×256256\times256、约 10.24°、0.04°,10 帧输入、30 帧输出;
  • 512_1:24 层、512×512512\times512、约 5.12°、0.01° 的简化 operational 变体。

第二者与论文茂名实验的 256×256256\times256、2.56° 不同,不能直接视为同一模型或同一评测设置。

CV.2 Claims → Code

论文 claim当前代码证据状态
3D U-Net + Transformer 主干1024_4 PhyPredNet 中可见编码解码器、Transformer 和时空结构部分验证
Helmholtz 速度φ,ψ\varphi,\boldsymbol\psi 的梯度和 curl 构造三分量位移验证
Monte Carlo 扩散,M=8M=8brownian_diffuse 的 n_samples 为 8验证
一般各向异性张量代码只输出三个轴向 sigma不完全一致
显式 Δt\Delta t2κΔt2\boldsymbol\kappa\Delta t代码用 grid + v + D × noise,没有显式论文符号需解释单位折叠
反射率空间平均扩散样本先由 dBZ-like 量转线性反射率因子,平均后再转回代码比主文更具体
源项 sΔt\mathbf s\Delta t代码直接加 S,没有显式 Δt\Delta t需解释尺度
双分支 diffusionstructure 与 intensity 文件主体相近,输出组合不同部分验证
三类 ensembledemo 组合三个成员来源部分验证;符号和混合规则未完全对齐
缺测 mask输入接收 mask,最终应用 y_mask部分验证;1024 主 forward 中 x_mask 未实际使用

CV.3 论文未写明但会影响结果的实现

  • 网格采样使用 nearest、border padding、align_corners=True;
  • Brownian 样本在雷达线性功率空间平均,再转换回来;
  • rollout 中上一时刻预测被 detach;
  • 当前 diffusion 采用 v-objective、sigmoid beta schedule、1000 训练步、250 DDIM 采样步、eta 为 0;
  • demo 后处理删除面积小于 4 的连通分量;
  • 公开 ensemble demo 的第三类组合系数为 0.5,但与论文 Sstruct+αSres\mathbf S_{\mathrm{struct}}+\alpha\mathbf S_{\mathrm{res}} 的残差符号关系并不完全透明;
  • 传入的 spacing 参数没有用于 1024 模型的 torch.gradient,速度首先是网格位移,随后才做物理单位换算。

这些实现选择都可能显著影响平滑性、边界、微弱回波和速度解释,应写入正式复现配置。

CV.4 可复现性审计

项目状态
推理代码已公开
demo 样例与公开 checkpoint通过外部 Google Drive 提供
最佳 checkpointREADME 明确称为保密,未公开
全量 CMA 数据需作者和 CMA 许可
训练入口未发现
论文全量评测脚本未发现
消融配置未发现
依赖锁定无 requirements lock
随机 seed未见统一设置
自动测试未发现
License未发现明确许可证
端到端复跑未执行;本地无 checkpoint、样例包和 PyTorch 环境
静态语法检查Python 文件通过 py_compile

扩散训练相关接口在公开代码中还有 NotImplementedError 提示,因此当前发布更接近 demo / inference package,而不是可从原始数据复现 v4 所有表图的 research artifact。

CV.5 代码结论

公开实现支持论文的总体故事:三维势函数运动、M=8M=8 布朗扰动、强度源项和二维扩散精化确实存在;但方程符号到代码单位的映射、扩散张量形式、边界、后处理、训练流程和最佳权重没有完整闭环。代码存在不等于结果可复现。若要复现论文,必须让作者提供固定 commit、完整配置、训练 / 评测入口、测试案例清单和与 v4 对应的 checkpoint。

Static research notes built with VitePress and KaTeX.