CycleNet:通过建模周期性模式来提升时间序列预测精度

主要内容:NeurIPS 2024的CycleNet针对长时序预测,提出RCF周期建模模块,通过学习全局固定周期模板拆分周期与残差,仅预测残差再融合结果,可嵌入各类时序模型。模型搭配单层线性或双层MLP,结构极轻量,参数量大幅减少。在电力、气象等稳定周期数据集上效果达SOTA;但单通道建模、易受异常值干扰,交通数据表现不及iTransformer。实验证明RCF优于传统时序分解。文章也说明模型仅适配固定周期序列,最后给出融合变量关联、提升鲁棒性等改进方向。

代码地址:https://github.com/ACAT-SCUT/CycleNet

论文地址:[2409.18479] CycleNet: Enhancing Time Series Forecasting through Modeling Periodic Patterns

一、引言

1.长时序预测现有方案的痛点

长时序预测(LTSF)广泛用于电力负荷、交通流量、气象、光伏等场景,需要一次性预测数十至数百步。当下主流方案分两类:一是基于 Transformer、TCN、RNN 的深度模型,依靠多层网络、注意力机制捕捉长依赖,缺点是参数量庞大、推理慢、算力成本高;二是 DLinear、Autoformer 这类时序分解模型,仅在输入回看窗口内拆分季节周期与趋势,只能利用局部片段,当回看长度小于数据固有周期时,分解效果大幅衰减,无法充分挖掘全局稳定周期规律。两类方法都绕开了一个核心事实:长时序预测的核心支撑是全局固定周期性。

2.CycleNet 核心创新与论文基础信息

本文是 NeurIPS 2024 Spotlight 论文,由华南理工团队提出,核心创新为RCF 残差周期预测,一种可即插即用的全局周期建模模块。区别传统局部分解,RCF 学习全局共享周期模板,完整提取时序周期分量,仅对去除周期后的残差做预测,最终叠加周期得到结果。将 RCF 搭配单层线性、双层 MLP 即可构成极简 CycleNet,参数量相比主流模型降低 90% 以上,在电力、光伏、气象等周期稳定数据集达到 SOTA。 开源代码:https://github.com/ACAT-SCUT/CycleNet 论文 arXiv:[2409.18479] CycleNet: Enhancing Time Series Forecasting through Modeling Periodic Patterns

二、模型架构

1.核心模块:RCF 残差周期预测原理

现有 DLinear、Autoformer 等时序分解方法,仅能在有限输入回看窗口内拆分季节、趋势成分,只能利用局部时序片段;一旦回看长度小于数据完整周期,分解会出现残缺、边缘失真问题。为解决该缺陷,论文提出RCF 残差周期预测模块,核心思路是提前学习数据集全局共享的周期模板,把时序拆分为可稳定复现的周期部分、无规律波动残差部分分开建模,整套流程分为周期提取、残差预测、结果融合三步。
1. 全局周期模板初始化与对齐
定义可学习参数:Q ∈ R^(W×D),其中,W 表示数据集固有周期长度,D 表示变量通道数。模板 Q 初始化为全零矩阵,并通过反向传播持续更新。
对于当前时间步 t,模型根据时间偏移量:t mod W,对周期模板进行循环移位,得到与当前时间位置对齐的周期模板 Q^(t),从而解决时序起点与周期模板之间的错位问题。
2. 周期分量重复拼接
将对齐后的 Q^(t) 通过重复与截断操作生成:
c_(t−L+1:t)    (输入窗口周期片段)
c_(t+1:t+H)    (预测窗口周期片段)
当回看长度 L 或预测长度 H 大于单周期长度 W 时,通过循环复制模板进行扩展;当长度不足一个周期时,则截取对应部分。最终生成与输入序列和预测序列长度一致的周期分量。
3. 残差分离与残差预测
通过下式计算残差序列:r = x – c,其中 x 为原始输入序列,c 为对应周期分量。
骨干网络仅对残差序列 r 进行预测,无需重复学习周期规律,从而降低建模难度,提高预测效率。
4. 周期与残差融合输出
设骨干网络预测得到未来残差:r̂_(t+1:t+H)
最终预测结果表示为:ŷ_(t+1:t+H) = r̂_(t+1:t+H) + c_(t+1:t+H)
RCF 通过将周期规律固化为全局模板,使网络重点学习随机波动和局部变化,从而提高长序列预测能力。

2.CycleNet 两种轻量化网络结构

RCF 本质上是一个通用分解插件,可与不同骨干网络结合构成 CycleNet。论文设计了两种轻量化实现方案,并采用通道独立(Channel Independent)建模策略,即所有变量共享同一组网络参数。
1. CycleNet/Linear
采用单层全连接线性层作为残差预测器:r̂ = Wr + b
该结构不包含激活函数、卷积操作和注意力机制,计算开销极低,训练速度快,适用于周期规律明显的场景。
2. CycleNet/MLP
采用双层多层感知机结构:h = GELU(W1r + b1),r̂ = W2h + b2
相比 Linear 版本,MLP 能够更好拟合复杂残差波动,在高维多变量数据集上具有更优预测性能,因此也是论文推荐的默认配置。
此外,RCF 具有较强的可插拔性,可以作为前置分解模块集成到 DLinear、SparseTSF、PatchTST、iTransformer 等模型中,在几乎不增加计算成本的情况下提升预测精度。

3.配套辅助:归一化与损失函数设计

1. RevIN 实例归一化
为缓解时序数据中的分布偏移问题,CycleNet 默认采用不带可学习仿射变换的 RevIN(Reversible Instance Normalization)。
输入归一化过程:x_norm = (x − μ) / √(σ + ε)
预测结果反归一化过程:x̂_raw = x̂_norm × √(σ + ε) + μ
其中:μ 为当前输入窗口均值;σ 为当前输入窗口标准差;ε 为防止分母为零的极小常数。
该方法能够有效消除不同样本之间的统计分布差异,提高模型泛化能力。但对于太阳能发电等大量零值场景,归一化可能导致特征失真,因此需要关闭 RevIN。
2. MSE 损失函数
模型训练采用均方误差(Mean Squared Error)作为优化目标:Loss = ||x_real − x̂_pred||²₂,其中:x_real 表示真实值;x̂_pred 表示模型预测值。
统一采用 MSE 损失函数能够保证与 Autoformer、PatchTST、iTransformer 等主流基线模型的公平对比,提高实验结果的可信度。

三、实验结果与分析

1.预测精度与轻量化效率表现

实验覆盖 ETT 负荷、电力、光伏、气象、交通六大标准时序数据集,对比近十年主流 SOTA 模型。在电力、光伏、气象、ETT 等具备稳定日 / 周周期的数据上,CycleNet/MLP 整体最优,CycleNet/Linear 稳居第二;仅交通数据集弱于 iTransformer。

效率层面优势突出,参数量、MAC 运算量远低于 PatchTST、iTransformer,训练耗时更短,兼顾高精度与轻量化。

2.消融实验验证 RCF 的有效性

多组消融从三个维度验证 RCF 价值:

1.基础骨干消融:纯 Linear/MLP 加装 RCF 后,MSE 普遍下降 10%-20%,证明 RCF 是性能提升核心;

2.插件通用性:给 PatchTST、iTransformer、DLinear 接入 RCF,均能稳定涨点;

3.时序分解横向对比:RCF 显著优于 MOV 滑动平均、LD 可学习分解、Sparse 稀疏分解三类传统 STD 方案;

4.周期超参 W 消融:W 必须匹配数据集真实周期,错配后模型效果几乎等同于不加 RCF。

3.模型短板:交通数据集表现分析

交通数据集存在两大缺陷限制 CycleNet 效果:第一,路网流量存在大量突发极端离群值,会偏移 RCF 学习到的全局平均周期模板,残差计算失真;第二,Cycle 采用单通道独立建模,不建模测点之间时空依赖,而 iTransformer 通过维度翻转捕捉多变量交互,在交通任务更适配。补充 PEMS 小型交通数据集实验可见,离群点更少时,CycleNet 和 SOTA 差距明显缩小。

四、总结与展望

1.全文核心贡献梳理

  • 提出 RCF 全局周期分解模块,突破传统局部时序分解窗口限制,可即插即用兼容所有主流时序模型;
  • 基于 RCF 搭建 CycleNet/Linear、CycleNet/MLP 两种极简轻量模型,多数数据集超越复杂 Transformer 基线;
  • 大量消融、可视化、横向对比实验,完整证明 RCF 相比传统季节分解方法的优越性。

2.模型固有局限与适用范围

CycleNet 有明确适用边界:优势场景为电力、光伏、气象、ETT 负荷等固定稳定周期、变量交互弱、异常值少的时序任务;存在四点固有局限:仅支持全局统一固定周期,无法处理时变周期(心电);全通道共用同一 W,多通道周期不一致效果下滑;极端离群值严重干扰周期模板;年度超长周期缺少足量训练数据难以学习。

3.未来优化研究方向

论文提出三条可行改进路线:优化 RCF 损失或模板更新逻辑,提升对异常值鲁棒;融合 GNN、iTransformer 类跨变量交互模块,弥补交通场景短板;设计多通道独立周期、适配年尺度长周期的扩展 RCF 结构。

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值