cs.LG 2202.03528

TACTiS: Transformer-Attentional Copulas for Time Series

Proposes TACTiS, a Transformer-based model using attention copulas for joint probabilistic forecasting of high-dimensional multivariate time series.

Alexandre Drouin, Étienne Marcotte, Nicolas Chapados

2022-02-08 35
cs.LG 2202.03376

Message Passing Neural PDE Solvers

MP-PDE unifies classical local solvers with message passing and improves autoregressive stability via pushforward training.

Johannes Brandstetter, Daniel Worrall, Max Welling

2022-02-08 15
cs.LG 2202.01545

Byzantine-Robust Decentralized Learning via ClippedGossip

Proposed ClippedGossip algorithm achieves neighborhood convergence for non-convex decentralized training under Byzantine attacks, leveraging spectral gap γ and attack ratio δ.

Lie He, Sai Praneeth Karimireddy, Martin Jaggi

2022-02-03 30
cs.LG 2202.01017

Multi-Task Learning as a Bargaining Game

Proposes Nash-MTL, modeling gradient aggregation as a bargaining game, achieving proportional fairness and improving multi-task learning performance.

Aviv Navon, Aviv Shamsian, Idan Achituve et al.

2022-02-02 45
cs.LG 2112.08654

Learning to Prompt for Continual Learning

L2P introduces a prompt pool with instance-wise query for continual learning without task labels, outperforming buffer-based methods.

Zifeng Wang, Zizhao Zhang, Chen-Yu Lee et al.

2021-12-16 33
cs.LG 2112.06305

Recalibrating probabilistic forecasts of epidemics

Proposes a PIT entropy-based recalibration method for epidemic forecasts, significantly improving calibration and accuracy across 27 influenza models.

Aaron Rumack, Ryan J. Tibshirani, Roni Rosenfeld

2021-12-13 31