Layers Matter: Why Continual Learning Regularization Should Be Layer-Adaptive
Layer-adaptive regularization based on Hessian top eigenvalues improves continual learning by reducing forgetting.
Brian B. Moser, Ahmed Anwar, Tobias Christian Nauen et al.