cs.LG 2110.02861

8-bit Optimizers via Block-wise Quantization

Proposes 8-bit optimizers with block-wise dynamic quantization, maintaining 32-bit performance while reducing memory by 75%.

Tim Dettmers, Mike Lewis, Sam Shleifer et al.

2021-10-06 47
cs.LG 2109.04838

Block Pruning For Faster Transformers

Introduces block movement pruning, combining it with movement pruning to accelerate Transformer models by 2.4x and reduce size by 74% while maintaining performance.

François Lagunas, Ella Charlaix, Victor Sanh et al.

2021-09-10 45
cs.LG 2108.08481

Neural Operator: Learning Maps Between Function Spaces

Proposes neural operators combining integral kernels and nonlinear activations for PDE operator approximation, achieving universal approximation and discretization invariance.

Nikola Kovachki, Zongyi Li, Burigede Liu et al.

2021-08-19 47