排序: 最新 热门 引用
cs.LG 1502.07073

Strongly Adaptive Online Learning

提出强适应性在线学习算法,将低遗憾算法转化为在任意时间段表现接近最优。

Amit Daniely, Alon Gonen, Shai Shalev-Shwartz

2015-02-25 39
cs.LG 1502.05477

Trust Region Policy Optimization

TRPO(信赖域策略优化)通过近似理论保证单调提升,优化深层神经网络策略,实验显示在机器人控制和Atari游戏中表现优异。

John Schulman, Sergey Levine, Philipp Moritz 等

2015-02-19 8275 引用 49
cs.LG 1412.7149

Deep Fried Convnets

提出深度炸鸡卷(Deep Fried ConvNets),用Fastfood层替代全连接层,参数减少90%,性能不变。

Zichao Yang, Marcin Moczulski, Misha Denil 等

2014-12-23 56
cs.LG 1412.6651

Deep learning with Elastic Averaging SGD

提出Elastic Averaging SGD(EASGD)算法,通过弹性力机制在深度学习分布式训练中实现高效通信与探索,显著提升训练速度和模型性能。

Sixin Zhang, Anna Choromanska, Yann LeCun

2014-12-20 646 引用 38
cs.LG 1412.0233

The Loss Surfaces of Multilayer Networks

用球面自旋玻璃理论解释SGD在大网络中趋向低能量、高质量局部极小值。

Anna Choromanska, Mikael Henaff, Michael Mathieu 等

2014-11-30 24