GptGet
Features PaperForge Apps Papers Blog Contact AI Chat 中文
Sort: Latest Popular Citations
All Artificial Intelligence Computation and Language Computer Vision Information Retrieval Machine Learning Machine Learning (Stats) Neural and Evolutionary Computing Robotics
cs.LG 2605.07075

ModelLens: Finding the Best for Your Task from Myriads of Models

ModelLens learns a performance-aware latent space from leaderboard interactions to recommend models without running them, outperforming metadata-based baselines on 162K records.

Rui Cai, Weijie Jacky Mo, Xiaofei Wen et al.

2026-05-08 29
cs.LG 2605.06947

Rollback-Free Stable Brick Structures Generation

STABLE uses RLPR to achieve rollback-free stable brick generation, improving inference speed by 94%.

Chenhui Xu, Ziyue Bai, Fuxun Yu et al.

2026-05-08 34
cs.LG 2605.06797

MIND: Monge Inception Distance for Generative Models Evaluation

MIND uses sliced Wasserstein for efficient, robust evaluation of generative models, requiring fewer samples and being faster than FID.

Quentin Berthet, Yu-Han Wu, Clement Crepy et al.

2026-05-08 43
cs.LG 2605.06387

Asymmetric On-Policy Distillation: Bridging Exploitation and Imitation at the Token Level

AOPD replaces negative reinforcement with local divergence minimization, reducing variance and exploration issues in on-policy distillation, boosting math reasoning by 4.09/8.34 points.

Nan Jia, Haojin Yang, Xing Ma et al.

2026-05-07 39
cs.LG 2605.06036

Optimal Transport for LLM Reward Modeling from Noisy Preference

Proposes SelectivelyRM, an optimal transport-based framework for robust reward modeling from noisy preferences, outperforming SOTA by 5-10% in error metrics.

Licheng Pan, Haochen Yang, Haoxuan Li et al.

2026-05-07 20
cs.LG 2605.05994

DiBA: Diagonal and Binary Matrix Approximation for Neural Network Weight Compression

DiBA (Diagonal and Binary Matrix Approximation) compresses neural network weights by decomposing matrices into three diagonal and two binary factors, improving storage efficiency.

Nobutaka Ono

2026-05-07 49
cs.LG 2605.05387

Conditional Diffusion Under Linear Constraints: Langevin Mixing and Information-Theoretic Guarantees

Proposes a linear-constrained diffusion sampling method combining Langevin mixing and information-theoretic bounds, improving image inpainting and super-resolution.

Ahmad Aghapour, Erhan Bayraktar, Asaf Cohen

2026-05-07 45
cs.LG 2605.04747

Knowledge-Free Correlated Agreement for Incentivizing Federated Learning

Introduces Knowledge-Free Correlated Agreement (KFCA) to incentivize federated learning without ground truth.

Leon Witt, Togrul Abbasli, Kentaroh Toyoda et al.

2026-05-06 5
cs.LG 2605.04356

Efficiently Aligning Language Models with Online Natural Language Feedback

Proposes online natural language feedback to improve language model alignment via ICL and fine-tuning, achieving up to 35% performance recovery with 50x fewer samples.

Christine Ye, Joe Benton

2026-05-06 55
cs.LG 2605.04217

Jordan-RoPE: Non-Semisimple Relative Positional Encoding via Complex Jordan Blocks

Jordan-RoPE uses complex Jordan blocks for non-semisimple relative positional encoding, outperforming RoPE on WikiText-103.

Yaobo Zhang

2026-05-06 13
cs.LG 2605.03677

Uni-OPD: Unifying On-Policy Distillation with a Dual-Perspective Recipe

Uni-OPD unifies on-policy distillation with dual strategies, boosting multi-task and multi-modal model performance.

Wenjin Hou, Shangpin Peng, Weinong Wang et al.

2026-05-05 33 citations 68
cs.LG 2605.16318

Investigating Action Encodings in Recurrent Neural Networks in Reinforcement Learning

This study compares additive and multiplicative RNN architectures incorporating action embeddings for RL, showing multiplicative models improve efficiency and accuracy.

Matthew Schlegel, Volodymyr Tkachuk, Adam White et al.

2026-05-05 26
cs.LG 2604.28144

Global Optimality for Constrained Exploration via Penalty Regularization

Proposes Policy Gradient Penalty (PGP) for constrained exploration, achieving ε-approximate optimality and feasibility via quadratic regularization.

Florian Wolf, Ilyas Fatkhullin, Niao He

2026-05-01 40
cs.LG 2604.27166

Distributional Alignment Games for Answer-Level Fine-Tuning

Proposes a distributional alignment game framework for answer-level fine-tuning, utilizing GRPO for efficient training, achieving significant performance gains.

Mehryar Mohri, Jon Schneider, Yifan Wu

2026-04-30 63
cs.LG 2604.26573

PAINT: Partial-Solution Adaptive Interpolated Training for Self-Distilled Reasoners

PAINT integrates adaptive partial solution masking and sparse energy interpolation, boosting self-distilled reasoning performance.

Zhiquan Tan, Yinrong Hong

2026-04-29 46
cs.LG 2604.24708

Scalable Hyperparameter-Divergent Ensemble Training with Automatic Learning Rate Exploration for Large Models

Proposes HDET method to improve optimization quality and generalization of large models via automatic learning rate exploration.

Hailing Cheng, Tao Huang, Chen Zhu et al.

2026-04-28 194
cs.LG 2604.24555

Efficient learning by implicit exploration in bandit problems with side observations

Efficient learning by implicit exploration in bandit problems with side observations, achieving near-optimal regret guarantees.

Tomas Kocak, Gergely Neu, Michal Valko et al.

2026-04-27 140 citations 293
cs.LG 2604.24005

TCOD: Exploring Temporal Curriculum in On-Policy Distillation for Multi-turn Autonomous Agents

TCOD employs a progressive trajectory length schedule to stabilize on-policy distillation in multi-turn autonomous agents, boosting success rate by up to 18 points.

Jiaqi Wang, Wenhao Zhang, Weijie Shi et al.

2026-04-27 22 citations 42
cs.LG 2604.23765

Necessary and sufficient conditions for universality of Kolmogorov-Arnold networks

Kolmogorov-Arnold Networks achieve universality with a single non-affine function.

Vugar Ismailov

2026-04-26 187
cs.LG 2604.23003

Collocation-based Robust Physics Informed Neural Networks for time-dependent simulations of pollution propagation under thermal inversion conditions on Spitsbergen

Proposed a Collocation-based Robust Physics-Informed Neural Network (CRVPINN) for simulating pollution propagation under thermal inversion conditions on Spitsbergen.

Leszek Siwik, Maciej Sikora, Natalia Leszczyńska et al.

2026-04-25 331
Prev 1 ... 21 22 23 24 25 26 27 ... 97 Next

© 2026 GptGet.net - Paper Insights Platform

Paper List Submit Paper Help GptGet Home