GptGet
Features PaperForge Apps Papers Blog Contact AI Chat 中文
Sort: Latest Popular Citations
All Artificial Intelligence Computation and Language Computer Vision Information Retrieval Machine Learning Machine Learning (Stats) Neural and Evolutionary Computing Robotics
cs.AI 2605.02592

Foundation-Model-Based Agents in Industrial Automation: Purposes, Capabilities, and Open Challenges

Foundation-model-based industrial agents leverage large language models for autonomous decision-making, enhancing human interaction (+37%) and uncertainty handling (+35%).

Vincent Henkel, Felix Gehlhoff, David Kube et al.

2026-05-04 45
cs.AI 2605.01507

MILD: Mediator Agent System with Bidirectional Perception and Multi-Layered Alignment for Human-Vehicle Collaboration

MILD integrates bidirectional perception and multi-layered alignment with ECPO optimization for human-vehicle collaboration.

Jiyao Wang, Yunbiao Wang, Yubo Jiao et al.

2026-05-02 50
cs.AI 2605.01338

DiagramNet: An End-to-End Recognition Framework and Dataset for Non-Standard System-Level Diagrams

DiagramNet employs multi-stage training and a decoupled multi-agent workflow to achieve superior system-level diagram recognition, outperforming GPT-5 and industry benchmarks.

Jincheng Lou, Ruohan Xu, Jiapeng Li et al.

2026-05-02 49
cs.AI 2605.00642

Learn where to Click from Yourself: On-Policy Self-Distillation for GUI Grounding

GUI-SD introduces on-policy self-distillation with visual privileged context and entropy-guided loss, boosting GUI grounding accuracy to 68.4% and training speed 4× faster.

Yan Zhang, Daiqing Wu, Huawen Shen et al.

2026-05-01 7 citations 59
cs.AI 2604.27955

GUI Agents with Reinforcement Learning: Toward Digital Inhabitants

This paper introduces a reinforcement learning framework for GUI agents, categorized into offline, online, and hybrid strategies, emphasizing reward engineering and data efficiency.

Junan Hu, Jian Liu, Jingxiang Lai et al.

2026-04-30 47
cs.AI 2604.27859

Rethinking Agentic Reinforcement Learning In Large Language Models

Proposes an agentic RL framework for LLMs integrating meta-reasoning, multi-step planning, and external tools, achieving 50% improvement on complex tasks.

Fangming Cui, Ruixiao Zhu, Cheng Fang et al.

2026-04-30 52
cs.AI 2604.27151

Step-level Optimization for Efficient Computer-use Agents

Proposed event-driven step-level cascade framework improves efficiency, achieving 58.2% success rate.

Jinbiao Wei, Kangqi Ni, Yilun Zhao et al.

2026-04-30 7
cs.AI 2604.26644

When to Vote, When to Rewrite: Disagreement-Guided Strategy Routing for Test-Time Scaling

Proposed a disagreement-guided strategy routing method, improving mathematical reasoning accuracy by 3%-7%.

Zhimin Lin, Yixin Ji, Jinpeng Li et al.

2026-04-29 31
cs.AI 2604.24697

Can Current Agents Close the Discovery-to-Application Gap? A Case Study in Minecraft

SciCrafter evaluates AI's discovery-to-application ability in Minecraft; current models achieve only 26% success.

Zhou Ziheng, Huacong Tang, Jinyuan Zhang et al.

2026-04-28 230
cs.AI 2604.23878

ZenBrain: A Neuroscience-Inspired 7-Layer Memory Architecture for Autonomous AI Systems

ZenBrain is a 7-layer neuroscience-inspired memory architecture integrating 15 mechanisms, significantly improving QA and cross-session reasoning with 91.3% oracle accuracy at 1/106 query cost.

Alexander Bering

2026-04-27 1 citations 38
cs.AI 2604.22597

Rethinking Math Reasoning Evaluation: A Robust LLM-as-a-Judge Framework Beyond Symbolic Rigidity

Proposes an LLM-based evaluation framework to enhance math reasoning assessment accuracy beyond symbolic math limitations.

Erez Yosef, Oron Anschel, Shunit Haviv Hakimi et al.

2026-04-24 242
cs.AI 2604.22436

AgentSearchBench: A Benchmark for AI Agent Search in the Wild

AgentSearchBench improves agent search ranking quality using execution signals, bridging the gap between semantics and performance.

Bin Wu, Arastun Mammadli, Xiaoyu Zhang et al.

2026-04-24 188
cs.AI 2604.19689

A-MAR: Agent-based Multimodal Art Retrieval for Fine-Grained Artwork Understanding

A-MAR framework enhances multimodal art retrieval explanation quality through structured reasoning plans.

Shuai Wang, Hongyi Zhu, Jia-Hong Huang et al.

2026-04-22 2 citations 264
cs.AI 2604.19638

SafetyALFRED: Evaluating Safety-Conscious Planning of Multimodal Large Language Models

SafetyALFRED evaluates safety planning in multimodal LLMs in kitchen settings, finding good hazard recognition but low risk mitigation success.

Josue Torres-Fonseca, Naihao Deng, Yinpei Dai et al.

2026-04-22 275
cs.AI 2604.19301

Large Language Models Exhibit Normative Conformity

Large language models exhibit normative conformity, revealing underlying mechanisms.

Mikako Bito, Keita Nishimoto, Kimitaka Asatani et al.

2026-04-21 3 citations 205
cs.AI 2604.18584

MathNet: a Global Multimodal Benchmark for Mathematical Reasoning and Retrieval

MathNet provides a global multimodal benchmark for mathematical reasoning and retrieval, covering 30,676 Olympiad-level problems from 47 countries.

Shaden Alshammari, Kevin Wen, Abrar Zainal et al.

2026-04-21 1 citations 227
cs.AI 2604.18576

Agentic Forecasting using Sequential Bayesian Updating of Linguistic Beliefs

BLF system achieves state-of-the-art binary forecasting performance on ForecastBench using sequential Bayesian updating of linguistic beliefs.

Kevin Murphy

2026-04-21 5 citations 576
cs.AI 2604.18543

ClawEnvKit: Automatic Environment Generation for Claw-Like Agents

ClawEnvKit automates environment generation for claw-like agents, reducing costs by 13,800x.

Xirui Li, Ming Li, Derry Xu et al.

2026-04-21 4 citations 195
cs.AI 2604.17708

Co-evolving Agent Architectures and Interpretable Reasoning for Automated Optimization

Proposes EvoOR-Agent, a co-evolution framework optimizing reasoning paths and architectures, achieving 15% performance gains on heterogeneous benchmarks.

Jiahao Huang, Peilan Xu, Xiaoya Nan et al.

2026-04-20 43
cs.AI 2604.17308

SkillFlow:Benchmarking Lifelong Skill Discovery and Evolution for Autonomous Agents

SkillFlow benchmark demonstrates 8.43% improvement in task success via lifelong skill evolution, using a dual-agent iterative framework.

Ziao Zhang, Kou Shi, Shiting Huang et al.

2026-04-19 34
Prev 1 ... 19 20 21 22 23 24 25 ... 45 Next

© 2026 GptGet.net - Paper Insights Platform

Paper List Submit Paper Help GptGet Home