排序: 最新 热门 引用
cs.CL 2504.03553

Agentic Knowledgeable Self-awareness

提出KnowSelf实现语言模型的情境自我认知,结合两阶段训练提升规划表现。

Shuofei Qiao, Zhisong Qiu, Baochang Ren 等

2025-04-05 40
cs.CL 2504.02441

Cognitive Memory in Large Language Models

本研究提出多层次记忆机制,结合文本、KV缓存、参数和隐藏状态,提升大模型长时记忆能力。

Lianlei Shan, Shixian Luo, Zezhou Zhu 等

2025-04-03 22
cs.CL 2503.21295

R-PRM: Reasoning-Driven Process Reward Modeling

提出R-PRM,通过强模型生成种子数据和偏好优化,显著提升数学推理步骤评估准确率,F1提升11.9点。

Shuaijie She, Junxiao Liu, Yifeng Liu 等

2025-03-27 48 引用 39
cs.CL 2503.19786

Gemma 3 Technical Report

Gemma 3引入多模态、长上下文(128K tokens)和视觉理解,采用改进架构和蒸馏训练,性能优于Gemma 2。

Gemma Team, Aishwarya Kamath, Johan Ferret 等

2025-03-25 29
cs.CL 2503.17489

Judge Anything: MLLM as a Judge Across Any Modality

本论文提出“JudgeAnything”基准,利用多模态大模型(MLLM)作为跨模态评估工具,涵盖15类任务,评估模型理解与生成能力,显示其在MMU表现优异,但在MMG方面仍存偏差。

Shu Pu, Yaochen Wang, Dongping Chen 等

2025-03-22 33 引用 55