排序: 最新 热门 引用
cs.CL 2505.11820

Chain-of-Model Learning for Language Model

CoLM以链式表示实现渐进扩展与弹性推理,CoLM-Air在1M上下文预填充中最高加速3倍。

Kaitao Song, Xiaohua Wang, Xu Tan 等

2025-05-17 27
cs.CL 2505.09388

Qwen3 Technical Report

Qwen3结合思考与非思考模式,参数规模达235B,提升多语言、多任务性能。

An Yang, Anfeng Li, Baosong Yang 等

2025-05-14 34
cs.CL 2505.02387

RM-R1: Reward Modeling as Reasoning

RM-R1将奖励建模作为推理任务,通过链式推理和Rubrics机制提升性能,超越更大模型。

Xiusi Chen, Gaotang Li, Ziqi Wang 等

2025-05-05 31