排序: 最新 热门 引用
cs.CL 2601.21968

OVD: On-policy Verbal Distillation

提出OVD:基于轨迹匹配的对策,显著降低内存消耗,提升Web问答和数学推理性能。

Jing Xiong, Hui Shen, Shansan Gong 等

2026-01-30 44
cs.CL 2601.20757

Persona Prompting as a Lens on LLM Social Reasoning

本文提出Persona Prompting(PP)方法,分析其在LLMs社会推理中的影响,涉及偏见、合理性与任务性能,基于hate speech等数据集。

Jing Yang, Moritz Hechtbauer, Elisabeth Khalilov 等

2026-01-29 58