排序: 最新 热门 引用
cs.CY 2601.23112

How Should AI Safety Benchmarks Benchmark Safety?

提出基于风险管理原则的AI安全基准改进策略,涵盖210个评估工具,强调测量的概率性和有效性。

Cheng Yu, Severin Engelmann, Ruoxuan Cao 等

2026-01-30 40
cs.CL 2601.21968

OVD: On-policy Verbal Distillation

提出OVD:基于轨迹匹配的对策,显著降低内存消耗,提升Web问答和数学推理性能。

Jing Xiong, Hui Shen, Shansan Gong 等

2026-01-30 56