排序: 最新 热门 引用
cs.CL 2310.17217

Beyond MLE: Convex Learning for Text Generation

提出凸函数训练目标,提升文本生成模型的输出集中性,改善自动回归和非自动回归模型性能。

Chenze Shao, Zhengrui Ma, Min Zhang 等

2023-10-26 44
cs.CL 2310.10683

Large Language Model Unlearning

大语言模型遗忘技术,通过梯度上升减少不良行为,计算效率高。

Yuanshun Yao, Xiaojun Xu, Yang Liu

2023-10-14 32