排序: 最新 热门 引用
cs.CL 2004.02644

Sparse Text Generation

采用entmax训练采样,解决训练与测试不匹配问题,实现更高多样性和一致性。

Pedro Henrique Martins, Zita Marinho, André F. T. Martins

2020-04-06 66
cs.CL 2003.07892

Calibration of Pre-trained Transformers

本研究评估BERT和RoBERTa的校准性,采用温度缩放和标签平滑显著改善内外域校准。

Shrey Desai, Greg Durrett

2020-03-18 54
cs.CL 1911.12543

How Can We Know What Language Models Know?

通过自动生成高质量提示词(包括挖掘和释义方法)提升语言模型知识检索准确率,从31.1%提升至39.6%。

Zhengbao Jiang, Frank F. Xu, Jun Araki 等

2019-11-28 55