排序: 最新 热门 引用
cs.CL 2210.03070

Toxicity in Multilingual Machine Translation at Scale

本研究分析多语种机器翻译中的添加毒性,采用HOLISTICBIAS数据集和ALTI+解释方法,发现低资源语言和特定人口轴易出现毒性。

Marta R. Costa-jussà, Eric Smith, Christophe Ropers 等

2022-10-07 43
cs.CL 2209.15189

Learning by Distilling Context

提出“上下文蒸馏”方法,通过合成无标签数据实现模型内部化任务指令、推理步骤和示例,显著提升模型性能。

Charlie Snell, Dan Klein, Ruiqi Zhong

2022-09-30 110 引用 26
cs.CL 2209.15162

Linearly Mapping from Image to Text Space

LiMBeR方法通过线性映射将图像特征转化为文本提示,提升视觉问答性能。

Jack Merullo, Louis Castricato, Carsten Eickhoff 等

2022-09-30 0
cs.CL 2209.02535

Analyzing Transformers in Embedding Space

提出Embedding空间参数解释框架,支持GPT-2参数零样本对齐与迁移,验证模型在嵌入空间的可解释性。

Guy Dar, Mor Geva, Ankit Gupta 等

2022-09-06 27
cs.CL 2207.10397

CodeT: Code Generation with Generated Tests

CodeT利用预训练模型自动生成测试用例,通过双重执行一致性显著提升代码解决方案选择性能。

Bei Chen, Fengji Zhang, Anh Nguyen 等

2022-07-21 607 引用 40
cs.CL 2207.07061

Confident Adaptive Language Modeling

提出自信自适应语言建模(CALM),在减少计算量的同时保持高性能,速度提高达3倍。

Tal Schuster, Adam Fisch, Jai Gupta 等

2022-07-15 5