排序: 最新 热门 引用
cs.CL 2209.15189

Learning by Distilling Context

提出“上下文蒸馏”方法,通过合成无标签数据实现模型内部化任务指令、推理步骤和示例,显著提升模型性能。

Charlie Snell, Dan Klein, Ruiqi Zhong

2022-09-30 110 引用 28
cs.CL 2209.15162

Linearly Mapping from Image to Text Space

LiMBeR方法通过线性映射将图像特征转化为文本提示,提升视觉问答性能。

Jack Merullo, Louis Castricato, Carsten Eickhoff 等

2022-09-30 9
cs.AI 2209.15111

Quantifying Harm

提出量化伤害的新定义,结合因果模型和决策理论,评估单人和社会层面伤害。

Sander Beckers, Hana Chockler, Joseph Y. Halpern

2022-09-30 42
cs.LG 2209.11895

In-context Learning and Induction Heads

提出诱导头机制可能主导大模型中的大部分“上下文学习”,通过六条证据支持。

Catherine Olsson, Nelson Elhage, Neel Nanda 等

2022-09-24 48
cs.LG 2209.10652

Toy Models of Superposition

通过 toy 模型揭示神经网络中的超叠加现象,展示相变、几何结构及对抗样本关联。

Nelson Elhage, Tristan Hume, Catherine Olsson 等

2022-09-22 30