排序: 最新 热门 引用
cs.LG 2407.04622

On scalable oversight with weak LLMs judging strong LLMs

本文提出以辩论(debate)作为可扩展监督协议,通过弱LLMs评判强LLMs,实验证明辩论在信息不对称任务中优于咨询,提升判别准确率。

Zachary Kenton, Noah Y. Siegel, János Kramár 等

2024-07-06 102 引用 44