排序: 最新 热门 引用
cs.CL 2401.10020

Self-Rewarding Language Models

提出自我奖励语言模型,通过迭代DPO训练,Llama 2 70B在AlpacaEval 2.0中超越Claude 2、Gemini Pro和GPT-4 0613。

Weizhe Yuan, Richard Yuanzhe Pang, Kyunghyun Cho 等

2024-01-18 693 引用 29
cs.CV 2401.09414

Vlogger: Make Your Dream A Vlog

Vlogger结合大模型与扩散模型,实现长视频vlog自动生成,达5分钟,保持脚本与演员一致。

Shaobin Zhuang, Kunchang Li, Xinyuan Chen 等

2024-01-18 25