Enhancing Chat Language Models by Scaling High-quality Instructional Conversations
Scaling a 1.5M multi-turn instruction dataset UltraChat and fine-tuning LLaMA-13B yields UltraLLaMA, outperforming Vicuna with a 9.02/10 score.
Ning Ding, Yulin Chen, Bokai Xu et al.