排序: 最新 热门 引用
cs.CV 2310.01415

GPT-Driver: Learning to Drive with GPT

GPT-Driver利用GPT-3.5将运动规划转化为语言模型,实现在nuScenes数据集上优异表现,误差仅0.84米。

Jiageng Mao, Yuxi Qian, Junjie Ye 等

2023-10-03 467 引用 40
cs.CV 2309.17444

LLM-grounded Video Diffusion Models

LVD利用大语言模型生成动态场景布局,结合无训练指导的扩散模型实现高质量视频生成。

Long Lian, Baifeng Shi, Adam Yala 等

2023-09-30 36
cs.CL 2309.16609

Qwen Technical Report

Qwen系列语言模型在多项任务中表现优异,特别是Qwen-Chat使用RLHF技术。

Jinze Bai, Shuai Bai, Yunfei Chu 等

2023-09-29 39