Aladdin: Zero-Shot Hallucination of Stylized 3D Assets from Abstract Scene Descriptions
利用基础模型实现零-shot风格化3D资产生成,无需详细对象描述。
Ian Huang, Vrishab Krishna, Omoruyi Atekha 等
利用基础模型实现零-shot风格化3D资产生成,无需详细对象描述。
Ian Huang, Vrishab Krishna, Omoruyi Atekha 等
Prodigy算法通过自适应估计D值优化学习率,实验表明其性能优于D-Adaptation,接近手动调参的Adam。
Konstantin Mishchenko, Aaron Defazio
Mind2Web是首个涵盖137个真实网站、2000余任务的多域数据集,利用小型和大型语言模型实现网页任务执行。
Xiang Deng, Yu Gu, Boyuan Zheng 等
提出AdaBatAL方法,通过自适应批量大小提高主动学习效率,显著提升贝叶斯优化性能。
Masaki Adachi, Satoshi Hayakawa, Martin Jørgensen 等
REMEMBERER框架通过长期经验记忆提升LLM的强化学习能力,成功率提高4%。
Danyang Zhang, Lu Chen, Situo Zhang 等
MusicGen采用单阶段Transformer模型,通过编码器-解码器架构,结合多流离散音乐表示,实现文本和旋律条件下高质量音乐生成。
Jade Copet, Felix Kreuk, Itai Gat 等
提出基于超网络的可控多目标重排序框架(CMR),实现在线偏好调节,提升推荐效果。
Sirui Chen, Yuan Wang, Zijing Wen 等
PandaLM为LLM指令调优设计的自动评估基准,结合多维主观指标,达成93.75% GPT-3.5评估能力。
Yidong Wang, Zhuohao Yu, Zhengran Zeng 等
系统评估扩散模型的感知真实性,发现现有指标与人类评价偏差,提出DINOv2-ViT-L/14作为更优特征提取器。
George Stein, Jesse C. Cresswell, Rasa Hosseinzadeh 等
本文提出变换器可实现多种机器学习算法的端到端理论,包括岭回归、Lasso等,并具备在不同任务间自适应选择算法的能力。
Yu Bai, Fan Chen, Huan Wang 等
RotorPy是用Python开发的多旋翼飞行器模拟器,包含空气动力学模型,适用于教育与研究。
Spencer Folk, James Paulos, Vijay Kumar
M$^3$IT数据集优化视觉语言模型,含40个数据集和80种语言。
Lei Li, Yuwei Yin, Shicheng Li 等
提出改进的三相不平衡网络梯级OPF算法,提升电压安全性,实验在IEEE 123节点测试中验证。
Heng Liang, Xinyang Zhou, Changhong Zhao
本文提出基于随机枢轴Cholesky的核求积新算法,误差率接近最优,计算速度显著提升。
Ethan N. Epperly, Elvira Moreno
本研究提出DIFT,利用预训练扩散模型的隐含特征,无需监督即可实现语义、几何和时序对应,超越弱监督方法。
Luming Tang, Menglin Jia, Qianqian Wang 等
RAM模型通过大规模图像-文本对训练,实现高精度零样本图像标注。
Youcai Zhang, Xinyu Huang, Jinyu Ma 等
基于推导和归纳的ABM模型,分析社会影响下态度变化机制。
Yun-Shiuan Chuang, Timothy T. Rogers
提出推理时干预(ITI)技术,通过调整有限注意头激活,显著提升LLaMA模型在TruthfulQA上的真实性,从32.5%到65.1%。
Kenneth Li, Oam Patel, Fernanda Viégas 等
利用ChatGPT和BLIP-2提升OSM道路标签准确率,最高提升29%。
Levente Juhász, Peter Mooney, Hartwig H. Hochmair 等
CMExam是首个提供全面医学标注的中文医学考试数据集,GPT-4在该数据集上达到61.6%的准确率。
Junling Liu, Peilin Zhou, Yining Hua 等