SubSplat: High-Resolution Pixel-aligned 3DGS via Sub-pixel Gaussian Reparameterization
SubSplat用SPGR在低分辨率输入下实现高分辨率3DGS,RealEstate10K达25.52dB。
Jiun Lee, Jaekwang Kim, Sangmin Lee
SubSplat用SPGR在低分辨率输入下实现高分辨率3DGS,RealEstate10K达25.52dB。
Jiun Lee, Jaekwang Kim, Sangmin Lee
Axolotl3D结合多模态输入,实现高保真、多视角、多遮挡条件下的3D形状补全。
Anita Hu, Maria Shugrina
提出Masked Topology Modeling(MTM)用于CAD B-rep的自监督预训练,显著提升几何理解能力。
Heinrich Jiang, Jennifer Jang
提出PerceptDrive,通过自适应专家路由融合感知先验,实现端到端自主驾驶,达90.4 PDMS。
Yushan Liu, Tianxiong Lv, Bohua Wang 等
ENTRAP-VL通过双模态探针研究视觉语言模型中的上下文同步,提供1,500项数据集。
Karan Goyal, Afreen Hossain, Debojyoti Das 等
提出CAMA-BC,通过多层多模态对齐提升视频和语境感知的背后反应预测性能。
Min-Jae Kim, Jun-Yeong Moon, Mujeen Sung 等
引入Trace环境,通过场景语法和任务程序实现多域视觉推理,提升模型迁移能力。
Md Tanvirul Alam
提出基于大视图合成模型的多视角全景分割,利用隐式对应关系实现无3D重建的标签传递。
Kwonyoung Ryu, In-Jae Lee, Jonghyun Jin 等
Detectors for AI-generated video are evaluated offline. A clip is decoded to pixels and scored once, increasingly by a large vision-language model. Detection, however, is deployed online. We recast th
Mert Onur Cakiroglu, Mehmet Dalkilic, Hasan Kurban
本文提出基于黎曼流匹配的潜在空间方法,利用VGGT的高维超球面结构实现3D场景生成,性能优于现有基线。
Lisa Weijler, Irene Ballester, Guofeng Mei 等
COPD通过对比教学信号提升学生模型的推理效率,减少推理长度。
Jiacheng Ruan, Jun Tang, Wenzhen Yuan 等
Self-SiMS以视频自相似性生成片段,在QVHighlights测试集[email protected]达42.2%。
Jihyun Lee, Cheol-Ho Cho, Woojin Jun 等
本研究提出基于预训练感知模型的单视图3D重建框架,显著提升重建精度。
Y Huynh, Duc Thanh Nguyen, Mohamed Abdelrazek
提出“光场凝聚”PCon,结合多阶段重建实现高保真场景模型,精准测量损伤细节。
Brevin Tilmon, Alex DeJournett, John Leffingwell 等
SciForma以M-DPO和结构清单提升科学图示的组件、箭头与文本一致性,SciForma-9B超越开源基线及GPT-Image-1.5。
Yuxuan Luo, Peng Zhang, Xinjie Zhang 等
提出未来状态条件化VLN(FSC-VLN),通过训练引导模型预测未来视觉状态,提升长远导航性能。
Lingfeng Zhang, Zhanguang Zhang, Liheng Ma 等
MoGe-3通过自引导稀疏体积优化显著提升单目几何估计的细节精度,解决薄结构失真问题。
Lingyu Kong, Ruicheng Li, Ruicheng Wang 等
FF-ProCams采用前馈高斯反演,结合Mamba2-Transformer编码,实现实时多视角投影场景重建。
Ziyao Wang, Yuqi Li, Wenxing Zheng 等
ShotPlan利用可学习的规划Token实现电影级多镜头视频生成,控制帧级转场,显著优于现有方法。
Su Guo, Guangce Liu, Haosen Yang 等
ConsiSpace通过几何一致性提升视频空间推理,平均提升12.6分。
Ting Huang, Zhenyu Zhang, Wenyuan Huang 等