GenONet: A Generative operator Network for High-Resolution Precipitation Nowcasting
引入深度算子网络(DeepONet)结合生成对抗网络(GAN)实现高分辨率降水预报,提升长时预测的稳定性与物理一致性。
Mohammad Kian Golkar, Luciano Alves de Oliveira, Mohammad Khanjani
引入深度算子网络(DeepONet)结合生成对抗网络(GAN)实现高分辨率降水预报,提升长时预测的稳定性与物理一致性。
Mohammad Kian Golkar, Luciano Alves de Oliveira, Mohammad Khanjani
StreamScout通过逐步增强时间线视图,提高流媒体视频理解效率,减少59%令牌消耗。
Ce Zhang, Jing Bi, Jinxi He 等
DUPIN通过无监督预训练和少量攻击样本微调,在APT攻击取证中表现出色。
Chanwoo Bae, Hailun Ding, Shiqing Ma 等
引入失效合约协议层,通过版本戳和缓存提示提高缓存建议的有效性和合规性。
Michael Wu, Arquimedes Canedo
ReDeck通过逐步渲染反馈优化幻灯片生成,提升空间准确性和设计质量。
Muzhao Tian, Zezi Zeng, Yifan Yang 等
提出上下文感知交错批处理方法,结合VAD边界稳定WhisperX,显著降低WER并提升专有名词识别。
Carlos Bain, Max Bain
提出BRF-GS,基于3D高斯点云的高光谱双向反射模型与图像生成,结合混合BRDF核实现复杂方向性反射。
Yiling Yao, Wenjuan Zhang, Bowen Wang 等
DreamX-Creator采用Gated Cross-Modal Attention实现7B模型的2K原生同步音视频生成。
Jiashu Zhu, Yanhao Zheng, Ruitian Tian 等
ECCBench评估视觉语言模型的记忆能力,超越准确性。
Shmuel Berman, Jia Deng
提出自适应结构化未结构化数据的代理式数据破解,显著降低推理成本。
Milad Rezaei Hajidehi, Qitong Wang, Stratos Idreos
本研究发现对比偏好优化中的教师模型会无意中传递谄媚行为,影响模型对抗性。
Camila Blank, Zhuofan Ying, Christopher Potts 等
AutoSciRub通过自动诱导任务特定的可执行评分标准,提升科研代理的评估与改进能力。
Xuehai Wang, Haowei Qin, Tongxin Liu 等
知识对齐的监督微调减少幻觉,提升事实性。
Arthur Becker, Jakob Kemmler, David Thulke 等
提出一种基于音频的对抗性防御方法,保护3D说话人脸生成的视觉保真度。
Rui-Qing Sun, Chen-Hao Cui, Hui-Yang Zhao 等
LightNav-0利用预训练VLM的空间推理能力,通过统一的点指令和残差量化轨迹,实现多任务通用机器人导航。
Shaoan Wang, Aocheng Luo, Fei Huang 等
Zeva通过在上下文中学习因果关系,实现机器人无需参数更新的自我演化,提升操控成功率。
Fu Chen, Xin Ding, Bingjia Huang 等
提出基于状态信息的去中心化应急MPC,确保安全与收敛,适应有限感知。
Max Studt, Georg Schildbach
AVENUE通过1,291个片段和7,957条编辑指令,评估音视频编辑模型的选择性编辑能力。
Hayeon Kim, Yoojin Jang, Jaejun Yoo
SocialReasonBench通过分支叙事视频评估社交推理能力,揭示LMMs在反事实推理上的不足。
Zheyu Huang, Zijing Shi, Haozhe Luo 等
液体门控注意力(LGA)通过输入驱动的门控机制实现连续时间建模,具有线性时间复杂度。
Yiheng Jiang, Yuanbo Xu, Yongjian Yang