Complexity as Advantage: A Regret-Based Perspective on Emergent Structure
提出复杂性即优势(CAA)框架,通过观察者的预测遗憾来定义复杂性。
Oshri Naparstek
提出复杂性即优势(CAA)框架,通过观察者的预测遗憾来定义复杂性。
Oshri Naparstek
提出软约束最优传输方法,逼近Knothe-Rosenblatt映射,确保收敛性。
Ricardo Baptista, Franca Hoffmann, Minh Van Hoang Nguyen 等
提出“用视频思考”范式,利用Sora-2模型实现多模态推理,涵盖Vision和Text任务,准确率达92%(MATH)和69.2%(MMMU)。
Jingqi Tong, Yurong Mou, Hangcheng Li 等
批量提示有效抑制大规模推理模型的过度思考,减少76%推理令牌。
Saurabh Srivastava, Janit Bidhan, Hao Yan 等
本文比较LCR与Vendi Score两种感知相似性熵,基于53个大规模数据集分析差异。
Phuc Nguyen, Josiah Couch, Rahul Bansal 等
引入LiveTradeBench,用大模型进行实时多资产交易评估,揭示静态测试与实际表现差距。
Haofei Yu, Fenghai Li, Jiaxuan You
MUTANT通过两阶段训练和语言感知预处理,显著提升多语种Tokenizer性能,降低Fertility达39.5%。
Souvik Rana, Arul Menezes, Ashish Kulkarni 等
miniF2F-v2显著提高了自动化证明的准确性,达到70%。
Azim Ospanov, Farzan Farnia, Roozbeh Yousefzadeh
PublicAgent采用多智能体架构,基于LLM实现开放数据分析,验证五项设计原则。
Sina Montazeri, Yunhe Feng, Kewei Sha
TWIST2系统结合PICO4U VR实现无摩擦全身人形机器人远程控制与数据采集,成功实现长时长高成功率示范。
Yanjie Ze, Siheng Zhao, Weizhuo Wang 等
提出Lookahead Unmasking(LookUM),通过路径选择提升扩散语言模型的解码准确率,节省计算资源。
Sanghyun Lee, Seungryong Kim, Jongho Park 等
DoFlow利用连续归一流(CNF)结合因果DAG实现时间序列的观察、干预与反事实预测。
Dongze Wu, Feng Qiu, Yao Xie
提出基于隐马尔可夫模型(HMM)和切换线性动力系统(sLDS)的结构化世界模型框架,支持被动预测与主动控制。
Lancelot Da Costa, Sanjeev Namjoshi, Mohammed Abbas Ansari 等
Wonder3D++利用跨域扩散模型,从单图高效生成高细节3D网格,融合多视角法线与色彩信息。
Yuxiao Yang, Xiao-Xiao Long, Zhiyang Dou 等
AlphaEvolve结合LLM与自动评估,自动发现数学构造,解决67个分析、几何等问题。
Bogdan Georgiev, Javier Gómez-Serrano, Terence Tao 等
提出Viewpoint学习,通过两阶段微调激活多模态大模型的空间推理能力,利用Viewpoint-100K数据集实现显著提升。
Xiaoyu Zhan, Wenxuan Huang, Hao Sun 等
ExplicitLM通过百万级外部记忆库实现知识解耦,提升知识任务性能43.67%。
Chengzhang Yu, Zening Lu, Chenyang Zheng 等
LiCoMemory结合CogniGraph实现轻量化、层次化的长时记忆,提升推理效率。
Zhengjun Huang, Zhoujin Tian, Qintian Guo 等
使用GPT-4o模型提升音频理解和生成能力,显著提高音频交互表现。
Siyin Wang, Zengrui Jin, Changli Tang 等
MotionStream实现单GPU实时视频生成,达29FPS,结合运动控制与长视频推断技术。
Joonghyuk Shin, Zhengqi Li, Richard Zhang 等