Dual-Path LLM Reasoning for Multimodal Few-Shot Knowledge Graph Completion
DuPLeR利用双路径结构推理,结合多模态LLM先验,提升少样本知识图谱补全效果。
Jinlan Liu, Zhiying Tu, Yongchao Xing 等
DuPLeR利用双路径结构推理,结合多模态LLM先验,提升少样本知识图谱补全效果。
Jinlan Liu, Zhiying Tu, Yongchao Xing 等
提出DASH,结合跨域历史和思考轨迹,提升广告用户模拟的决策感知能力。
Zipeng Chen, Jiaer Zheng, Xiangyang Xu 等
StructureGS通过结构引导实现多关节物体的高质量重建,利用OBB约束几何与连接关系。
Gahye Lee, Gyoonseo Kim, Wonjong Jang 等
引入Metis,具备原生记忆能力的基础模型,优化架构与训练,提升长时记忆表现。
Zeyu Zhang, Ziliang Guo, Yihang Sun 等
MPEcho通过引入音素编码器和长度调节器,将SongEcho框架扩展为可控翻唱生成模型,音素错误率降低至18.65%。
Wei-Jaw Lee, Hsuan-Yu Yeh, Ting-Yi Hu 等
本文综述34篇利用生成式大语言模型(LLMs)进行文献检索与筛选的研究,强调模型架构与评估指标。
Eleni Adamidi, Serafeim Chatzopoulos, Thanasis Vergoulis
本文系统分析了有损验证在推测解码中的机制,分类为截断验证和协作验证,揭示其性能陷阱与控制原则。
Tianyu Wang, Yuxuan Zhou, Wenbin Wang 等
CineWeaver无需训练,通过位置编码、注意力、分镜路由和锚点记忆实现长时、多镜头、可控视频生成;摘要未给出数值指标。
Yuyang Huang, Yabo Chen, Wenrui Dai 等
提出MO-SB-NESR方法,改善多输出符号回归的物理一致性。
Manuel Rodriguez
采用梯度、进化和一-shot方法的交通预测NAS,提升模型自动化设计效率。
Truong Giang Vu, Li Yang, Richard W. Pazzi
提出MultivationBench,基于Maslow层级和Reiss欲望模型,评估多模态连续动机推理,模型表现不足。
Kawai Chung, Chunkit Chan, Yauwai Yim 等
StrataCL通过注册即分配实现用户缓冲区直接通信,提升带宽1.6倍,推理吞吐量1.9倍。
Tiancheng Hu, Jin Qin, Yuzheng Wang 等
引入跨分支语义引导,验证理解与生成空间是否统一,发现理解向生成迁移有效,反向效果有限。
Yu Wang, Sharon Li
MoSAIC通过对齐干预监督实现局部运动风格转移,减少错误并提高响应。
Nazanin Amini, Kevin Desai
OpenMarket发布同步的毫秒级Polymarket与Binance数据集,验证高频预测市场的无显著超额收益。
Gregory Young
提出四层系统框架,定义持续安全成功,结合模型、系统、证据与部署层级评估可信度。
Xinyu Yang, Tianxing Chen, Honghao Su 等
MODUS为解码器单一模型,实现任意模态间的多模态预测,支持多任务应用。
Mingqiao Ye, Zhaochong An, Zhitong Gao 等
Meshy T2通过流匹配实现快速本地网格生成,6秒内完成图像到网格转换,几何精度领先。
Jiale Xu, Rendong Liang, Yuhao Long 等
HiSkill通过层次技能图提升LLM代理,成功率提高17.33%,推理token消耗减少78.75%。
Yu Hao, Jinxuan Cai, Qi Zhang 等
使用视频Transformer编码器,研究概念瓶颈模型在心脏超声中的体积编码,发现体积监督可减少误差。
Hyunkyung Han, Min Jung Kim