AutoPP: Towards Automated Product Poster Generation and Optimization
AutoPP通过统一设计和元素渲染实现自动生成与优化产品海报,利用IDPO提升CTR。
Jiahao Fan, Yuxin Qin, Wei Feng 等
AutoPP通过统一设计和元素渲染实现自动生成与优化产品海报,利用IDPO提升CTR。
Jiahao Fan, Yuxin Qin, Wei Feng 等
Co-GRPO通过联合优化模型和推理计划,提升了MDM的生成质量。
Renping Zhou, Zanlin Ni, Tianyi Chen 等
GeCo通过融合运动和深度先验,提供几何一致性评估,揭示视频生成中的失真和遮挡不一致。
Leslie Gu, Junhwa Hur, Charles Herrmann 等
采用Transformer模型分析塞内加尔低资源语言的NLP进展,识别数据缺口与未来方向。
Derguene Mbaye, Tatiana D. P. Mbengue, Madoune R. Seye 等
kooplearn是一个与scikit-learn兼容的库,用于学习演化算子,支持线性、核和深度学习估计器。
Giacomo Turri, Grégoire Pacreau, Giacomo Meanti 等
LookPlanGraph通过VLM图增强实现动态环境中的指令跟随,提升任务成功率。
Anatoly O. Onishchenko, Alexey K. Kovalev, Aleksandr I. Panov
Axlerod结合NLP和RAG技术,提升保险代理信息检索准确率至93.18%,缩短搜索时间2.42秒。
Adam Bradley, John Hastings, Khandaker Mamun Ahmed
基于ALE方法的新变量重要性评估方法,解决高相关性变量的解释偏差问题,计算效率显著提升。
Jingyu Zhu, Daniel W. Apley
本文系统综述基于大语言模型的智能软件问题解决方法,分析242篇相关研究,强调强化学习的应用。
Zhonghao Jiang, David Lo, Zhongxin Liu
提出GateBreaker,基于门控分析的无训练轻量化攻击框架,有效破坏MoE大模型安全对齐,成功率达64.9%。
Lichao Wu, Sasha Behrouzi, Mohamadreza Rostami 等
提出AutoHet系统实现异构GPU上3D并行,优化设备分组和负载平衡,提升训练速度。
Yuxiao Wang, Yuedong Xu, Qingyang Duan 等
TS-Arena通过预注册协议实现实时预测,避免信息泄露,验证TSFMs的泛化能力。
Marcel Meyer, Sascha Kaltenpoth, Henrik Albers 等
SemanticGen通过在语义空间生成视频,提升长视频生成速度与质量,采用双阶段Diffusion模型。
Jianhong Bai, Xiaoshi Wu, Xintao Wang 等
本研究首次系统分析视频扩散Transformer(DiT)特征在点追踪中的鲁棒性,发现其优于ResNet,提出DiTracker实现高效零样本追踪。
Soowon Son, Honggyu An, Jisu Nam 等
提出基于卡尔曼滤波的单目VIO漂移校正与感知规划,提升无人机竞赛性能。
Maulana Bisyir Azhari, Donghun Han, Je In You 等
提出QCU-Net,结合量子操作与扩散模型,用于生成高质量标注遥感影像,显著提升生成效果。
Francesco Mauro, Francesca De Falco, Lorenzo Papa 等
CRAFT框架通过连续推理和反馈调优显著提升多模态文本到图像生成的准确性和可控性。
V. Kovalev, A. Kuvshinov, A. Buzovkin 等
提出ActionFlow系统框架,通过跨请求流水线策略显著提升边缘设备上VLA模型FPS达2.55倍,无需重训练。
Yuntao Dai, Hang Gu, Teng Wang 等
DDAVS通过音频语义解耦和延迟双向对齐实现音视频分割,在AVS-Objects和VPO基准上表现优异。
Jingqi Tian, Yiheng Du, Haoji Zhang 等
Memory-T1利用强化学习实现多会话中的时间感知记忆选择,提升长对话的推理能力。
Yiming Du, Baojun Wang, Yifan Xiang 等