FireRed-Image-Edit-1.0 Technical Report
FireRed-Image-Edit采用扩散变换器,通过数据优化和多阶段训练实现先进的图像编辑性能。
Super Intelligence Team, Changhao Qiao, Chao Hui 等
FireRed-Image-Edit采用扩散变换器,通过数据优化和多阶段训练实现先进的图像编辑性能。
Super Intelligence Team, Changhao Qiao, Chao Hui 等
本文重新审视单边-高斯子(single-minus gluon)树级振幅,提出在半共线配置和复数动量下非零表达式,导出分段常数闭式公式,验证满足软定理等多重一致性条件。
Alfredo Guevara, Alexandru Lupsasca, David Skinner 等
DreamID-Omni框架实现了可控的人物音视频生成,超越现有商业模型。
Xu Guo, Fulong Ye, Qichao Sun 等
SafeNeuron通过参数冻结和冗余机制提升大模型的安全鲁棒性,显著增强抗参数剪枝攻击能力。
Zhaoxin Wang, Jiaming Liang, Fengbin Zhu 等
FAIL通过对抗训练实现无奖励的流匹配模仿学习,使用13,000示范提升模型性能。
Yeyao Ma, Chen Li, Xiaosong Zhang 等
提出G-OPD框架,通过奖励外推提升学生模型性能,实验显示超越教师模型。
Wenkai Yang, Weijie Liu, Ruobing Xie 等
AssetFormer使用自回归Transformer生成模块化3D资产,提升UGC内容创作质量。
Lingting Zhu, Shengju Qian, Haidi Fan 等
VLAW通过迭代在线交互提高视觉-语言-动作模型性能,成功率提升39.2%。
Yanjiang Guo, Tony Lee, Lucy Xiaoyang Shi 等
提出Composition-RL,通过自动组合多题提升LLM推理能力,实验显示在4B到30B模型中显著优于原始RL。
Xin Xu, Clive Bai, Kai Yang 等
引入Min-kNN距离检测RLVR训练数据,利用结构收敛特征实现黑箱识别。
Hongbo Zhang, Yue Yang, Jianhao Yan 等
ABot-N0采用层次“脑-行动”架构,融合5项导航任务,利用1690万轨迹数据实现SOTA性能。
Zedong Chu, Shichao Xie, Xiaolong Wu 等
LASER用SeqVault+STA/GSTA实现超长序列低延迟CTR建模,线上ADVV+2.36%、收入+2.08%。
Tianhe Lin, Ziwei Xiong, Baoyuan Ou 等
NRT模型通过自生成推理路径提升推理能力,无需外部验证器,显著提升复杂推理任务表现。
Yuanfu Wang, Zhixuan Liu, Xiangtian Li 等
Krause Attention通过局部同步减少注意力下沉,提升性能并降低复杂度。
Jingkun Liu, Yisong Yue, Max Welling 等
AuroraRL利用稀疏参数变化实现去中心化网络中的高效RL训练,减少79倍带宽,提升1.3-9.5倍吞吐。
Chaoyi Ruan, Geng Luo, Xinyi Wan 等
提出检索感知蒸馏方法,仅保留2%注意力头,恢复95%性能。
Aviv Bick, Eric P. Xing, Albert Gu
MDE-VIO结合轻量级深度先验,提升低纹理环境下的视觉惯性里程计精度,ATE降低28.3%。
Arda Alniak, Sinan Kalkan, Mustafa Mert Ankarali 等
提出基于Wasserstein距离的设计特征表征,分析其对贝叶斯优化中决策质量的影响。
Antonio Candelieri, Francesco Archetti
pplx-embed以扩散预训练和多阶段对比学习,4B模型多语nDCG@10达69.66%,上下文模型达81.96%。
Sedigheh Eslami, Maksim Gaiduk, Markus Krimmel 等
提出GameDevBench,评估AI在复杂游戏开发中的多模态能力,成功率为53.8%。
Wayne Chi, Yixiong Fang, Arnav Yayavaram 等