IndexCache: Accelerating Sparse Attention via Cross-Layer Index Reuse
IndexCache通过跨层索引重用加速稀疏注意力,减少75%计算量,提升1.82倍速度。
Yushi Bai, Qian Dong, Ting Jiang 等
IndexCache通过跨层索引重用加速稀疏注意力,减少75%计算量,提升1.82倍速度。
Yushi Bai, Qian Dong, Ting Jiang 等
提出一种能处理8192个token的波兰语长上下文编码器模型,显著提升长文档任务表现。
Sławomir Dadas, Rafał Poświata, Marek Kozłowski 等
ComFree-Sim是一种基于GPU并行化的接触物理引擎,能在接触密集场景中实现近线性扩展,吞吐量提高2-3倍。
Chetan Borse, Zhixian Xie, Wei-Cheng Huang 等
通过正反向KL目标量化生成模型训练后遗忘,避免质量下降。
Krishnakumar Balasubramanian, Shiva Prasad Kasiviswanathan
LifeSim通过BDI模型模拟用户认知,提升个性化助手评估。
Feiyu Duan, Xuanjing Huang, Zhongyu Wei
FlashMotion采用三阶段训练,结合扩散与对抗,实现少步轨迹控制视频生成,速度提升47倍。
Quanhao Li, Zhen Xing, Rui Wang 等
O3N框架通过极坐标螺旋拓扑实现360°空间表示,在QuadOcc和Human360Occ基准上达到最先进性能。
Mengfei Duan, Hao Shi, Fei Teng 等
HATS通过硬度感知的轨迹合成,提升GUI代理在语义模糊交互中的泛化能力。
Rui Shao, Ruize Gao, Bin Xie 等
提出dVRK-Si PSM的动态建模与重力补偿方法,减少68-84%关节误差。
Haoying Zhou, Hao Yang, Brendan Burkhart 等
提出UniCAC基准,评估24种算法在不同光学像差条件下的表现。
Xiaolong Qian, Qi Jiang, Yao Gao 等
Node-RF结合Neural ODE与NeRF,实现连续时空场景动态预测与泛化。
Hiran Sarkar, Liming Kuang, Yordanka Velikova 等
提出一种异步传感器融合的多机器人系统去中心化协作定位框架,RMSE减少34%。
Nivand Khosravi, Niusha Khosravi, Mohammad Bozorg 等
SNAP-V: 基于RISC-V的SoC,优化小规模SNN推理,平均突触能耗1.05 pJ。
Kanishka Gunawardana, Sanka Peeris, Kavishka Rambukwella 等
EnTransformer结合Transformer与engression,实现多变量概率预测,优于现有模型。
Rajdeep Pathak, Rahul Goswami, Madhurima Panja 等
使用信息气味的序列决策模型模拟试错导航,验证了模型在记忆限制下的有效性。
Xiaofu Jin, Yunpeng Bai, Antti Oulasvirta
利用稀疏3D手关节作为控制信号,提出一种考虑遮挡的高保真视频生成方法。
Chenyangguang Zhang, Botao Ye, Boqi Chen 等
Stable Spike通过位操作实现双重一致性优化,提升SNN在超低延迟下的识别性能,准确率提高至8.33%。
Yongqi Ding, Kunshan Yang, Linze Li 等
本文提出Shape-of-You(SoY)框架,利用融合Gromov-Wasserstein(FGW)优化实现无标注语义对应,达成SOTA性能。
Jiin Im, Sisung Liu, Je Hyeong Hong
FedShare框架通过个性化数据共享和对已共享数据的反向学习,提升推荐系统性能。
Liang Qu, Jianxin Li, Wei Yuan 等
WeEdit通过HTML自动生成330K训练对,结合Glyph引导微调和强化学习,实现多语言文本图像编辑。
Hui Zhang, Juntao Liu, Zongkai Liu 等