IndexCache: Accelerating Sparse Attention via Cross-Layer Index Reuse
IndexCache accelerates sparse attention by reusing cross-layer indices, reducing 75% of computations, achieving 1.82x speedup.
Yushi Bai, Qian Dong, Ting Jiang et al.
IndexCache accelerates sparse attention by reusing cross-layer indices, reducing 75% of computations, achieving 1.82x speedup.
Yushi Bai, Qian Dong, Ting Jiang et al.
Introduced a Polish long-context encoder model handling up to 8192 tokens, significantly improving long-document task performance.
Sławomir Dadas, Rafał Poświata, Marek Kozłowski et al.
ComFree-Sim is a GPU-parallelized contact physics engine achieving near-linear scaling in contact-rich scenarios, with 2-3x throughput improvement.
Chetan Borse, Zhixian Xie, Wei-Cheng Huang et al.
Quantifies forgetting in generative models post-training using forward and reverse KL objectives, avoiding quality degradation.
Krishnakumar Balasubramanian, Shiva Prasad Kasiviswanathan
LifeSim simulates user cognition via BDI model to enhance personalized assistant evaluation.
Feiyu Duan, Xuanjing Huang, Zhongyu Wei
FlashMotion introduces a three-stage training framework combining diffusion and adversarial objectives, achieving 47× faster controllable video generation with high quality.
Quanhao Li, Zhen Xing, Rui Wang et al.
O3N framework achieves state-of-the-art performance on QuadOcc and Human360Occ benchmarks using polar-spiral topology for 360° spatial representation.
Mengfei Duan, Hao Shi, Fei Teng et al.
HATS employs hardness-aware trajectory synthesis, enhancing GUI agents' generalization in ambiguous interactions.
Rui Shao, Ruize Gao, Bin Xie et al.
Proposed dynamic modeling and gravity compensation for dVRK-Si PSM, reducing joint errors by 68-84%.
Haoying Zhou, Hao Yang, Brendan Burkhart et al.
Introduced UniCAC benchmark to evaluate 24 algorithms under various optical aberrations.
Xiaolong Qian, Qi Jiang, Yao Gao et al.
Node-RF integrates Neural ODE with NeRF for continuous-time scene dynamics, achieving superior long-range extrapolation and generalization.
Hiran Sarkar, Liming Kuang, Yordanka Velikova et al.
Proposed a decentralized cooperative localization framework with asynchronous sensor fusion, achieving 34% RMSE reduction.
Nivand Khosravi, Niusha Khosravi, Mohammad Bozorg et al.
SNAP-V: A RISC-V SoC optimized for small-scale SNN inference, average synaptic energy 1.05 pJ.
Kanishka Gunawardana, Sanka Peeris, Kavishka Rambukwella et al.
EnTransformer combines Transformer with engression for superior multivariate probabilistic forecasting.
Rajdeep Pathak, Rahul Goswami, Madhurima Panja et al.
Modeling trial-and-error navigation using a sequential decision model of information scent under memory constraints.
Xiaofu Jin, Yunpeng Bai, Antti Oulasvirta
Using sparse 3D hand joints with occlusion-aware features, this method enhances egocentric video generation fidelity and control.
Chenyangguang Zhang, Botao Ye, Boqi Chen et al.
Stable Spike achieves dual consistency optimization via bitwise AND operations, enhancing SNN recognition performance under ultra-low latency by up to 8.33%.
Yongqi Ding, Kunshan Yang, Linze Li et al.
Shape-of-You (SoY) employs fused Gromov-Wasserstein optimal transport with 3D geometric priors, achieving state-of-the-art semantic correspondence without explicit annotations.
Jiin Im, Sisung Liu, Je Hyeong Hong
FedShare framework enhances recommendation performance through personalized data sharing and unlearning.
Liang Qu, Jianxin Li, Wei Yuan et al.
WeEdit employs HTML-generated 330K training pairs, glyph-guided fine-tuning, and multi-objective reinforcement learning for multi-language text editing.
Hui Zhang, Juntao Liu, Zongkai Liu et al.