cs.CV 2601.03233

LTX-2: Efficient Joint Audio-Visual Foundation Model

LTX-2 employs an asymmetric dual-stream Transformer with 14B (video) and 5B (audio) parameters, integrating cross-modal attention for synchronized audiovisual generation.

Yoav HaCohen, Benny Brazowski, Nisan Chiprut et al.

2026-01-07 168 citations 36
cs.CL 2601.01972

Hidden State Poisoning Attacks against Mamba-based Language Models

Introduces Hidden State Poisoning Attacks (HiSPA) against Mamba models, using short triggers to irreversibly overwrite hidden states and impair long-context retrieval, with experimental validation on ROBENCH-25.

Alexandre Le Mercier, Chris Develder, Thomas Demeester

2026-01-05 3 citations 41
cs.LG 2512.25070

Scaling Open-Ended Reasoning to Predict the Future

Using OpenForesight dataset, retrieval, and reinforcement learning, trained OpenForecaster 8B achieves competitive future prediction accuracy.

Nikhil Chandak, Shashwat Goel, Ameya Prabhu et al.

2026-01-01 44
cs.CL 2512.24880

mHC: Manifold-Constrained Hyper-Connections

mHC projects residual mappings onto the doubly stochastic matrix manifold, restoring identity properties and enhancing large-scale training stability.

Zhenda Xie, Yixuan Wei, Huanqi Cao et al.

2025-12-31 23