cs.CL 2607.05196

Unified Audio Intelligence Without Regressing on Text Intelligence

Audex, built on Nemotron-Cascade-2-30B-A3B, unifies audio-text modeling with a single Transformer decoder, achieving state-of-the-art performance in audio understanding, speech recognition, translation, and generation, while maintaining text reasoning.

Zhifeng Kong, Sang-gil Lee, Jaehyeon Kim et al.

2026-07-06 47
cs.CL 2606.30096

Information Dynamics of Language Communication

Introduced STE and SPID frameworks to quantify semantic information flow and multi-source contributions in communication.

Leonardo S. Goodall, Andrea I. Luppi, Pedro A. M. Mediano

2026-06-29 38
cs.CL 2606.28057

MultiHashFormer: Hash-based Generative Language Models

MultiHashFormer employs a multi-hash signature mechanism supporting causal language modeling, outperforming standard Transformers across 100M-3B parameters, with zero-parameter multilingual vocabulary expansion.

Huiyin Xue, Atsuki Yamaguchi, Nikolaos Aletras

2026-06-26 245
cs.CL 2606.27617

Masked Language Flow Models

Introduces Masked Language Flow Models combining masking and flow models to enhance multi-step reasoning.

Iskander Azangulov, Kianoosh Ashouritaklimi, Leo Zhang et al.

2026-06-26 4