cs.CL 2601.21744

Temporal Guidance for Large Language Models

Introduces Temporal Guidance (TeGu), leveraging temporal contrast to enhance LLM generation quality, achieving a 3.03% improvement on GSM8K.

Hong-Kai Zheng, Piji Li

2026-01-29 47
cs.CV 2601.21426

MultiModal Fine-tuning with Synthetic Captions

MultiModal Fine-tuning with Synthetic Captions significantly improves performance on 13 benchmarks, especially in few-shot learning.

Shohei Enomoto, Shin'ya Yamaguchi

2026-01-29 14
cs.LG 2601.20985

Distributional Active Inference

Introduces Distributional Active Inference (DAIF), integrating active inference into distributional RL for model-free, efficient control in complex environments.

Abdullah Akgül, Gulcin Baykal, Manuel Haußmann et al.

2026-01-29 59
cs.CL 2601.20757

Persona Prompting as a Lens on LLM Social Reasoning

This paper introduces Persona Prompting (PP) to analyze its impact on social reasoning in LLMs, focusing on bias, rationale quality, and task performance using hate speech datasets.

Jing Yang, Moritz Hechtbauer, Elisabeth Khalilov et al.

2026-01-29 62
cs.CV 2601.20552

DeepSeek-OCR 2: Visual Causal Flow

DeepSeek-OCR 2 uses DeepEncoder V2 for visual causal flow, achieving a 3.73% performance boost on OmniDocBench v1.5.

Haoran Wei, Yaofeng Sun, Yukun Li

2026-01-28 38
cs.CR 2601.20901

Towards Sensitivity-Aware Language Models

Proposed LoRA-based fine-tuning boosts 4-bit quantized LLM sensitivity awareness by 21.7%.

Dren Fazlija, Iyiola E. Olatunji, Daniel Kudenko et al.

2026-01-28 46