Ax Jayden Teoh, Manan Tomar, Kwangjun Ahn, Edward S. Hu, Tim Pearce, Pratyusha Sharma, Akshay Krishnamurthy, Riashat Islam, Alex Lamb, John Langford 5/25/2026

Next-Latent Prediction Transformers Learn Compact World Models

NextLat: Transformer training with self-supervised next-latent prediction to learn compact world models with better generalization.

Ax Eloi Campagne (CB), Yvenn Amara-Ouali (LMO), Yannig Goude (LMO), Mathilde Mougeot (CB, ENSIIE, ENS Paris Saclay), Argyris Kalogeratos (CB, ENS Paris Saclay) 5/25/2026

Cascaded Transfer: Learning Many Tasks under Budget Constraints

Cascaded Transfer Learning paradigm for learning many related tasks hierarchically under distributed training budget constraints.

Ax Alina Shutova, Alexandra Olenina, Ivan Vinogradov, Anton Sinitsin 5/25/2026

Evaluating Memory Structure in LLM Agents

Benchmark for evaluating long-term memory architectures in LLM agents. Analyzes memory design capabilities for agent systems.

Ax Thanh Q. Tran, Arun Verma, Kiwan Wong, Bryan Kian Hsiang Low, Daniela Rus, Wei Xiao 5/25/2026

BarrierSteer: LLM Safety via Learning Barrier Steering

BarrierSteer inference-time safety framework for LLMs against adversarial attacks. Novel safety mechanism with theoretical grounding.

Ax Woogyeol Jin, Taywon Min, Yongjin Yang, Swanand Ravindra Kadhe, Yi Zhou, Dennis Wei, Nathalie Baracaldo, Kimin Lee 5/25/2026

Entropy-Aware On-Policy Distillation of Language Models

Entropy-aware on-policy distillation for knowledge transfer between language models. Improves student LLM training stability and diversity.

Ax Hoang Phan, Quang H. Nguyen, Hung T. Q. Le, Xiusi Chen, Heng Ji, Khoa D. Doan 5/25/2026

Decoding the Critique Mechanism in Large Reasoning Models

Analysis of critique mechanisms in Large Reasoning Models, investigating how models recover from errors through self-verification and backtracking.