Ax Anurag Kumar, Raghuveer Peri, Jon Burnsky, Alexandru Nelus, Rohit Paturi, Srikanth Vishnubhotla, Yanjun Qi 4/2/2026

Robust Multimodal Safety via Conditional Decoding

Conditional decoding strategy (CASA) for improving safety alignment in multimodal LLMs against cross-modal attacks.

Ax Weyl Lu, Chenjie Hao, Yubei Chen 4/2/2026

Deep Networks Favor Simple Data

Study showing deep networks assign higher density to simpler out-of-distribution data than in-distribution test data.

Ax Yaqi Chen, Shixun Huang, Ryan Twemlow, Lei Wang, John Le, Sheng Wang, Willy Susilo, Jun Yan, Jun Shen 4/2/2026

A Cross-graph Tuning-free GNN Prompting Framework

Tuning-free GNN prompting framework for cross-graph adaptation without task-specific parameter updates.

Ax Ritish Shrirao, Aditya Priyadarshi, Raghuram Bharadwaj Diddigi 4/2/2026

Full-Gradient Successor Feature Representations

arXiv: Full-gradient successor feature representations improve convergence guarantees for transfer learning in RL with non-linear function approximation.

Ax Yu Xia, Canwen Xu, Zhewei Yao, Julian McAuley, Yuxiong He 4/2/2026

Learning to Hint for Reinforcement Learning

arXiv: Group Relative Policy Optimization for RL addresses advantage collapse in reinforcement learning with verifiable rewards using hints.

Ax Huaiyang Wang, Xiaojie Li, Deqing Wang, Haoyi Zhou, Zixuan Huang, Yaodong Yang, Jianxin Li, Yikun Ban 4/2/2026

Policy Improvement Reinforcement Learning

Reinforcement learning approach with verification for iteratively improving LLM policies based on actual performance gains.

Ax Ken M. Nakanishi 4/2/2026

Screening Is Enough

Multiscreen mechanism for language models enabling absolute query-key relevance assessment beyond relative attention redistribution.