Ax Shuli Jiang, Zhaoyang Zhang, Yi Zhang, Shuo Yang, Wei Xia, Stefano Soatto 4/2/2026

Asymmetric Actor-Critic for Multi-turn LLM Agents

Asymmetric Actor-Critic method for improving reliability of multi-turn LLM agents in one-shot settings without requiring model retraining.

Ax Anurag Kumar, Raghuveer Peri, Jon Burnsky, Alexandru Nelus, Rohit Paturi, Srikanth Vishnubhotla, Yanjun Qi 4/2/2026

Robust Multimodal Safety via Conditional Decoding

CASA: conditional decoding strategy for robust multimodal safety in MLLMs against cross-modal attacks.

Ax Weyl Lu, Chenjie Hao, Yubei Chen 4/2/2026

Deep Networks Favor Simple Data

Research on out-of-distribution anomaly where deep models assign higher density to simple OOD data than in-distribution test data.

Ax Yabin Zhang, Chong Wang, Yunhe Gao, Jiaming Liu, Maya Varma, Justin Xu, Sophie Ostmeier, Jin Long, Sergios Gatidis, Seena Dehkharghani, Arne Michalson, Eun Kyoung Hong, Christian Bluethgen, Haiwei Henry Guo, Alexander Victor Ortiz, Stephan Altmayer, Sandhya Bodapati, Joseph David Janizek, Ken Chang, Jean-Benoit Delbrouck, Akshay S. Chaudhari, Curtis P. Langlotz 4/2/2026

A Reasoning-Enabled Vision-Language Foundation Model for Chest X-ray Interpretation

Vision-Language foundation model for chest X-ray interpretation providing explicit reasoning about visual evidence and diagnostic predictions.

Ax Pawe{\l} Liskowski, Kyle Schmaus 4/2/2026

Streaming Model Cascades for Semantic SQL

Method using model cascades to optimize LLM inference costs in semantic SQL queries by routing rows through fast/expensive models based on confidence.

Ax Yu Xia, Canwen Xu, Zhewei Yao, Julian McAuley, Yuxiong He 4/2/2026

Learning to Hint for Reinforcement Learning

Reinforcement learning technique adding hints to overcome advantage collapse in group relative policy optimization.

Ax Xiangqi Wang, Yue Huang, Haomin Zhuang, Kehan Guo, Xiangliang Zhang 4/2/2026

Dual Optimal: Make Your LLM Peer-like with Dignity

Dignified Peer framework addressing evasive and sycophantic behavior in aligned LLMs through anti-sycophancy and empathy.

Ax Zhengyang Tang, Ke Ji, Xidong Wang, Zihan Ye, Xinyuan Wang, Yiduo Guo, Ziniu Li, Chenxin Li, Jingyuan Hu, Shunian Chen, Tongxu Luo, Jiaxi Bi, Zeyu Qin, Shaobo Wang, Xin Lai, Pengyuan Lyu, Junyi Li, Can Xu, Chengquan Zhang, Han Hu, Ming Yan, Benyou Wang 4/2/2026

Do Phone-Use Agents Respect Your Privacy?

MyPhoneBench: evaluation framework measuring privacy-compliant behavior in mobile phone-use agents during task execution.