Ax Wenhao Dai, Haodong Deng, Mengfei Rong, Xinyu Yang, Hongyu Liu, Fangxin Liu, Hailong Yang, Qianwen Cao, Qingxiao Sun 5/20/2026

Accelerating Sparse Transformer Inference on GPU

Optimizes sparse Transformer inference on GPUs through parallelization and operator fusion to reduce computation from mask-induced sparsity in LLMs.

Ax Wei Guo, Jaemoo Choi, Yuchen Zhu, Molei Tao, Yongxin Chen 5/20/2026

Proximal Diffusion Neural Sampler

Framework for training diffusion-based neural samplers on multimodal distributions using proximal stochastic optimal control.

Ax Sanjari Srivastava, Gang Li, Cheng Chang, Rishu Garg, Manpreet Kaur, Charlene Y. Lee, Yuezhang Li, Yining Mao, Ignacio Cases, Yanan Xie, Peng Qi 5/20/2026

WARC-Bench: Web Archive Based Benchmark for GUI Subtask Executions

Benchmark with 438 web navigation subtasks for evaluating multimodal AI agents on real-world UI interactions.

Ax Qiyang Li, Sergey Levine 5/20/2026

Q-learning with Adjoint Matching

Q-learning algorithm for continuous-action RL that optimizes diffusion/flow-matching policies using first-order critic information.

Ax Pourya Shamsolmoali, Masoumeh Zareapoor 5/20/2026

Finding Structure in Continual Learning

Continual learning method using Douglas-Rachford operator to reduce gradient conflicts without external memory or parameter regularization.

Ax Michal Nauman, Marek Cygan, Pieter Abbeel 5/20/2026

Reward-Conditioned Reinforcement Learning

Reward-Conditioned RL (RCRL) off-policy method conditioning agents on reward parameterizations for robustness to reward misspecification.

Ax Leonard S. Pleiss, James Harrison, Maximilian Schiffer 5/20/2026

Target-Aligned Reinforcement Learning

Target-Aligned Reinforcement Learning (TARL) addresses stability-recency tradeoff in value-based deep RL by refining target network mechanisms.

Ax Yuyuan Chen, Shiyi Wang, Peter Potaptchik, Jaeyeon Kim, Michael S. Albergo 5/20/2026

Discrete Tilt Matching

Discrete Tilt Matching: Likelihood-free RL fine-tuning for masked diffusion LLMs. Addresses intractability of sequence-level likelihoods in masked language model training.

Ax Jiachen Liu, Jiaxin Pei, Jintao Huang, Chenglei Si, Ao Qu, Xiangru Tang, Runyu Lu, Lichang Chen, Xiaoyan Bai, Haizhong Zheng, Carl Chen, Zhiyang Chen, Haojie Ye, Yujuan Fu, Zexue He, Zijian Jin, Zhenyu Zhang, Shangquan Sun, Maestro Harmon, John Dianzhuo Wang, Jianqiao Zeng, Jiachen Sun, Mingyuan Wu, Baoyu Zhou, Chenyu You, Shijian Lu, Yiming Qiu, Fan Lai, Yuan Yuan, Yao Li, Junyuan Hong, Ruihao Zhu, Beidi Chen, Alex Pentland, Ang Chen, Mosharaf Chowdhury, Zechen Zhang 5/20/2026

The Last Human-Written Paper: Agent-Native Research Artifacts

Proposes agent-native research artifacts to replace linear paper narratives. Addresses storytelling and engineering tax by enabling AI agents to process and use full research exploration.

Ax Chuanyang Zheng, Jiankai Sun, Yihang Gao, Yuehao Wang, Liangchen Tan, Mac Schwager, Anderson Schneider, Yuriy Nevmyvaka, Xiaodong Liu 5/20/2026

Cubit: Token Mixer with Kernel Ridge Regression

Cubit: Token mixer alternative to attention using kernel ridge regression interpretation. Proposes replacement for transformer attention mechanism based on Nadaraya-Watson regression.