Ax Kai Guo, Xinnan Dai, Zhibo Zhang, Nuohan Lin, Shenglai Zeng, Jie Ren, Haoyu Han, Jiliang Tang 5/15/2026

Why Retrieval-Augmented Generation Fails: A Graph Perspective

Research study examining failure modes of RAG systems through a graph-based lens, analyzing how retrieved evidence influences LLM answer generation.

Ax Andrew Lanpouthakoun, Aryaman Arora, Zhengxuan Wu, Dhruv Pai, Ben Keigwin, Dan Jurafsky, Christopher Potts 5/15/2026

PreFT: Prefill-only finetuning for efficient inference

Prefill-only finetuning method enabling efficient personalized LLM serving without throughput degradation from user-specific adapters.

Ax Jerem\'ias Figueiredo Paschmann, Juan Kaplan, Francisco Nattero Santiago Mauricio Barron Bucolo, Juan Wisznia, Luciano del Corro 5/15/2026

Active Learners as Efficient PRP Rerankers

Active learning approach to improve pairwise ranking prompting from LLMs by reframing as efficient reranking problem.

Ax Julien Piet, Annabella Chow, Yiwei Hou, Muxi Lyu, Sylvie Venuto, Jinhao Zhu, Raluca Ada Popa, David Wagner 5/15/2026

Web Agents Should Adopt the Plan-Then-Execute Paradigm

Web agents should use plan-then-execute paradigm instead of ReAct, committing to task-specific programs before observing web content to avoid injection attacks.

Ax Fangyuan Yu, Xin Su, Amir Abdullah 5/15/2026

Dynamic Latent Routing

Dynamic Latent Routing: Language model post-training method using General Dijkstra Search for temporal composition of sub-policies in MDPs.

Ax Xiang Shen, Yuhang Zhou, Yifan Wu, Zhuokai Zhao, Siyu Lin, Lei Huang, Qianqian Zhong, Lizhu Zhang, Benyu Zhang, Xiangjun Fan, Hong Yan 5/15/2026

Agentic Recommender System with Hierarchical Belief-State Memory

MARS framework for memory-augmented LLM agents in recommendation systems using structured belief-state memory with lifecycle management.

Ax Letian Yang (Shanghai Jiao Tong University, Shanghai, China), Xu Liu (Shanghai Jiao Tong University, Shanghai, China), Yiqiang Lu (Ant Group, Shanghai, China), Jian Liu (Ant Group, Shanghai, China), Weiqiang Wang (Ant Group, Shanghai, China), Shuai Li (Shanghai Jiao Tong University, Shanghai, China) 5/15/2026

ROAD: Adaptive Data Mixing for Offline-to-Online Reinforcement Learning via Bi-Level Optimization

Offline-to-online reinforcement learning approach using bi-level optimization for adaptive data mixing across training stages.

Ax Andreas Schlaginhaufen, Maryam Kamgarpour 5/15/2026

Fast Rates for Inverse Reinforcement Learning

Theoretical analysis establishing fast convergence rates for entropy-regularized inverse reinforcement learning with linear reward classes.

Ax Yaroslav Sokolov, Yury Khudyakov, Lenar Sharipov, Andrei Gasparian, Parth Tiwary, Artem Trofimov 5/15/2026

In-IDE Toolkit for Developers of AI-Based Features

JetBrains IDE plugin toolkit for developers building AI features with LLMs and agentic workflows, enabling tracing, debugging, and evaluation in development loop.