Ax Charlie F. Ruan, Yucheng Qin, Akaash R. Parthasarathy, Xun Zhou, Ruihang Lai, Hongyi Jin, Yixin Dong, Bohan Hou, Meng-Shiun Yu, Yiyan Zhai, Sudeep Agarwal, Hangrui Cao, Siyuan Feng, Tianqi Chen 4/14/2026

WebLLM: A High-Performance In-Browser LLM Inference Engine

WebLLM inference engine enabling high-performance LLM execution directly in web browsers for on-device deployment without server GPUs.

Ax Kisu Yang, Yoonna Jang, Hwanseok Jang, Kenneth Choi, Isabelle Augenstein, Heuiseok Lim 4/14/2026

Reliable Evaluation Protocol for Low-Precision Retrieval

Protocol for reliable evaluation of low-precision retrieval systems, addressing spurious ties and variability in relevance scoring with reduced numerical precision.

Ax Wenhong Zhu, Ruobing Xie, Rui Wang, Xingwu Sun, Di Wang, Pengfei Liu 4/14/2026

Proximal Supervised Fine-Tuning

Proximal SFT: supervised fine-tuning method using trust-region constraints to prevent capability deterioration when adapting foundation models to new tasks.

Ax Fang Wu, Aaron Tu, Weihao Xuan, Heli Qi, Xu Huang, Qingcheng Zeng, Shayan Talaei, Yijia Xiao, Peng Xia, Xiangru Tang, Yuchen Zhuang, Bing Hu, Hanqun Cao, Wenqi Shi, Rui Yang, Nan Liu, Huaxiu Yao, Ge Liu, Li Erran Li, Amin Saberi, Naoto Yokoya, Jure Leskovec, Yejin Choi 4/14/2026

Position: The Hidden Costs and Measurement Gaps of Reinforcement Learning with Verifiable Rewards

Position paper analyzing measurement gaps in reinforcement learning with verifiable rewards for LLMs on structured tasks.

Ax Xue-Cheng Tai, Hao Liu, Lingfeng Li, Raymond H. Chan 4/14/2026

A Mathematical Explanation of Transformers

Mathematical framework interpreting Transformers as discretizations of integro-differential equations.

Ax Kedi Chen, Dezhao Ruan, Yuhao Dan, Yaoting Wang, Siyu Yan, Xuecheng Wu, Yinqi Zhang, Qin Chen, Jie Zhou, Liang He, Biqing Qi, Linyang Li, Qipeng Guo, Xiaoming Shi, Wei Zhang 4/14/2026

A Survey of Inductive Reasoning for Large Language Models

Survey of inductive reasoning in LLMs, covering particular-to-general thinking patterns and knowledge generalization capabilities.