Ax Xiangwen Wang, Yibo Jacky Zhang, Zhoujie Ding, Katherine Tsai, Haolun Wu, Sanmi Koyejo 3/9/2026

Aligning Compound AI Systems via System-level DPO

System-level DPO method for aligning compound AI systems with multiple interacting components via policy optimization.

Ax Mohammad S. Ahmad, Zan A. Naeem, Micha\"el Aupetit, Ahmed Elmagarmid, Mohamed Eltabakh, Xiaosong Ma, Mourad Ouzzani, Chaoyi Ruan, Hani Al-Sayeh 3/9/2026

HCT-QA: A Benchmark for Question Answering on Human-Centric Tables

HCT-QA benchmark for question answering on human-centric tables in PDFs and web pages with complex structural layouts.

Ax Xiusi Chen, Gaotang Li, Ziqi Wang, Bowen Jin, Cheng Qian, Yu Wang, Hongru Wang, Yu Zhang, Denghui Zhang, Tong Zhang, Hanghang Tong, Heng Ji 3/9/2026

RM-R1: Reward Modeling as Reasoning

RM-R1 integrates chain-of-thought reasoning into reward models for improved LLM alignment with human preferences via RLHF.

Ax Haiqing Hao, Nikola Zubi\'c, Weihua He, Zhipeng Sui, Davide Scaramuzza, Wenhui Wang 3/9/2026

Maximizing Asynchronicity in Event-based Neural Networks

Event-based neural networks optimized for asynchronous event camera data using improved asynchronous-to-synchronous encoding methods.

Ax Eugenie Lai, Gerardo Vitagliano, Ziyu Zhang, Om Chabra, Sivaprasad Sudhir, Anna Zeng, Anton A. Zabreyko, Chenning Li, Ferdi Kossmann, Jialin Ding, Jun Chen, Markos Markakis, Matthew Russo, Weiyang Wang, Ziniu Wu, Michael J. Cafarella, Lei Cao, Samuel Madden, Tim Kraska 3/9/2026

KramaBench: A Benchmark for AI Systems on Data-to-Insight Pipelines over Data Lakes

KramaBench benchmark evaluates AI systems on end-to-end data-to-insight pipelines over real-world data lakes with unstructured data.

Ax Timo Klein, Thomas Lang, Andrii Shkabrii, Alexander Sturm, Kevin Sidak, Lukas Miklautz, Claudia Plant, Yllka Velaj, Sebastian Tschiatschek 3/9/2026

Understanding and Improving Hyperbolic Deep Reinforcement Learning

Analysis and improvements for hyperbolic deep reinforcement learning agents, identifying gradient factors affecting optimization success.

Ax David P. Woodruff, Vincent Cohen-Addad, Lalit Jain, Jieming Mao, Song Zuo, MohammadHossein Bateni, Simina Branzei, Michael P. Brenner, Lin Chen, Ying Feng, Lance Fortnow, Gang Fu, Ziyi Guan, Zahra Hadizadeh, Mohammad T. Hajiaghayi, Mahdi JafariRaviz, Adel Javanmard, Karthik C. S., Ken-ichi Kawarabayashi, Ravi Kumar, Silvio Lattanzi, Euiwoong Lee, Yi Li, Ioannis Panageas, Dimitris Paparas, Benjamin Przybocki, Bernardo Subercaseaux, Ola Svensson, Shayan Taherijam, Xuan Wu, Eylon Yogev, Morteza Zadimoghaddam, Samson Zhou, Yossi Matias, James Manyika, Vahab Mirrokni 3/9/2026

Accelerating Scientific Research with Gemini: Case Studies and Common Techniques

Case studies demonstrating how Google's Gemini LLMs assist researchers with mathematical discovery and routine scientific tasks.

Ax Tony Feng, Trieu H. Trinh, Garrett Bingham, Dawsen Hwang, Yuri Chervonyi, Junehyuk Jung, Joonkyung Lee, Carlo Pagano, Sang-hyun Kim, Federico Pasqualotto, Sergei Gukov, Jonathan N. Lee, Junsu Kim, Kaiying Hou, Golnaz Ghiasi, Yi Tay, YaGuang Li, Chenkai Kuang, Yuan Liu, Hanzhao Lin, Evan Zheran Liu, Nigamaa Nayakanti, Xiaomeng Yang, Heng-Tze Cheng, Demis Hassabis, Koray Kavukcuoglu, Quoc V. Le, Thang Luong 3/9/2026

Towards Autonomous Mathematics Research

Aletheia: an autonomous AI agent for mathematics research that generates, verifies, and revises proofs at professional research level.

Ax Haoyu Hu, Raja Marjieh, Katherine M Collins, Chenyi Li, Thomas L. Griffiths, Ilia Sucholutsky, Nori Jacoby 3/9/2026

Why Human Guidance Matters in Collaborative Vibe Coding

Research on AI-assisted code generation via natural language instructions, examining human collaboration and productivity impacts.

Ax Karun Sharma, Vidushee Vats, Shengzhi Li, Yuxiang Wang, Zhongtian Sun, Prayag Tiwari 3/9/2026

IntelliAsk: Learning to Ask High-Quality Research Questions via RLVR

IntelliAsk uses RLVR to train LLMs to generate high-quality research review questions by learning from expert annotations across effort, evidence, and grounding dimensions.