Ax Chang Li, Tshihao Tsu, Yaren Zhang, Chao Xue, Xiaodong He 3/10/2026

Fibration Policy Optimization

Policy optimization framework for heterogeneous LLM systems with hierarchical stability control.

Ax Yagiz Can Akay, Muhammed Yusuf Kartal, Esra Alparslan, Faruk Ortakoyluoglu, Arda Akpinar 3/10/2026

SPD-RAG: Sub-Agent Per Document Retrieval-Augmented Generation

SPD-RAG: Multi-agent RAG framework that assigns sub-agents per document for exhaustive cross-document question answering with improved evidence coverage.

Ax Daniil Karzanov, Marcin Detyniecki 3/10/2026

Geometrically Constrained Outlier Synthesis

GCOS training regularization framework improves out-of-distribution robustness by synthesizing constrained outliers respecting learned manifold structure.

Ax Peter Brodeur, Jacob M. Koshy, Anil Palepu, Khaled Saab, Ava Homiar, Roma Ruparel, Charles Wu, Ryutaro Tanno, Joseph Xu, Amy Wang, David Stutz, Hannah M. Ferrera, David Barrett, Lindsey Crowley, Jihyeon Lee, Spencer E. Rittner, Ellery Wulczyn, Selena K. Zhang, Elahe Vedadi, Christine G. Kohn, Kavita Kulkarni, Vinay Kadiyala, Sara Mahdavi, Wendy Du, Jessica Williams, David Feinbloom, Renee Wong, Tao Tu, Petar Sirkovic, Alessio Orlandi, Christopher Semturs, Yun Liu, Juraj Gottweis, Dale R. Webster, Jo\"elle Barral, Katherine Chou, Pushmeet Kohli, Avinatan Hassidim, Yossi Matias, James Manyika, Rob Fields, Jonathan X. Li, Marc L. Cohen, Vivek Natarajan, Mike Schaekermann, Alan Karthikesalingam, Adam Rodman 3/10/2026

A prospective clinical feasibility study of a conversational diagnostic AI in an ambulatory primary care clinic

Clinical feasibility study of AMIE, an LLM-based conversational AI system for patient diagnostic history-taking in real primary care workflows.

Ax Francesco Argenziano, John Mark Alexis Marcelo, Michele Brienza, Abdel Hakim Drid, Emanuele Musumeci, Daniele Nardi, Domenico D. Bloisi, Vincenzo Suriani 3/10/2026

R2F: Repurposing Ray Frontiers for LLM-free Object Navigation

R2F method enables efficient zero-shot object navigation without LLM queries by repurposing ray frontier representations for real-time deployment.

Ax Simone Carnemolla, Chiara Russo, Simone Palazzo, Quentin Bouniot, Daniela Giordano, Zeynep Akata, Matteo Pennisi, Concetto Spampinato 3/10/2026

UNBOX: Unveiling Black-box visual models with Natural-language

UNBOX: Method using natural language to interpret black-box vision models, enabling auditing and bias detection of proprietary APIs.

Ax Ben Rank, Hardik Bhatnagar, Ameya Prabhu, Shira Eisenberg, Karina Nguyen, Matthias Bethge, Maksym Andriushchenko 3/10/2026

PostTrainBench: Can LLM Agents Automate LLM Post-Training?

PostTrainBench: Research benchmarking whether LLM agents can automate LLM post-training, extending agents beyond software engineering.

Ax Junjie Xing, Yeye He, Mengyu Zhou, Haoyu Dong, Shi Han, Lingjiao Chen, Dongmei Zhang, Surajit Chaudhuri, H. V. Jagadish 3/10/2026

MMTU: A Massive Multi-Task Table Understanding and Reasoning Benchmark

Introduces MMTU benchmark for comprehensive evaluation of LLM table understanding and reasoning across spreadsheets, databases, and computational notebooks.

Ax Di Wen, Kunyu Peng, Junwei Zheng, Yufan Chen, Yitian Shi, Jiale Wei, Ruiping Liu, Kailun Yang, Rainer Stiefelhagen 3/10/2026

MICA: Multi-Agent Industrial Coordination Assistant

Presents MICA, a multi-agent industrial coordination system with five role-specialized LLM agents for real-time assembly guidance under resource and privacy constraints.

Ax Zirui Cheng, Jiaxuan You 3/10/2026

Towards Strategic Persuasion with Language Models

Provides theory-driven framework for evaluating LLM persuasive capabilities systematically across diverse domains, addressing both benefits and societal risks.

Ax Shuai Shao, Qihan Ren, Chen Qian, Boyi Wei, Dadi Guo, Jingyi Yang, Xinhao Song, Linfeng Zhang, Weinan Zhang, Dongrui Liu, Jing Shao 3/10/2026

Your Agent May Misevolve: Emergent Risks in Self-evolving LLM Agents

Analyzes emergent risks in self-evolving LLM agents where autonomous self-improvement deviates from intended behavior, introducing novel safety concerns for autonomous agent systems.

Ax Pratik S. Sachdeva, Tom van Nuenen 3/10/2026

Deliberative Dynamics and Value Alignment in LLM Debates

Studies moral reasoning and value alignment in LLMs through multi-turn debates, extending beyond single-turn prompt evaluations to understand alignment in complex reasoning scenarios.

Ax Pengcheng Jiang, Jiacheng Lin, Zhiyi Shi, Zifeng Wang, Luxi He, Yichen Wu, Ming Zhong, Peiyang Song, Qizheng Zhang, Heng Wang, Xueqiang Xu, Hanwen Xu, Pengrui Han, Dylan Zhang, Jiashuo Sun, Chaoqi Yang, Kun Qian, Tian Wang, Changran Hu, Manling Li, Quanzheng Li, Hao Peng, Sheng Wang, Jingbo Shang, Chao Zhang, Jiaxuan You, Liyuan Liu, Pan Lu, Yu Zhang, Heng Ji, Yejin Choi, Dawn Song, Jimeng Sun, Jiawei Han 3/10/2026

Adaptation of Agentic AI: A Survey of Post-Training, Memory, and Skills

Survey of LLM agent adaptation techniques including post-training, reinforcement learning with verifiable rewards, memory systems, and skill accumulation.