Ax Jun Liu, Zhenglun Kong, Peiyan Dong, Changdi Yang, Tianqi Li, Hao Tang, Geng Yuan, Wei Niu, Wenbin Zhang, Pu Zhao, Xue Lin, Dong Huang, Yanzhi Wang 3/13/2026

Structured Agent Distillation for Large Language Model

Framework for compressing large LLM-based ReAct agents into smaller student models while preserving reasoning and action consistency.

Ax Ozgur Guldogan, Neeraj Sarna, Yuanyuan Li, Michael Berger 3/13/2026

Counterfactually Fair Conformal Prediction

Development of conformal prediction method that ensures counterfactual fairness in prediction sets for fair decision-making under uncertainty.

Ax Jose Javier Gonzalez Ortiz, Abhay Gupta, Christopher Rinard, Davis Blalock 3/13/2026

FlashOptim: Optimizers for Memory-Efficient Training

Introduces FlashOptim, memory-efficient optimizers for mixed-precision neural network training reducing per-parameter memory requirements.

Ax Isotta Magistrali, Fr\'ed\'eric Berdoz, Sam Dauncey, Roger Wattenhofer 3/13/2026

Subliminal Signals in Preference Labels

Shows preference labels in LLM-as-judge training can function as covert communication channels, challenging assumptions about semantic supervision.

Ax Hadi Sotoudeh, Payel Mukhopadhyay, Ruben Ohana, Michael McCabe, Neil D. Lawrence, Shirley Ho, Miles Cranmer 3/13/2026

On the Value of Tokeniser Pretraining in Physics Foundation Models

Investigates tokenizer pretraining impact on physics foundation models for emulating complex multiphysics phenomena in data-limited settings.

Ax Benjamin A. T. Grahama, Lauren Brown, Georgios Chochlakis, Morteza Dehghani, Raquel Delerme, Brittany Friedman, Ellie Graeden, Preni Golazizian, Rajat Hebbar, Parsa Hejabi, Aditya Kommineni, Mayag\"uez Salinas, Michael Sierra-Ar\'evalo, Jackson Trager, Nicholas Weller, Shrikanth Narayanan 3/13/2026

Community-Informed AI Models for Police Accountability

AI system analyzing police bodycam footage at scale to assess officer-public interactions and improve government accountability.

Ax Nadav Kunievsky, James A. Evans 3/13/2026

Measuring Intent Comprehension in LLMs

Research paper on measuring whether LLMs comprehend user intent beyond surface-level text patterns, addressing training-inference gaps in language models.

Ax Sayan Nag, K J Joseph, Koustava Goswami, Vlad I Morariu, Balaji Vasan Srinivasan 3/13/2026

Agentic Design Review System

Agentic Design Review System orchestrates multiple AI agents to collaboratively analyze graphic designs with meta-agent coordination.

Ax Andr\'es Carofilis, Sergio Burdisso, Esa\'u Villatoro-Tello, Shashi Kumar, Kadri Hacioglu, Srikanth Madikeri, Pradeep Rangappa, Manjunath K E, Petr Motlicek, Shankar Venkatesan, Andreas Stolcke 3/13/2026

Text-only adaptation in LLM-based ASR through text denoising

Novel text-only adaptation method for LLM-based ASR systems using text denoising to preserve speech-text alignment without fine-tuning disruption.

Ax Xinwu Ye, Yicheng Mao, Jia Zhang, Yimeng Liu, Li Hao, Fang Wu, Zhiwei Li, Yuxuan Liao, Zehong Wang, Zhiyuan Liu, Zhenfei Yin, Li Yuan, Philip Torr, Huan Sun, Xiangxiang Zeng, Mengdi Wang, Le Cong, Shenghua Gao, Xiangru Tang 3/13/2026

LatentChem: From Textual CoT to Latent Thinking in Chemical Reasoning

LatentChem: Latent reasoning interface for chemical LLMs, decoupling chemical reasoning from text tokens for improved efficiency.

Ax Fr\'ed\'eric Berdoz, Leonardo Rugli, Roger Wattenhofer 3/13/2026

Can AI Agents Agree?

Systematic evaluation of LLM-based AI agents in Byzantine consensus games, testing agreement behavior in adversarial settings.

Ax Fr\'ed\'eric Berdoz, Yann Billeter, Yann Vonlanthen, Roger Wattenhofer 3/13/2026

Reasoning Boosts Opinion Alignment in LLMs

Study of reasoning techniques in LLMs for political opinion modeling and alignment with individual preferences.

Ax Louis Mozart Kamdem Teyou, Caglar Demir, Axel-Cyrille Ngonga Ngomo 3/13/2026

Semantics-Aware Caching for Concept Learning

Caching optimization for concept learning in description logic knowledge bases using supervised learning.

HN andes314 3/13/2026

Give Your AI Agent a Live Status Page

ClawJetty adds live status pages and progress tracking to AI agents with shareable run links and task completion visibility.

HN gmays 3/13/2026

Teaching LLMs to reason like Bayesians

Research from Google on training LLMs to reason using Bayesian inference for improved probabilistic world modeling in agentic systems.