Ax Ruicheng Ao, Hongyu Chen, Siyang Gao, Hanwei Li, David Simchi-Levi 3/12/2026

Designing Service Systems from Textual Evidence

Framework using LLMs to design service systems by analyzing textual evidence from customer interactions and operational reports.

Ax Hengjie Cao, Zhendong Huang, Mengyi Chen, Yifeng Yang, Fanqi Yu, Ruijun Huang, Fang Dong, Xin Zhang, Jixian Zhou, Anrui Chen, Mingzhi Dong, Yujiang Wang, Jinlong Hou, Qin Lv, Yuan Cheng, Tun Lu, Fan Yang, Li Shang 3/12/2026

The Curse and Blessing of Mean Bias in FP4-Quantized LLM Training

Analysis of mean bias effects in FP4 quantization during LLM training, addressing numerical instability from anisotropic weight distributions.

Ax Simon Roth 3/12/2026

A Grammar of Machine Learning Workflows

Grammar-based structural framework decomposing supervised learning into 7 primitives with DAG constraints to prevent data leakage in ML workflows.

Ax Dominik Baumann, Erfaun Noorani, Arsenii Mustafin, Xinyi Sheng, Bert Verbruggen, Arne Vanhoyweghen, Vincent Ginis, Thomas B. Sch\"on 3/12/2026

Ergodicity in reinforcement learning

Analyzes ergodicity in RL optimization, showing expected value across trajectories differs from single long-trajectory performance, affecting deployment-stage agent behavior.

Ax Mohsen Hariri, Michael Hinczewski, Jing Ma, Vipin Chaudhary 3/12/2026

Ranking Reasoning LLMs under Test-Time Scaling

Scorio library implementing statistical ranking methods for comparing reasoning LLMs under test-time scaling.

Ax Tycho F. A. van der Ouderaa, Mart van Baalen, Paul Whatmough, Markus Nagel 3/12/2026

Leech Lattice Vector Quantization for Efficient LLM Compression

Leech Lattice Vector Quantization: novel LLM compression technique using structured lattice approaches for efficient parameter encoding without explicit codebook storage.

Ax Yannis Karmim (ALMAnaCH), Renato Pino (UCHILE), Hernan Contreras (UCHILE), Hernan Lira (CENIA), Sebastian Cifuentes (CENIA), Simon Escoffier (PUC), Luis Mart\'i (UP4, ALPAGE), Djam\'e Seddah (UP4, ALPAGE), Valentin Barri\`ere (UCHILE, CENIA) 3/12/2026

Leveraging Wikidata for Geographically Informed Sociocultural Bias Dataset Creation: Application to Latin America

Proposes using Wikidata to create sociocultural bias datasets for detecting LLM prejudices against Latin American cultures in non-English languages.

Ax Ond\v{r}ej Luk\'a\v{s}, Jihoon Shin, Emilia Rivas, Diego Forni, Maria Rigaki, Carlos Catania, Aritran Piplai, Christopher Kiekintveld, Sebastian Garcia 3/12/2026

Evaluating Generalization Mechanisms in Autonomous Cyber Attack Agents

Evaluation of autonomous cyber attack agent generalization across unseen network IP configurations using meta-learning.