Ax Daniel Geyfman, Felix Draxler, Jan Groeneveld, Hyunsoo Lee, Theofanis Karaletsos, Stephan Mandt 7/2/2026

Calibrated Test-Time Guidance for Bayesian Inference

Analysis of test-time guidance in diffusion models showing common methods miscalibrate Bayesian inference; proposes correction for posterior sampling.

Ax Minhak Song, Liang Zhang, Bingcong Li, Niao He, Michael Muehlebach, Sewoong Oh 7/2/2026

Zeroth-Order Optimization at the Edge of Stability

Zeroth-order optimization methods for gradient-free black-box learning and memory-efficient LLM fine-tuning, analyzing stability dynamics.

Ax Rajat Ghosh, Datta Nimmaturi, Aryan Singhal, Vaishnavi Bhargava, Henry Wong, Johnu George, Debojyoti Dutta 7/2/2026

Predictable GRPO: A Closed-Form Model of Training Dynamics

Closed-form reduced-order model of GRPO training dynamics using mean-field approximation and stochastically-forced oscillator analogy.

Ax Tianyi Ma, Tengyao Wang, Richard J. Samworth 7/2/2026

Deep learning with missing data

Pattern Embedded Neural Networks (PENNs) for multivariate regression with missing covariates, combining imputation with indicator observation networks.

Ax Matteo Farina, Vishaal Udandarao, Thao Nguyen, Selim Kuzucu, Maximilian B\"other, Andreas Hochlehnert, Adhiraj Ghosh, Marianna Nezhurina, Karsten Roth, Joschka Struber, Yuhui Zhang, Sebastian Dziadzio, Elaine Sui, Soumya Jahagirdar, Dhruba Ghosh, Hasan Hammoud, Thomas De Min, Simone Caldarella, Jehanzeb Mirza, Sedrick Keh, Mehdi Cherti, Hilde Kuehne, Bernt Schiele, Serena Yeung-Levy, Muhammad Ferjad Naeem, Federico Tombari, Ana Klimovic, Elisa Ricci, Matthias Bethge, Sewoong Oh, Ameya Prabhu, Alessio Tonioni, Jenia Jitsev, Massimiliano Mancini, Ludwig Schmidt, Nikhil Parthasarathy 7/2/2026

DataComp-VLM: Improved Open Datasets for Vision-Language Models

DataComp-VLM benchmark with 160 datasets for systematically evaluating vision-language model training data curation strategies.