Ax Zhuoyun Du, Runze Wang, Huiyu Bai, Zouying Cao, Xiaoyong Zhu, Yu Cheng, Bo Zheng, Wei Chen, Haochao Ying 4/17/2026

Enabling Agents to Communicate Entirely in Latent Space

Interlat enables LLM-based agents to communicate in latent space instead of natural language, improving information transfer depth.

Ax Suyan Dai, Gan Sun, Fazeng Li, Xu Tang, Qianqian Wang, Yang Cong 4/17/2026

Federated Multi-Task Clustering

Federated learning approach for spectral clustering in decentralized environments, capturing latent correlations across tasks.

Ax Denizalp Goktas, Gerardo Ria\~no-Brice\~no, Alif Abdullah, Aryan Nair, Chenkai Shen, Beatriz de Lucio, Alexandra Magnusson, Farhan Mashrur, Ahmed Abdulla, Shawrna Sen, Mahitha Thippireddy, Gregory Schwartz, Amy Greenwald 4/17/2026

TempusBench: An Evaluation Framework for Time-Series Forecasting

Comprehensive evaluation framework for assessing time-series foundation models with benchmarks and community standards.

Ax Ido Guy, Daniel Haimovich, Fridolin Linder, Nastaran Okati, Lorenzo Perini, Niek Tax, Mark Tygert 4/17/2026

Measuring multi-calibration

Proposes scalar metrics for measuring multi-calibration of probabilistic predictions across multiple subpopulations.

Ax Haonan Chen, Jiaming Xu, Hongyu Chen, Kaiwen Hong, Binghao Huang, Chaoqi Liu, Jiayuan Mao, Yunzhu Li, Yilun Du, Katherine Driggs-Campbell 4/17/2026

Multi-Modal Manipulation via Multi-Modal Policy Consensus

Multi-modal policy consensus approach factorizing robotic manipulation policies into modality-specific diffusion models for flexible integration.

Ax Drew Prinster, Clara Fannjiang, Ji Won Park, Kyunghyun Cho, Anqi Liu, Suchi Saria, Samuel Stanton 4/17/2026

Conformal Policy Control

Conformal policy control framework using safe reference policies as regulators for untested policies in high-stakes agent exploration.