Ax Zhizhi Peng, Chonghe Zhao, Taotao Wang, Guofu Liao, Zibin Lin, Yifeng Liu, Bin Cao, Long Shi, Qing Yang, Shengli Zhang 3/31/2026

A Survey of Zero-Knowledge Proof Based Verifiable Machine Learning

Survey of zero-knowledge proof based verifiable machine learning for ensuring computational integrity and privacy in ML pipelines.

Ax Jiageng Wu, Bowen Gu, Ren Zhou, Kevin Xie, Doug Snyder, Yixing Jiang, Valentina Carducci, Richard Wyss, Rishi J Desai, Emily Alsentzer, Leo Anthony Celi, Adam Rodman, Sebastian Schneeweiss, Jonathan H. Chen, Santiago Romero-Brufau, Kueiyu Joshua Lin, Jie Yang 3/31/2026

BRIDGE: Benchmarking Large Language Models for Understanding Real-world Clinical Practice Text

Benchmark evaluating LLMs on real-world electronic health record clinical text understanding across diverse medical models.

Ax Jun Liu, Zhenglun Kong, Peiyan Dong, Changdi Yang, Tianqi Li, Hao Tang, Geng Yuan, Wei Niu, Wenbin Zhang, Pu Zhao, Xue Lin, Dong Huang, Yanzhi Wang 3/31/2026

Structured Agent Distillation for Large Language Model

Framework compressing large LLM-based agents into smaller student models while preserving reasoning and action fidelity using distillation.

Ax Nanaka Hosokawa, Ryo Takahashi, Tomoya Kitano, Yukihiro Iida, Chisako Muramatsu, Tatsuro Hayashi, Yuta Seino, Xiangrong Zhou, Takeshi Hara, Akitoshi Katsumata, Hiroshi Fujita 3/31/2026

Generating Findings for Jaw Cysts in Dental Panoramic Radiographs Using a GPT-Based VLM: A Preliminary Study on Building a Two-Stage Self-Correction Loop with Structured Output (SLSO) Framework

SLSO framework uses GPT vision-language models with self-correction loops and structured output for automated dental radiograph interpretation and medical image analysis.

Ax Qizheng Zhang, Changran Hu, Shubhangi Upasani, Boyuan Ma, Fenglu Hong, Vamsidhar Kamanuru, Jay Rainton, Chen Wu, Mengmeng Ji, Hanchen Li, Urmish Thakker, James Zou, Kunle Olukotun 3/31/2026

Agentic Context Engineering: Evolving Contexts for Self-Improving Language Models

ACE framework evolves contexts for self-improving language models, addressing brevity bias and context collapse through agentic context engineering for domain-specific applications.

Ax Jungbin Cho, Minsu Kim, Jisoo Kim, Ce Zheng, Laszlo A. Jeni, Ming-Hsuan Yang, Youngjae Yu, Seonjoo Kim 3/31/2026

SceneAdapt: Scene-aware Adaptation of Human Motion Diffusion

Diffusion-based human motion generation adapting to scene constraints using two-stage approach for diverse, scene-aware motion.

Ax Pan Chen, Shaohong Chen, Mark Wang, Shi Xuan Leong, Priscilla Fung, Varinia Bernales, Alan Aspuru-Guzik 3/31/2026

Schema for In-Context Learning

Schema-based in-context learning framework enabling transformers to activate and transfer pre-existing knowledge abstractions.

Ax Sandeep Routray, Hengkai Pan, Unnat Jain, Shikhar Bahl, Deepak Pathak 3/31/2026

ViPRA: Video Prediction for Robot Actions

Framework learning robot control policies from unlabeled video data using video prediction and action inference.

Ax Zhongang Cai, Ruisi Wang, Chenyang Gu, Fanyi Pu, Junxiang Xu, Yubo Wang, Wanqi Yin, Zhitao Yang, Chen Wei, Qingping Sun, Tongxi Zhou, Jiaqi Li, Hui En Pang, Oscar Qian, Yukun Wei, Zhiqian Lin, Xuanke Shi, Kewang Deng, Xiaoyang Han, Zukai Chen, Xiangyu Fan, Hanming Deng, Lewei Lu, Liang Pan, Bo Li, Ziwei Liu, Quan Wang, Dahua Lin, Lei Yang 3/31/2026

Scaling Spatial Intelligence with Multimodal Foundation Models

Scaling multimodal foundation models for improved spatial understanding capabilities in visual reasoning tasks.

Ax Nicolas Carion, Laura Gustafson, Yuan-Ting Hu, Shoubhik Debnath, Ronghang Hu, Didac Suris, Chaitanya Ryali, Kalyan Vasudev Alwala, Haitham Khedr, Andrew Huang, Jie Lei, Tengyu Ma, Baishan Guo, Arpit Kalla, Markus Marks, Joseph Greer, Meng Wang, Peize Sun, Roman R\"adle, Triantafyllos Afouras, Effrosyni Mavroudi, Katherine Xu, Tsung-Han Wu, Yu Zhou, Liliane Momeni, Rishi Hazra, Shuangrui Ding, Sagar Vaze, Francois Porcher, Feng Li, Siyuan Li, Aishwarya Kamath, Ho Kei Cheng, Piotr Doll\'ar, Nikhila Ravi, Kate Saenko, Pengchuan Zhang, Christoph Feichtenhofer 3/31/2026

SAM 3: Segment Anything with Concepts

SAM 3 extends segment anything model to detect, segment and track objects using concept prompts combining text and image exemplars.

Ax Alan T. L. Bacellar, Mustafa Munir, Felipe M. G. Fran\c{c}a, Priscila M. V. Lima, Radu Marculescu, Lizy K. John 3/31/2026

Single-Round Scalable Analytic Federated Learning

SAFLe: Single-round federated learning framework for non-linear models with heterogeneous data.