Ax Hengjie Cao, Zhendong Huang, Mengyi Chen, Yifeng Yang, Fanqi Yu, Ruijun Huang, Fang Dong, Xin Zhang, Jixian Zhou, Anrui Chen, Mingzhi Dong, Yujiang Wang, Jinlong Hou, Qin Lv, Yuan Cheng, Tun Lu, Fan Yang, Li Shang 3/12/2026

The Curse and Blessing of Mean Bias in FP4-Quantized LLM Training

Analysis of mean bias effects in FP4 quantization during LLM training, addressing numerical instability from anisotropic weight distributions.

Ax Jing Peng, Ziyi Chen, Haoyu Li, Yucheng Wang, Duo Ma, Mengtian Li, Yunfan Du, Dezhu Xu, Kai Yu, Shuai Wang 3/12/2026

G-STAR: End-to-End Global Speaker-Tracking Attributed Recognition

End-to-end system for speaker-attributed speech recognition in multi-party conversations with temporal boundaries and speaker identity consistency.

Ax Wei Wu, Peilun Zhou, Liyi Chen, Qimeng Wang, Chengqiang Lu, Yan Gao, Yi Wu, Yao Hu, Hui Xiong 3/12/2026

Aligning Large Language Models with Searcher Preferences

Methods for aligning generative search systems with user preferences while ensuring robustness, safety, and handling noisy retrieval.

Ax Pum Jun Kim, Seung-Ah Lee, Seongho Park, Dongyoon Han, Jaejun Yoo 3/12/2026

On the Reliability of Cue Conflict and Beyond

Analyzes reliability of cue-conflict benchmark for measuring visual bias in neural networks, finding instability in stylization-based methods.

Ax Susung Hong, Brian Curless, Ira Kemelmacher-Shlizerman, Steve Seitz 3/12/2026

COMIC: Agentic Sketch Comedy Generation

Automated system generating comedic sketch videos using population of LLM-based agents with different roles competing and improving iteratively.

Ax Mingchen Zhuge, Haozhe Liu, Francesco Faccio, Dylan R. Ashley, R\'obert Csord\'as, Anand Gopalakrishnan, Abdullah Hamdi, Hasan Abed Al Kader Hammoud, Vincent Herrmann, Kazuki Irie, Louis Kirsch, Bing Li, Guohao Li, Shuming Liu, Jinjie Mai, Piotr Pi\k{e}kos, Aditya Ramesh, Imanol Schlag, Weimin Shi, Aleksandar Stani\'c, Wenyi Wang, Yuhui Wang, Mengmeng Xu, Deng-Ping Fan, Bernard Ghanem, J\"urgen Schmidhuber 3/12/2026

Mindstorms in Natural Language-Based Societies of Mind

Multi-agent systems of LLMs and neural networks solving problems through natural language dialogue, overcoming limitations of single models.

Ax Carlos N\'u\~nez-Molina, Vicen\c{c} G\'omez, Hector Geffner 3/12/2026

From Next Token Prediction to (STRIPS) World Models

STRIPS Transformer: Architecture enabling next-token prediction to yield world models supporting planning via symbolically aligned transformers for STRIPS action domains.

Ax Haebin Seong, Sungmin Kim, Yongjun Cho, Myunchul Joe, Geunwoo Kim, Yubeen Park, Sunhoo Kim, Yoonshik Kim, Suhwan Choi, Jaeyoon Jung, Jiyong Youn, Jinmyung Kwak, Sunghee Ahn, Jaemin Lee, Younggil Do, Seungyeop Yi, Woojin Cheong, Minhyeok Oh, Minchan Kim, Seongjae Kang, Samwoo Seong, Youngjae Yu, Yunsung Lee 3/12/2026

CostNav: A Navigation Benchmark for Real-World Economic-Cost Evaluation of Physical AI Agents

CostNav: Economic navigation benchmark for physical AI agents evaluating real-world commercialization constraints through comprehensive cost-revenue analysis.

Ax Yaorui Shi, Shugui Liu, Yu Yang, Wenyu Mao, Yuxin Chen, Qi GU, Hui Su, Xunliang Cai, Xiang Wang, An Zhang 3/12/2026

MemOCR: Layout-Aware Visual Memory for Efficient Long-Horizon Reasoning

MemOCR: Multimodal memory agent improving long-horizon agentic reasoning by allocating memory efficiently within limited context windows using layout-aware visual compression.

Ax Borja Requena, Austin Letson, Krystian Nowakowski, Izan Beltran Ferreiro, Leopoldo Sarra 3/12/2026

A Minimal Agent for Automated Theorem Proving

Minimal agent for automated theorem proving with iterative proof refinement, library search, and context management for systematic architecture comparison across frontier models.