Ax Haotian Ye, Qiyuan He, Jiaqi Han, Puheng Li, Jiaojiao Fan, Zekun Hao, Fitsum Reda, Yogesh Balaji, Huayu Chen, Sheng Liu, Angela Yao, James Zou, Stefano Ermon, Haoxiang Wang, Ming-Yu Liu 3/24/2026

InfoTok: Adaptive Discrete Video Tokenizer via Information-Theoretic Compression

Adaptive discrete video tokenizer using information-theoretic compression for efficient long video sequence processing with variable information density.

Ax Shengyu Cao, Ming Hu 3/24/2026

Collusive Pricing Under LLM

Economic study analyzing how delegating pricing to LLMs can facilitate collusion through propensity and fidelity parameters in duopoly settings.

Ax Abhi Kottamasu, Chirag Mahapatra, Sam Lee, Ben Pan, Aakash Barthwal, Akul Datta, Anurag Gupta, Pranav Mehta, Ajay Arun, Silas Alberti, Adarsh Hiremath, Brendan Foody, Bertie Vidgen 3/24/2026

APEX-SWE

APEX-SWE benchmark assessing frontier AI models on real-world software engineering tasks including integration and debugging work.

Ax Bjarni Haukur Bjarnason, Andr\'e Silva, Martin Monperrus 3/24/2026

On Randomness in Agentic Evals

Analysis of variance in agentic evaluations showing single-run pass@1 scores are unreliable, with 2.2-6.0% variance across 60,000 trajectories.

Ax Rui Cen (Hunyuan AI Infra Team), QiangQiang Hu (Hunyuan AI Infra Team), Hong Huang (Hunyuan AI Infra Team), Hong Liu (Hunyuan AI Infra Team), Song Liu (Hunyuan AI Infra Team), Xin Luo (Hunyuan AI Infra Team), Lin Niu (Hunyuan AI Infra Team), Yifan Tan (Hunyuan AI Infra Team), Decheng Wu (Hunyuan AI Infra Team), Linchuan Xie (Hunyuan AI Infra Team), Rubing Yang (Hunyuan AI Infra Team), Guanghua Yu (Hunyuan AI Infra Team), Jianchen Zhu (Hunyuan AI Infra Team) 3/24/2026

AngelSlim: A more accessible, comprehensive, and efficient toolkit for large model compression

AngelSlim: comprehensive toolkit for large model compression including quantization, speculative decoding, token pruning, and distillation.

Ax Maria Rosaria Briglia, Simone Facchiano, Paolo Cursi, Alessio Sampieri, Emanuele Rodol\`a, Guido Maria D'Amely di Melendugno, Luca Franco, Fabio Galasso, Iacopo Masi 3/24/2026

Not All Latent Spaces Are Flat: Hyperbolic Concept Control

HyCon introduces hyperbolic geometry-based control for text-to-image models to steer generation away from unsafe content using parallel transport.

Ax Shubhashis Roy Dipta, Daniel Bis, Kun Zhou, Lichao Wang, Benjamin Z. Yao, Chenlei Guo, Ruhi Sarikaya 3/24/2026

PA3: Policy-Aware Agent Alignment through Chain-of-Thought

PA3 method for aligning conversational LLM agents with complex business policies using chain-of-thought reasoning without full policy context.

Ax Marcelo Fernandez (TraslaIA) 3/24/2026

Agent Control Protocol: Admission Control for Agent Actions

Agent Control Protocol (ACP) is a formal specification for governance of autonomous agents in institutional environments, using cryptographic admission control to validate agent actions before execution.

Ax Zhuolin Yang, Zihan Liu, Yang Chen, Wenliang Dai, Boxin Wang, Sheng-Chieh Lin, Chankyu Lee, Yangyi Chen, Dongfu Jiang, Jiafan He, Renjie Pi, Grace Lam, Nayeon Lee, Alexander Bukharin, Mohammad Shoeybi, Bryan Catanzaro, Wei Ping 3/24/2026

Nemotron-Cascade 2: Post-Training LLMs with Cascade RL and Multi-Domain On-Policy Distillation

Nemotron-Cascade 2: 30B MoE open model with agentic capabilities, achieving IMO Gold Medal performance with compact 3B activated parameters.

Ax Yogesh Agrawal, Aniruddha Dutta, Md Mahadi Hasan, Santu Karmaker, Aritra Dutta 3/24/2026

FinTradeBench: A Financial Reasoning Benchmark for LLMs

FinTradeBench: financial reasoning benchmark for LLMs evaluating decision-making over heterogeneous signals from regulatory filings and price data.

Ax Yunyi Zhang, Soji Adeshina, Sheng Guan, Ashwin Ganesh, Zhen Han, Vassilis N. Ioannidis, Huzefa Rangwala, George Karypis 3/24/2026

Scalable Prompt Routing via Fine-Grained Latent Task Discovery

Scalable prompt routing method using fine-grained latent task discovery to select optimal LLM from candidate pools.