Ax Sanyam Singh, Naga Ganesh, Vineet Singh, Lakshmi Pedapudi, Ritesh Kumar, SSP Jyothi, Archana Karanam, Waseem Pasha, Ekta Kumari, C. Yashoda, Mettu Vijaya Rekha Reddy, Shesha Phani Debbesa, Chandan Dash 3/9/2026

Fine-Tuning and Evaluating Conversational AI for Agricultural Advisory

Hybrid LLM architecture fine-tuned for agricultural advisory with domain-specific knowledge to provide accurate, actionable recommendations.

Ax Haoran Lu, Shang Wu, Jianshu Zhang, Maojiang Su, Guo Ye, Chenwei Xu, Lie Lu, Pranav Maneriker, Fan Du, Manling Li, Zhaoran Wang, Han Liu 3/9/2026

Phys4D: Fine-Grained Physics-Consistent 4D Modeling from Video Diffusion

Phys4D: Three-stage pipeline ensuring physics consistency in 4D world models generated from video diffusion models through iterative refinement.

Ax Alan Chan, Ranay Padarath, Joe Kwon, Hilary Greaves, Markus Anderljung 3/9/2026

Measuring AI R&D Automation

Analysis of AI R&D automation extent and effects, proposing empirical frameworks beyond capability benchmarks to measure real-world AIRDA impact.

Ax Xunzhuo Liu, Huamin Chen, Samzong Lu, Yossi Ovadia, Guohong Wen, Hao Wu, Zhengda Tan, Jintao Zhang, Senan Zedan, Yehudit Kerido, Liav Weiss, Haichen Zhang, Bishen Yu, Asaad Balum, Noa Limoy, Abdallah Samara, Baofa Fan, Brent Salisbury, Ryan Cook, Zhijie Wang, Qiping Pan, Rehan Khan, Avishek Goswami, Houston H. Zhang, Shuyi Wang, Ziang Tang, Fang Han, Zohaib Hassan, Jianqiao Zheng, Avinash Changrani 3/9/2026

vLLM Semantic Router: Signal Driven Decision Routing for Mixture-of-Modality Models

vLLM Semantic Router: Inference framework for intelligent request routing across diverse multimodal LLM deployments using composable signal orchestration.

Ax Chengwei Wu 3/9/2026

VDCook:DIY video data cook your MLLMs

VDCook: A configurable platform for constructing video datasets for multimodal LLMs via natural language queries, combining real retrieval with controlled synthesis.

Ax Levy Chaves, Chao Zhou, Rebekka Burkholz, Eduardo Valle, Sandra Avila 3/9/2026

Bridging Domains through Subspace-Aware Model Merging

Research on merging task-specific models for domain generalization, analyzing parameter competition and singular value decomposition of task matrices.

Ax Marmik Chaudhari, Idhant Gulati, Nishkal Hundia, Pranav Karra, Shivam Raval 3/9/2026

MoE Lens -- An Expert Is All You Need

Analysis of expert specialization in Mixture of Experts models through routing patterns and early decoding framework to understand inference behavior.

Ax Zongfang Liu, Shengkun Tang, Boyang Sun, Zhiqiang Shen, Xin Yuan 3/9/2026

EvoESAP: Non-Uniform Expert Pruning for Sparse MoE

EvoESAP non-uniform expert pruning method for Sparse Mixture-of-Experts language models with evolved layer-wise sparsity allocation.

Ax Zhipeng Yao, Rui Yu, Guisong Chang, Ying Li, Yu Zhang, Dazhou Li 3/9/2026

Dynamic Momentum Recalibration in Online Gradient Learning

Dynamic Momentum Recalibration method for SGD variants that adaptively adjusts momentum coefficients to balance bias-variance tradeoff in gradient updates.

Ax Puneet Mathur, Branislav Kveton, Subhojyoti Mukherjee, Viet Dac Lai 3/9/2026

Partial Policy Gradients for RL in LLMs

Partial Policy Gradients method for reinforcement learning in LLMs that optimizes subsets of future rewards to improve policy gradient accuracy.

Ax Lin Niu, Xin Luo, Linchuan Xie, Yifu Sun, Guanghua Yu, Jianchen Zhu, S Kevin Zhou 3/9/2026

Stem: Rethinking Causal Information Flow in Sparse Attention

Stem rethinks sparse attention mechanisms from information flow perspective to reduce quadratic computational complexity during LLM pre-filling for long contexts.