Ax Venkat Srinivasan, Vishaal Jatav, Anushka Chandrababu, Geetika Sharma 5/14/2026

Gyan: An Explainable Neuro-Symbolic Language Model

Gyan: neuro-symbolic language model combining transformers with symbolic reasoning to improve compositionality, interpretability, and reduce hallucinations.

Ax Musa Cim, Poovaiah Palangappa, Miro Hodak, Ravi Dwivedula, Meena Arunachalam, Mahmut Taylan Kandemir 5/14/2026

Pretraining large language models with MXFP4 on Native FP4 Hardware

Research on FP4 quantization for pretraining large language models, investigating stability and convergence issues in full-pipeline low-precision training on Llama 3.1-8B.

Ax Linus Heck, Filip Mac\'ak, Roman Andriushchenko, Milan \v{C}e\v{s}ka, Sebastian Junges 5/14/2026

Shields to Guarantee Probabilistic Safety in MDPs

Formal framework for probabilistic safety shielding in Markov decision processes with conservative guarantees.

Ax Yaxin Du, Xiyuan Yang, Zhifan Zhou, Wanxu Liu, Zixing Lei, Zimeng Chen, Fenyi Liu, Haotian Wu, Yuzhu Cai, Zexi Liu, Xinyu Zhu, WenHao Wang, Linfeng Zhang, Chen Qian, Siheng Chen 5/14/2026

DataMaster: Data-Centric Autonomous AI Research

DataMaster autonomous system for data-centric ML research automating dataset discovery, adaptation, validation, and knowledge propagation.

Ax Weichen Yu, Xiaomin Li, Yizhou Zhao, Xiaoze Liu, Ruowang Zhang, Haixin Wang, Yinyi Luo, Chen Henry Wu, Gaurav Mittal, Matt Fredrikson, Yu Hu 5/14/2026

Multi-Rollout On-Policy Distillation via Peer Successes and Failures

Multi-rollout on-policy distillation method for LLMs that leverages peer successes and failures to provide denser token-level supervision beyond sparse verifier rewards.

Ax Yujia Zheng, Fan Feng, Yuke Li, Shaoan Xie, Kevin Murphy, Kun Zhang 5/14/2026

From Generalist to Specialist Representation

Nonparametric framework for learning task-relevant specialist representations from generalist models with identifiability analysis.

Ax Joana Pasquali, Ramiro N. Barros, Arthur S. Bianchessi, Vin\'icius Conte Turani, Jo\~ao Vitor Boer Abitante, Rafaela Cappelari Ravazio, Christian Mattjie, Ot\'avio Parraga, Lucas S. Kupssinsk\"u, Rodrigo C. Barros 5/14/2026

Low-Rank Adapters Initialization via Gradient Surgery for Continual Learning

LoRA initialization method using gradient surgery to mitigate catastrophic forgetting in continual LLM fine-tuning.

Ax Vin\'icius Conte Turani, Ot\'avio Parraga, Jo\~ao Vitor Boer Abitante, Kristen K. Arguello, Joana Pasquali, Ramiro N. Barros, Flavio du Pin Calmon, Christian Mattjie, Rodrigo C. Barros, Lucas S. Kupssinsk\"u 5/14/2026

Inference-Time Machine Unlearning via Gated Activation Redirection

Inference-time machine unlearning via gated activation redirection to remove memorized training data from LLMs without retraining.