Ax David Campbell, Neil Kale, Udari Madhushani Sehwag, Bert Herring, Nick Price, Dan Borges, Alex Levinson, Christina Q Knight 3/12/2026

Defensive Refusal Bias: How Safety Alignment Fails Cyber Defenders

Study of safety alignment failures in LLMs for cybersecurity, where defensive refusal bias prevents assistance for legitimate defensive tasks.

Ax Dylan R. Ashley, Jan Przepi\'ora, Yimeng Chen, Ali Abualsaud, Nurzhan Yesmagambet, Shinkyu Park, Eric Feron, J\"urgen Schmidhuber 3/12/2026

RACAS: Controlling Diverse Robots With a Single Agentic System

Agentic system enabling unified control of diverse robotic platforms through a single interface, bridging low-level APIs to high-level autonomous behavior.

Ax Shijia Liao, Yuxuan Wang, Songting Liu, Yifan Cheng, Ruoyi Zhang, Tianyu Li, Shidong Li, Yisheng Zheng, Xingwei Liu, Qingzheng Wang, Zhizhuo Zhou, Jiahua Liu, Xin Chen, Dawei Han 3/12/2026

Fish Audio S2 Technical Report

Open-source text-to-speech system with multi-speaker generation and natural-language instruction control.

Ax Tenny Yin, Zhiting Mei, Zhonghe Zheng, Miyu Yamane, David Wang, Jade Sceats, Samuel M. Bateman, Lihan Zha, Apurva Badithela, Ola Shorinwa, Anirudha Majumdar 3/12/2026

PlayWorld: Learning Robot World Models from Autonomous Play

PlayWorld autonomous pipeline for learning robot world models through self-play using action-conditioned video models for manipulation tasks.

Ax Junfeng Liao, Qizhou Wang, Shanshan Ye, Xin Yu, Ling Chen, Zhen Fang 3/12/2026

Explainable LLM Unlearning Through Reasoning

Research on explainable LLM unlearning using reasoning-based approach to remove undesirable knowledge while preserving general capabilities.

Ax Reza Rahimi Azghan, Gautham Krishna Gudur, Mohit Malu, Edison Thomaz, Giulia Pedrielli, Pavan Turaga, Hassan Ghasemzadeh 3/12/2026

Gated Adaptation for Continual Learning in Human Activity Recognition

Continual learning method using gated adaptation for human activity recognition in IoT wearable sensors addressing catastrophic forgetting.

Ax Dan Lee, Seungwook Han, Akarsh Kumar, Pulkit Agrawal 3/12/2026

Training Language Models via Neural Cellular Automata

Research proposes neural cellular automata for generating synthetic non-linguistic training data as alternative to natural language for LLM pretraining.

Ax Jian Li, Dongsheng Chen, Zhenhua Xu, Yizhang Jin, Jiafu Wu, Chengjie Wang, Xiaotong Yuan, Yabiao Wang 3/12/2026

Improving Search Agent with One Line of Code

Research on Tool-based Agentic RL identifies Importance Sampling Distribution Drift causing training instability in search agents using external tools.

Ax Ruizhong Qiu, Hanqing Zeng, Yinglong Xia, Yiwen Meng, Ren Chen, Jiarui Feng, Dongqi Fu, Qifan Wang, Jiayi Liu, Jun Xiao, Xiangjun Fan, Benyu Zhang, Hong Li, Zhining Liu, Hyunsik Yoo, Zhichen Zeng, Tianxin Wei, Hanghang Tong 3/12/2026

ReMix: Reinforcement routing for mixtures of LoRAs in LLM finetuning

ReMix applies reinforcement learning to route inputs across specialized LoRA adapters during LLM finetuning for parameter efficiency.

Ax Maxwell Miller-Golub, Kamil Faber, Marcin Pietron, Panpan Zheng, Pasquale Minervini, Roberto Corizzo 3/12/2026

Rethinking the Harmonic Loss via Non-Euclidean Distance Layers

Harmonic loss function using non-Euclidean distance layers addresses interpretability and training inefficiencies in deep neural networks.