Ax Gang Liao, Hongsen Qin, Ying Wang, Alicia Golden, Michael Kuchnik, Yavuz Yetim, Jia Jiunn Ang, Chunli Fu, Yihan He, Samuel Hsia, Zewei Jiang, Dianshi Li, Uladzimir Pashkevich, Varna Puvvada, Feng Shi, Matt Steiner, Ruichao Xiao, Liyuan Li, Nathan Yan, Xiayu Yu, Zhou Fang, Roman Levenstein, Kunming Ho, Haishan Zhu, Alec Hammond, Richard Li, Ajit Mathews, Kaustubh Gondkar, Abdul Zainul-Abedin, Ketan Singh, Hongtao Yu, Wenyuan Chi, Barney Huang, Sean Zhang, Noah Weller, Zach Marine, Wyatt Cook, Carole-Jean Wu, Gaoxiang Liu 23d ago

KernelEvolve: Scaling Agentic Kernel Coding for Heterogeneous AI Accelerators at Meta

Agentic framework for automated kernel code generation across heterogeneous AI accelerators at scale for recommendation models.

Ax Ramnath Kumar, Kyle Ritscher, Junmin Judy, Lawrence Liu, Cho-Jui Hsieh 23d ago

FlexAct: Why Learn when you can Pick?

Research on learning discrete activation functions using Gumbel-Softmax for task-specific neural networks.

Ax Gloria Felicia (University of Virginia), Zitha Sasindran (Indian Institute of Science Bangalore), Jinfeng He (Cornell University), Michael Eniolade (University of the Cumberlands), Hemant Kumar (University of Arizona), Milan Hussain Angati (California State University Northridge) 23d ago

StepShield: When, Not Whether to Intervene on Rogue Agents

StepShield benchmark for agent safety measuring detection timeliness of rogue agent behavior on 9,429 code-agent trajectories.

Ax Stefano Woerner, Seong Joon Oh, Christian F. Baumgartner 23d ago

Universal Algorithm-Implicit Learning

Meta-learning framework defining practical universality and generalizable learning across arbitrary task distributions.

Ax Huaiyang Wang, Xiaojie Li, Xiaohan Wang, Zhixia Zhang, Xiaodong Lu, Zixuan Huang, Jiajun Chai, Guojun Yin, Deqing Wang, Haoyi Zhou, Yaodong Yang, Jianxin Li, Yikun Ban 23d ago

Policy Improvement Reinforcement Learning

Policy Improvement RL method for post-training LLMs and agents that explicitly verifies policy improvements over baselines.

Ax Kathan Shah 23d ago

Token Geometry

Lightweight optimizer exploiting gradient geometry of embedding tables and LM-heads for improved training efficiency across finetuning and pretraining.

Ax Joachim Tomasi, Sandrine Anthoine, Hachem Kadri 23d ago

Benign Overfitting with Quantum Kernels

Theoretical study of benign overfitting in quantum kernel methods for machine learning on quantum computers.

Ax Lianghua Huang, Zhi-Fan Wu, Yupeng Shi, Wei Wang, Mengyang Feng, Junjie He, Chen-Wei Xie, Yu Liu, Jingren Zhou, Ang Wang, Bang Zhang, Baole Ai, Chen Liang, Cheng Yu, Chongyang Zhong, Jinwei Qi, Kai Zhu, Pandeng Li, Peng Zhang, Wenyuan Zhang, Xinhua Cheng, Yitong Huang, Yun Zheng, Yuxiang Bao, Yuzheng Wang, Zoubin Bi 23d ago

Wan-Streamer v0.2: Higher Resolution, Same Latency

arXiv paper on Wan-Streamer v0.2, audio-visual interaction model achieving higher resolution (640x368) while maintaining 200ms latency.

Ax Zhifeng Kong, Sang-gil Lee, Jaehyeon Kim, Boxin Wang, Zihan Liu, Sungwon Kim, Yang Chen, Arushi Goel, Rajarshi Roy, Wenliang Dai, Zhuolin Yang, Yangyi Chen, Dongfu Jiang, Sreyan Ghosh, Tuomas Rintamaki, Andrew Tao, Jonathan Raiman, Mohammad Shoeybi, Bryan Catanzaro, Wei Ping 23d ago

Unified Audio Intelligence Without Regressing on Text Intelligence

arXiv paper introducing Nemotron Audex-30B-A3B, unified audio-text LLM maintaining text performance while adding audio understanding.

Ax Anthony Hu, V\'aclav Volhejn, Adrien Ramanana Rahary, Chris Mulder, Aditya Makkar, Alyx Liao, Am\'elie Royer, Manu Orsini, Adam Jelley, Eloi Alonso, Florian Laurent, Fredrik Nor\'en, James Swingos, Jan H\"unermann, Kent Rollins, Lucas Hosseini, Matthieu Le Cauchois, Maxim Peter, Pim de Witte, Tim Brown, Vincent Micheli, Moritz B\"ohle, Gabriel de Marmiesse, Viktoriia Sharmanska, Lucia Specia, Michael Black, Patrick P\'erez 23d ago

Multiplayer Interactive World Models with Representation Autoencoders

arXiv paper on multiplayer world models for dynamic environments with complex physics, conditioning on multiple agent action streams.