Ax Faith Wavinya Mutinda, Spandana Makeneni, Anna Lin, Shivaji Dutta, Irit R. Rasooly, Patrick Dibussolo, Shivani Kamath Belman, Hessam Shahriari, Kevin Murphy, Alex B. Ruan, Barbara H. Chaiyachati, Sanjay Chainani, Robert W. Grundmeier, Scott M. Haag, Jeffrey M. Miller, Heather M. Griffis, Ian M. Campbell 22d ago

Health System Scale Semantic Search Across Unstructured Clinical Notes

Semantic search system for clinical notes at health system scale using embeddings. LLM application but domain-specific healthcare focus.

Ax Akshansh, Leonardo Rosa Rodrigues, Michael Korostelev, Youssef Hassan, Mark E. Whiting 22d ago

Trading Human Curation for Synthetic Augmentation in RLVR

Research on scaling reinforcement learning from verifiable rewards for agentic LLMs using synthetic task augmentation instead of human curation.

Ax Ce Chen, Congrui Wang, Yonglin Li, Zhenchen Wan, Mingyang Geng, Junhao Xiao, Zhengpeng Xing, Yaqing Hu, Yao Wu, Zhaoyang Qu, Long Lan, Xinwang Liu, Yingqi Peng, Shijia Li, Zufeng Zhang, Chen Ma, Jingjing Zhou, Xingyu Wang, Qilin Lu, Bin Jiang, Qilin Sun, Shanzhi Gu, Yaoguang Jin, Tongliang Liu, Kede Ma, Yifan Peng 22d ago

JuZhou 1.0 Technical Report: The First Edge-Native Text-to-Image Foundation Model Trained Entirely on China-Developed AI Accelerators

JuZhou 1.0 is ultra-lightweight text-to-image model designed for edge deployment and offline execution on China-developed AI accelerators.

Ax Tianxing Chen, Yue Chen, Zixuan Li, Junyuan Tang, Kailun Su, Haoran Lu, Weijie Wan, Baijun Chen, Songling Liu, Haowen Yan, Honghao Su, Zhiyang Dou, Kaixuan Wang, Dandan Zhang, Yunze Liu, Yan Qin, Qiwei Liang, Qiwei Wu, Zijian Lin, Wenwei Lin, Yuran Wang, Minghua He, Tianshu Wu, Ruihai Wu, Jingquan Zhou, Kai-Chong Lei, Haibao Yu, Yuanfeng Ji, Weiyang Jin, Guanyu Lin, Xiaofan Li, Qi Xiong, Renjing Xu, Zhongyu Li, Wenhao Chai, Enze Xie, Ziwei Wang, Yao Mu, Hao Dong, Wojciech Matusik, Mingyu Ding, Wenbo Ding, Ping Luo, Masayoshi Tomizuka 22d ago

RoboDojo: A Unified Sim-and-Real Benchmark for Comprehensive Evaluation of Generalist Robot Manipulation Policies

RoboDojo provides unified sim-and-real benchmark for evaluating generalist robot manipulation policies across diverse tasks.

Ax Lianghua Huang, Zhi-Fan Wu, Yupeng Shi, Wei Wang, Mengyang Feng, Junjie He, Chen-Wei Xie, Yu Liu, Jingren Zhou, Ang Wang, Bang Zhang, Baole Ai, Chen Liang, Cheng Yu, Chongyang Zhong, Jinwei Qi, Kai Zhu, Pandeng Li, Peng Zhang, Wenyuan Zhang, Xinhua Cheng, Yitong Huang, Yun Zheng, Yuxiang Bao, Yuzheng Wang, Zoubin Bi 22d ago

Wan-Streamer v0.2: Higher Resolution, Same Latency

Wan-Streamer v0.2 improves resolution of native-streaming audio-visual interaction model while maintaining 200ms latency.

Ax Shiyuan Feng, Huan-ang Gao, Haohan Chi, Hanlin Wu, Zhilong Zhang, Zheng Jiang, Bingxiang He, Wei-Ying Ma, Ya-Qin Zhang, Hao Zhou 22d ago

Weak-to-Strong Generalization via Direct On-Policy Distillation

Weak-to-Strong Generalization enables cheaper RL post-training by running RL on small models then distilling to larger models for improved reasoning.

Ax Yipeng Liu, Chang Liu, Si Shen, Jiaqi Zheng, Mingfan Li, Yuyang Yang, Guanhua Li, Yuquan Zhang, Yimeng Xu, Zhongzhe Hu, Zhiyuan Huang, Qihang Duan, Junsong Wang, Wenkai Ling, Baochuan Yang, Xianzhi Yu, Han Bao, Yijie Chen, Guihai Chen 22d ago

UBEP: Re-architecting Expert Parallelism Communication Library for Production Superpods

UBEP optimizes Mixture-of-Experts model communication on high-bandwidth superpods by addressing execution serialization and bandwidth bottlenecks in production deployments.

Ax Xiaolong Huang, Benjamin Th\'erien, James Harrison, Eugene Belilovsky 22d ago

Efficient Long-Horizon Learning for Learned Optimization

Meta-learning approach for learned optimizers that efficiently scales to long-horizon inner problems, improving upon hand-designed optimizers like Adam.

Ax Yi\u{g}it Berkay Uslu, Samar Hadou, Sergio Rozada, Shirin Saeedi Bidokhti, Alejandro Ribeiro 22d ago

Generative Diffusion Models of Stochastic Graph Signals

Generative diffusion models for sampling stochastic signals on graphs, applied to recommender systems and financial forecasting.

Ax Tolgay Atinc Uzun, Waleed Khalid, Saif U Din, Sai Revanth Mulukuledu, Akashdeep Singh, Chandini Vysyaraju, Raghuvir Duvvuri, Avi Goyal, Yashkumar Rajeshbhai Lukhi, Muhammad A. Hussain, Krunal Jesani, Usha Shrestha, Yash Mittal, Roman Kochnev, Pritam Kadam, Mohsin Ikram, Harsh R. Moradiya, Alice Arslanian, Dmitry Ignatov, Radu Timofte 22d ago

LEMUR 2: Unlocking Neural Network Diversity for AI

LEMUR 2: Large-scale extensible NAS benchmark with 14,000+ distinct architectures and 750,000+ training records for cross-domain neural architecture evaluation.

Ax Tianyi Ma, Hanzhang Qin, Ruihao Zhu, Jierui Zuo 22d ago

Best-Arm Identification with Generative Proxy

Best-arm identification algorithm that pairs costly reward observations with cheap proxy scores from LLMs to improve data-driven decision-making efficiency.