Ax Per {\AA}hag, Alexander Friedrich, Fredrik Ohlsson, Viktor Vigren N\"aslund 2/18/2026

PolyNODE: Variable-dimension Neural ODEs on M-polyfolds

Extension of neural ODEs to variable-dimensional spaces (M-polyfolds) enabling flexible geometric deep learning beyond fixed-dimensional manifolds.

Ax Nicolas Buzeta, Felipe del Rio, Cristian Hinostroza, Denis Parra, Hans Lobel, Rodrigo Toro Icarte 2/18/2026

Seeing to Generalize: How Visual Data Corrects Binding Shortcuts

Analysis showing vision-language models outperform text-only LLMs on pure text retrieval tasks due to visual training correcting binding shortcuts.

Ax DatologyAI, :, Aldo Gael Carranza, Kaleigh Mentzer, Ricardo Pio Monti, Alex Fang, Alvin Deng, Amro Abbas, Anshuman Suri, Brett Larsen, Cody Blakeney, Darren Teh, David Schwab, Diego Kiner, Fan Pan, Haakon Mongstad, Jack Urbanek, Jason Lee, Jason Telanoff, Josh Wills, Luke Merrick, Parth Doshi, Paul Burstein, Pratyush Maini, Spandan Das, Tony Jiang, Vineeth Dorna, Zhengping Wang, Bogdan Gaza, Ari Morcos, Matthew Leavitt 2/18/2026

\"UberWeb: Insights from Multilingual Curation for a 20-Trillion-Token Dataset

Study of multilingual data curation across 13 languages for foundation models, addressing performance interference and uneven data availability in multilingual training.

Ax Atticus Wang, Iv\'an Arcuschin, Arthur Conmy 2/18/2026

Automatically Finding Reward Model Biases

Research on automatically detecting biases in reward models used for LLM post-training, proposing iterative LLM-based approach to identify spurious attributes like length, format, and hallucinations.

Ax Alessio Mazzetto (Brown University), Mohammad Mahdi Khalili (Ohio State University, Yahoo Research), Laura Fee Nern (Yahoo Research), Michael Viderman (Yahoo Research), Alex Shtoff (Technology Innovation Institute), Krzysztof Dembczy\'nski (Yahoo Research, Poznan University of Technology) 2/18/2026

tensorFM: Low-Rank Approximations of Cross-Order Feature Interactions

tensorFM model for efficient prediction on tabular categorical data by capturing high-order feature interactions with low-rank approximations.

Ax Dongxu Zhang, Zhichao Yang, Sepehr Janghorbani, Jun Han, Andrew Ressler II, Qian Qian, Gregory D. Lyng, Sanjit Singh Batra, Robert E. Tillman 2/18/2026

Fast and Effective On-policy Distillation from Reasoning Prefixes

On-policy distillation method sampling from reasoning prefixes to reduce training cost while maintaining benefits of token-level teacher supervision.

Ax Mohammad Partohaghighi, Roummel Marcia, YangQuan Chen 2/18/2026

Fractional-Order Federated Learning

Fractional-order variant of federated averaging addressing slow convergence, communication costs, and non-IID data distribution challenges.

Ax Tom Trigano, Yann Sepulcre, Itshak Lapidot 2/18/2026

Doubly Stochastic Mean-Shift Clustering

Extension of mean-shift clustering introducing randomness in both trajectory updates and kernel bandwidth for improved handling of data-scarce regimes.

Ax Beatrix M. B. Nielsen, Emanuele Marconato, Luigi Gresele, Andrea Dittadi, Simon Buchholz 2/18/2026

Logit Distance Bounds Representational Similarity

Theoretical analysis showing logit distance bounds representational similarity in discriminative models including language models.

Ax Dmitry Zhevnenko, Ilya Makarov, Aleksandr Kovalenko, Fedor Meshchaninov, Anton Kozhukhov, Vladislav Travnikov, Makar Ippolitov, Kirill Yashunin, Iurii Katser 2/18/2026

Benchmarking IoT Time-Series AD with Event-Level Augmentations

Benchmark protocol for IoT anomaly detection with event-level evaluation under realistic perturbations like sensor dropout and drift.

Ax Jan Kobiolka, Christian Frey, Gresa Shala, Arlind Kadra, Erind Bedalli, Josif Grabocka 2/18/2026

POP: Prior-fitted Optimizer Policies

Meta-learned optimizer predicting coordinate-wise step sizes to address hyperparameter sensitivity in gradient-based optimization for non-convex settings.

Ax Aadirupa Saha, Aniket Wagde, Branislav Kveton 2/18/2026

LLM-as-Judge on a Budget

Addresses optimal query allocation for LLM-as-judge evaluation under fixed computational budget to minimize estimation error in prompt-response scoring.

Ax 5 Team, Aohan Zeng, Xin Lv, Zhenyu Hou, Zhengxiao Du, Qinkai Zheng, Bin Chen, Da Yin, Chendi Ge, Chengxing Xie, Cunxiang Wang, Gengzheng Pan, Hao Zeng, Haoke Zhang, Haoran Wang, Huilong Chen, Jiajie Zhang, Jian Jiao, Jiaqi Guo, Jingsen Wang, Jingzhao Du, Jinzhu Wu, Kedong Wang, Lei Li, Lin Fan, Lucen Zhong, Mingdao Liu, Mingming Zhao, Pengfan Du, Qian Dong, Rui Lu, Shuang-Li, Shulin Cao, Song Liu, Ting Jiang, Xiaodong Chen, Xiaohan Zhang, Xuancheng Huang, Xuezhen Dong, Yabo Xu, Yao Wei, Yifan An, Yilin Niu, Yitong Zhu, Yuanhao Wen, Yukuo Cen, Yushi Bai, Zhongpei Qiao, Zihan Wang, Zikang Wang, Zilin Zhu, Ziqiang Liu, Zixuan Li, Bojie Wang, Bosi Wen, Can Huang, Changpeng Cai, Chao Yu, Chen Li, Chen Li, Chenghua Huang, Chengwei Hu, Chenhui Zhang, Chenzheng Zhu, Congfeng Yin, Daoyan Lin, Dayong Yang, Di Wang, Ding Ai, Erle Zhu, Fangzhou Yi, Feiyu Chen, Guohong Wen, Hailong Sun, Haisha Zhao, Haiyi Hu, Hanchen Zhang, Hanrui Liu, Hanyu Zhang, Hao Peng, Hao Tai, Haobo Zhang, He Liu, Hongwei Wang, Hongxi Yan, Hongyu Ge, Huan Liu, Huan Liu, Huanpeng Chu, Jia'ni Zhao, Jiachen Wang, Jiajing Zhao, Jiamin Ren, Jiapeng Wang, Jiaxin Zhang, Jiayi Gui, Jiayue Zhao, Jijie Li, Jing An, Jing Li, Jingwei Yuan, Jinhua Du, Jinxin Liu, Junkai Zhi, Junwen Duan, Kaiyue Zhou, Kangjian Wei, Ke Wang, Keyun Luo, Laiqiang Zhang, Leigang Sha, Liang Xu, Lindong Wu, Lintao Ding, Lu Chen, Minghao Li, Nianyi Lin, Pan Ta, Qiang Zou, Rongjun Song, Ruiqi Yang, Shangqing Tu, Shangtong Yang, Shaoxiang Wu, Shengyan Zhang, Shijie Li, Shuang Li, Shuyi Fan, Wei Qin, Wei Tian, Weining Zhang, Wenbo Yu, Wenjie Liang, Xiang Kuang, Xiangmeng Cheng, Xiangyang Li, Xiaoquan Yan, Xiaowei Hu, Xiaoying Ling, Xing Fan, Xingye Xia, Xinyuan Zhang, Xinze Zhang, Xirui Pan, Xunkai Zhang, Yandong Wu, Yanfu Li, Yidong Wang, Yifan Zhu, Yijun Tan, Yilin Zhou, Yiming Pan, Ying Zhang, Yinpei Su, Yipeng Geng, Yipeng Geng, Yong Yan, Yonglin Tan, Yuean Bi, Yuhan Shen, Yuhao Yang, Yujiang Li, Yunan Liu, Yunqing Wang, Yuntao Li, Yurong Wu, Yutao Zhang, Yuxi Duan, Yuxuan Zhang, Zezhen Liu, Zhengtao Jiang, Zhenhe Yan, Zheyu Zhang, Zhixiang Wei, Zhuo Chen, Zhuoer Feng, Zijun Yao, Ziwei Chai, Ziyuan Wang, Zuzhou Zhang, Bin Xu, Minlie Huang, Hongning Wang, Juanzi Li, Yuxiao Dong, Jie Tang 2/18/2026

GLM-5: from Vibe Coding to Agentic Engineering

GLM-5 foundation model for agentic engineering with reasoning and coding capabilities, using DSA for efficiency and asynchronous RL for alignment.

Ax Max Springer, Chung Peng Lee, Blossom Metevier, Jane Castleman, Bohdan Turbal, Hayoung Jung, Zeyu Shen, Aleksandra Korolova 2/18/2026

The Geometry of Alignment Collapse: When Fine-Tuning Breaks Safety

Study of how fine-tuning aligned LLMs on benign tasks degrades safety guardrails due to unstable orthogonality in parameter space.