Ax Anton Baumann, Rui Li, Marcus Klasson, Santeri Mentu, Shyamgopal Karthik, Zeynep Akata, Arno Solin, Martin Trapp 2/16/2026

Post-hoc Probabilistic Vision-Language Models

Post-hoc method adding probabilistic uncertainty to vision-language models like CLIP to better handle domain shifts in downstream tasks.

Ax Dheeraj Vattikonda, Santhoshi Ravichandran, Emiliano Penaloza, Hadi Nekoei, Megh Thakkar, Thibault Le Sellier de Chezelles, Nicolas Gontier, Miguel Mu\~noz-M\'armol, Sahar Omidi Shayegan, Stefania Raimondo, Xue Liu, Alexandre Drouin, Laurent Charlin, Alexandre Pich\'e, Alexandre Lacoste, Massimo Caccia 2/16/2026

How to Train Your LLM Web Agent: A Statistical Diagnosis

Statistical diagnosis and training methods for LLM-based web agents addressing multi-step interactions and reducing post-training compute costs.

Ax Sarah McClure, Evyatar Cohen, Alex Shpiner, Mark Silberstein, Sylvia Ratnasamy, Scott Shenker, Isaac Keslassy 2/16/2026

Load Balancing for AI Training Workloads

Technical analysis of load-balancing designs for AI training workloads, comparing approaches and establishing optimality bounds for distributed training.

Ax Gabriela Pinto, Palash Goyal, Mihir Parmar, Yiwen Song, Souradip Chakraborty, Zifeng Wang, Jinsung Yoon, Hamid Palangi, Tomas Pfister 2/16/2026

HEART: Emotionally-Driven Test-Time Scaling of Language Models

HEART framework uses emotional cues during test-time scaling to improve LLM problem-solving by preventing repetitive thought patterns through alternating critical and encouraging tones.

Ax Leonardo Christov-Moore, Arthur Juliani, Alex Kiefer, Joel Lehman, Nicco Reggente, B. Scot Rousse, Adam Safron, Nicol\'as Hinrichs, Daniel Polani, Antonio Damasio 2/16/2026

The Conditions of Physical Embodiment Enable Generalization and Care

Research on physical embodiment constraints for AI agents in eldercare and disaster response scenarios, addressing generalization and care provision under uncertainty.

Ax Bangzheng Li, Jianmo Ni, Chen Qu, Ian Miao, Liu Yang, Xingyu Fu, Muhao Chen, Derek Zhiyuan Cheng 2/16/2026

Reinforced Attention Learning

Policy-gradient framework optimizing internal attention distributions in multimodal LLMs for improved reasoning without verbose rationales.

Ax Aboli Kathar, Aman Kumar, Anusha Kamath, Araveeti Srujan, Ashish Sharma, Chandra Bhushan, Divya Sorate, Duddu Prasanth Kumar, Evan Acharya, Harsh Sharma, Hrithik Kadam, Kanishk Singla, Keyur Doshi, Kiran Praveen, Kolisetty Krishna SK, Krishanu Adhikary, Lokesh MPT, Mayurdeep Sonowal, Nadeem Shaikh, Navya Prakash, Nimit Kothari, Nitin Kukreja, Prashant Devadiga, Rakesh Paul, Ratanjeet Pratap Chauhan, Raunak Kalani, Raviraj Joshi, Shamanth MH, Shantanu Pandey, Shubham Soni, Siddharth Dixit, Smriti Jopat, Sunil Patel, Suraj Singh, Suvradip Paul, Tulasi Pilla, Utkarsh Vaidya, Vineeth Nambiar, Vishal Kanvaty, Yatharth Dedhia 2/16/2026

FiMI: A Domain-Specific Language Model for Indian Finance Ecosystem

Domain-specialized financial language model for Indian digital payment systems, developed by NPCI using multi-stage training on 68B tokens.

Ax Alon Beck, Yohai Bar Sinai, Noam Levi 2/16/2026

The Implicit Bias of Logit Regularization

Theoretical analysis of logit regularization in linear classifiers, examining implicit bias mechanisms of label smoothing and related convex penalties.

AR Neemias da Silva, J\'ulio C. W. Scholz, John Harrison, Marina Borges, Paulo \'Avila, Frances A Santos, Myriam Delgado, Rodrigo Minetto, Thiago H Silva 2/16/2026

Grandes Modelos de Linguagem Multimodais (MLLMs): Da Teoria \`a Pr\'atica

arXiv paper on multimodal LLMs covering fundamentals, emblematic models, and practical techniques for preprocessing, prompt engineering, and building pipelines with LangChain and LangGraph.

AR Ziqian Zhang, Xingjian Hu, Yue Huang, Kai Zhang, Ruoxi Chen, Yixin Liu, Qingsong Wen, Kaidi Xu, Xiangliang Zhang, Neil Zhenqiang Gong, Lichao Sun 2/16/2026

RankLLM: Weighted Ranking of LLMs by Quantifying Question Difficulty

RankLLM framework quantifying question difficulty in benchmarks to better differentiate LLM capabilities across model comparisons.

AR Longze Chen, Lu Wang, Renke Shan, Ze Gong, Run Luo, Jiaming Li, Jing Luo, Qiyao Wang, Min Yang 2/16/2026

Learning Ordinal Probabilistic Reward from Preferences

Novel reward modeling paradigm combining generative and discriminative approaches for probabilistic preference-based LLM alignment.

AR Baorong Shi, Bo Cui, Boyuan Jiang, Deli Yu, Fang Qian, Haihua Yang, Huichao Wang, Jiale Chen, Jianfei Pan, Jieqiong Cao, Jinghao Lin, Kai Wu, Lin Yang, Shengsheng Yao, Tao Chen, Xiaojun Xiao, Xiaozhong Ji, Xu Wang, Yijun He, Zhixiong Yang 2/16/2026

MedXIAOHE: A Comprehensive Recipe for Building Medical MLLMs

MedXIAOHE medical multimodal foundation model with entity-aware pretraining for clinical image and text understanding tasks.