AR Bangzheng Li, Jianmo Ni, Chen Qu, Ian Miao, Liu Yang, Xingyu Fu, Muhao Chen, Derek Zhiyuan Cheng 2/16/2026

Reinforced Attention Learning

Reinforced Attention Learning (RAL): Policy-gradient framework optimizing internal attention distributions in multimodal LLMs via RL post-training.

AR Yutao Zhu, Xingshuo Zhang, Maosen Zhang, Jiajie Jin, Liancheng Zhang, Xiaoshuai Song, Kangzhi Zhao, Wencong Zeng, Ruiming Tang, Han Li, Ji-Rong Wen, Zhicheng Dou 2/16/2026

GISA: A Benchmark for General Information-Seeking Assistant

GISA benchmark for evaluating information-seeking agents that perform multi-turn web interactions with naturally-constructed queries aligned to real-world needs.

AR Chengsong Huang, Wenhao Yu, Xiaoyang Wang, Hongming Zhang, Zongxia Li, Ruosen Li, Jiaxin Huang, Haitao Mi, Dong Yu 2/16/2026

R-Zero: Self-Evolving Reasoning LLM from Zero Data

R-Zero: self-evolving LLM framework that autonomously generates and learns from experiences without extensive human-curated data.

AR Aboli Kathar, Aman Kumar, Anusha Kamath, Araveeti Srujan, Ashish Sharma, Chandra Bhushan, Divya Sorate, Duddu Prasanth Kumar, Evan Acharya, Harsh Sharma, Hrithik Kadam, Kanishk Singla, Keyur Doshi, Kiran Praveen, Kolisetty Krishna SK, Krishanu Adhikary, Lokesh MPT, Mayurdeep Sonowal, Nadeem Shaikh, Navya Prakash, Nimit Kothari, Nitin Kukreja, Prashant Devadiga, Rakesh Paul, Ratanjeet Pratap Chauhan, Raunak Kalani, Raviraj Joshi, Shamanth MH, Shantanu Pandey, Shubham Soni, Siddharth Dixit, Smriti Jopat, Sunil Patel, Suraj Singh, Suvradip Paul, Tulasi Pilla, Utkarsh Vaidya, Vineeth Nambiar, Vishal Kanvaty, Yatharth Dedhia 2/16/2026

FiMI: A Domain-Specific Language Model for Indian Finance Ecosystem

FiMI: domain-specialized financial language model for Indian digital payments, adapted from Mistral Small with multilingual capabilities.

AR Sedigheh Eslami, Maksim Gaiduk, Markus Krimmel, Louis Milliken, Bo Wang, Denis Bykov 2/16/2026

Diffusion-Pretrained Dense and Contextual Embeddings

pplx-embed: multilingual embedding models using diffusion-based pretraining and contrastive learning for web-scale retrieval tasks.

AR Baorong Shi, Bo Cui, Boyuan Jiang, Deli Yu, Fang Qian, Haihua Yang, Huichao Wang, Jiale Chen, Jianfei Pan, Jieqiong Cao, Jinghao Lin, Kai Wu, Lin Yang, Shengsheng Yao, Tao Chen, Xiaojun Xiao, Xiaozhong Ji, Xu Wang, Yijun He, Zhixiong Yang 2/16/2026

MedXIAOHE: A Comprehensive Recipe for Building Medical MLLMs

Medical vision-language foundation model with entity-aware pretraining for clinical applications. SOTA on medical benchmarks.