DT Helder Burato Berto 2/13/2026

Building Shareable AI Agent Skills

Short article discussing building reusable AI agent skills to avoid repetitive instruction setup across sessions with Claude Code.

BL 2/13/2026

Scaling social science research

GABRIEL is an open-source toolkit using GPT to convert qualitative text and images into quantitative data for social science research.

HF Baorong Shi, Bo Cui, Boyuan Jiang, Deli Yu, Fang Qian, Haihua Yang, Huichao Wang, Jiale Chen, Jianfei Pan, Jieqiong Cao, Jinghao Lin, Kai Wu, Lin Yang, Shengsheng Yao, Tao Chen, Xiaojun Xiao, Xiaozhong Ji, Xu Wang, Yijun He, Zhixiong Yang 2/13/2026

MedXIAOHE: A Comprehensive Recipe for Building Medical MLLMs

MedXIAOHE: medical vision-language foundation model with entity-aware pretraining for clinical applications, achieves SOTA on medical benchmarks.

HF Rui Cai, Jun Guo, Xinze He, Piaopiao Jin, Jie Li, Bingxuan Lin, Futeng Liu, Wei Liu, Fei Ma, Kun Ma, Feng Qiu, Heng Qu, Yifei Su, Qiao Sun, Dong Wang, Donghao Wang, Yunhong Wang, Rujie Wu, Diyun Xiang, Yu Yang, Hangjun Ye, Yuan Zhang, Quanyun Zhou 2/13/2026

Xiaomi-Robotics-0: An Open-Sourced Vision-Language-Action Model with Real-Time Execution

Xiaomi-Robotics-0: open-sourced vision-language-action model for robotics with cross-embodiment pretraining and optimized real-time execution.

HF Liangzhi Shi, Shuaihang Chen, Feng Gao, Yinuo Chen, Kang Chen, Tonghe Zhang, Hongzhi Zhang, Weinan Zhang, Chao Yu, Yu Wang 2/13/2026

RLinf-Co: Reinforcement Learning-Based Sim-Real Co-Training for VLA Models

RL-based sim-real co-training method for vision-language-action models that combines simulation and real-world robot data using reinforcement learning instead of supervised fine-tuning.

Ax Natalia Abarca, Andr\'es Carvallo, Claudia L\'opez Moncada, Felipe Bravo-Marquez 2/13/2026

Explaining AI Without Code: A User Study on Explainable AI

User study examining explainable AI methods in no-code ML platforms, addressing transparency gaps for non-technical users in sensitive domains.

Ax Bo Pan, Xuan Kan, Kaitai Zhang, Yan Yan, Shunwen Tan, Zihao He, Zixin Ding, Junjie Wu, Liang Zhao 2/13/2026

Bi-Level Prompt Optimization for Multimodal LLM-as-a-Judge

Bi-level prompt optimization method aligning LLM-based evaluations with human judgments without costly fine-tuning, applicable across tasks and datasets.

Ax Aditya Taparia, Som Sagar, Ransalu Senanayake 2/13/2026

Learning to Configure Agentic AI Systems

Method to automatically configure LLM-based agents by learning query-wise decisions for workflows, tools, token budgets, and prompts instead of using fixed templates.

Ax Nikhil Verma, Minjung Kim, JooYoung Yoo, Kyung-Min Jin, Manasa Bharadwaj, Kevin Ferreira, Ko Keun Kim, Youngjoon Kim 2/13/2026

MAPLE: Modality-Aware Post-training and Learning Ecosystem

MAPLE improves RL post-training for multimodal language models by weighting modalities based on task relevance, reducing variance and improving robustness to missing/added signals.

Ax Shuo Lu, Jianjie Cheng, Yinuo Xu, Yongcan Yu, Lijun Sheng, Peijie Wang, Siru Jiang, Yongguan Hu, Run Ling, Yihua Shao, Ao Ma, Wei Feng, Lingxiao He, Meng Wang, Qianlong Xie, Xingxing Wang, Ran He, Jian Liang 2/13/2026

Do MLLMs Really Understand Space? A Mathematical Reasoning Evaluation

Evaluates multimodal LLMs on mathematical spatial reasoning tasks, finding significant gaps (60% vs 95% human accuracy) in 2D/3D relation parsing and manipulation.