HF Dianyi Wang, Ruihang Li, Feng Han, Chaofan Ma, Wei Song, Siyuan Wang, Yibin Wang, Yi Xin, Hongjian Liu, Zhixiong Zhang, Shengyuan Ding, Tianhang Wang, Zhenglin Cheng, Tao Lin, Cheng Jin, Kaicheng Yu, Jingjing Chen, Wenjie Wang, Zhongyu Wei, Jiaqi Wang 2/12/2026

DeepGen 1.0: A Lightweight Unified Multimodal Model for Advancing Image Generation and Editing

DeepGen 1.0 is a lightweight 5B unified model for image generation and editing using Stacked Channel Bridging, achieving competitive performance to larger models with reduced deployment costs.

HF Sicheng Feng, Zigeng Chen, Xinyin Ma, Gongfan Fang, Xinchao Wang 2/12/2026

dVoting: Fast Voting for dLLMs

dVoting fast voting technique for diffusion LLMs enabling parallel test-time scaling for improved reasoning performance.

HF GigaBrain Team, Boyuan Wang, Chaojun Ni, Guan Huang, Guosheng Zhao, Hao Li, Jie Li, Jindi Lv, Jingyu Liu, Lv Feng, Mingming Yu, Peng Li, Qiuping Deng, Tianze Liu, Xinyu Zhou, Xinze Chen, Xiaofeng Wang, Yang Wang, Yifan Li, Yifei Nie, Yilong Li, Yukun Zhou, Yun Ye, Zhichao Liu, Zheng Zhu 2/12/2026

GigaBrain-0.5M*: a VLA That Learns From World Model-Based Reinforcement Learning

GigaBrain-0.5M VLA model trained via world model-based reinforcement learning for improved multi-step action prediction.

HF Bo Zhang, Jiaxuan Guo, Lijun Li, Dongrui Liu, Sujin Chen, Guanxu Chen, Zhijie Zheng, Qihao Lin, Lewen Yan, Chen Qian, Yijin Zhou, Yuyao Wu, Shaoxiong Guo, Tianyi Du, Jingyi Yang, Xuhao Hu, Ziqi Miao, Xiaoya Lu, Jing Shao, Xia Hu 2/12/2026

DeepSight: An All-in-One LM Safety Toolkit

DeepSight is a unified toolkit for LLM/MLLM safety covering workflow, evaluation, diagnosis, and alignment with integrated explainability and risk scenario grounding capabilities.

HF Romain Froger, Pierre Andrews, Matteo Bettini, Amar Budhiraja, Ricardo Silveira Cabral, Virginie Do, Emilien Garreau, Jean-Baptiste Gaya, Hugo Laurençon, Maxime Lecanu, Kunal Malkan, Dheeraj Mekala, Pierre Ménard, Gerard Moreno-Torres Bertran, Ulyana Piterbarg, Mikhail Plekhanov, Mathieu Rita, Andrey Rusakov, Vladislav Vorotilov, Mengjue Wang, Ian Yu, Amine Benhalloum, Grégoire Mialon, Thomas Scialom 2/12/2026

Gaia2: Benchmarking LLM Agents on Dynamic and Asynchronous Environments

Gaia2 benchmark for evaluating LLM agents in realistic, asynchronous, dynamic environments with temporal constraints and collaboration.

HF Nenad Tomašev, Matija Franklin, Simon Osindero 2/12/2026

Intelligent AI Delegation

Adaptive framework for intelligent AI agent delegation across decomposed sub-tasks with dynamic adaptation to environmental changes and failure handling.

BL 2/12/2026

Introducing GPT-5.3-Codex-Spark

GPT-5.3-Codex-Spark real-time coding model with 15x faster generation, 128k context, available in research preview.

HF MiniCPM Team, Wenhao An, Yingfa Chen, Yewei Fang, Jiayi Li, Xin Li, Yaohui Li, Yishan Li, Yuxuan Li, Biyuan Lin, Chuan Liu, Hezi Liu, Siyuan Liu, Hongya Lyu, Yinxu Pan, Shixin Ren, Xingyu Shen, Zhou Su, Haojun Sun, Yangang Sun, Zhen Leng Thai, Xin Tian, Rui Wang, Xiaorong Wang, Yudong Wang, Bo Wu, Xiaoyue Xu, Dong Xu, Shuaikang Xue, Jiawei Yang, Bowen Zhang, Jinqian Zhang, Letian Zhang, Shengnan Zhang, Xinyu Zhang, Xinyuan Zhang, Zhu Zhang, Hengyu Zhao, Jiacheng Zhao, Jie Zhou, Zihan Zhou, Shuo Wang, Chaojun Xiao, Xu Han, Zhiyuan Liu, Maosong Sun 2/12/2026

MiniCPM-SALA: Hybridizing Sparse and Linear Attention for Efficient Long-Context Modeling

MiniCPM-SALA hybrid sparse-linear attention architecture for efficient long-context LLM processing in 9B parameter model.

HF Matteo Nulli, Vladimir Orshulevich, Tala Bazazo, Christian Herold, Michael Kozielski, Marcin Mazur, Szymon Tuzel, Cees G. M. Snoek, Seyyed Hadi Hashemi, Omar Javed, Yannick Versley, Shahram Khadivi 2/12/2026

Adapting Vision-Language Models for E-commerce Understanding at Scale

Large-scale study on adapting general-purpose VLMs to e-commerce attribute understanding while preserving generalizability across multi-image noisy product data.

HF Zedong Chu, Shichao Xie, Xiaolong Wu, Yanfen Shen, Minghua Luo, Zhengbo Wang, Fei Liu, Xiaoxu Leng, Junjun Hu, Mingyang Yin, Jia Lu, Yingnan Guo, Kai Yang, Jiawei Han, Xu Chen, Yanqing Zhu, Yuxiang Zhao, Xin Liu, Yirong Yang, Ye He, Jiahang Wang, Yang Cai, Tianlin Zhang, Li Gao, Liu Liu, Mingchao Sun, Fan Jiang, Chiyu Wang, Zhicheng Liu, Hongyu Pan, Honglin Han, Zhining Gu, Kuan Yang, Jianfang Zhang, Di Jing, Zihao Guan, Wei Guo, Guoqing Liu, Di Yang, Xiangpo Yang, Menglin Yang, Hongguang Xing, Weiguo Li, Mu Xu 2/12/2026

ABot-N0: Technical Report on the VLA Foundation Model for Versatile Embodied Navigation

ABot-N0 unified Vision-Language-Action foundation model for embodied robot navigation across five core tasks using hierarchical brain-action architecture.

HF David Wan, Han Wang, Ziyang Wang, Elias Stengel-Eskin, Hyunji Lee, Mohit Bansal 2/12/2026

Multimodal Fact-Level Attribution for Verifiable Reasoning

MuRGAt benchmark evaluates multimodal LLM attribution and factual grounding across complex reasoning tasks involving multiple modalities and information sources.

HF Yejin Kim, Wilbert Pumacay, Omar Rayyan, Max Argus, Winson Han, Eli VanderBilt, Jordi Salvador, Abhay Deshpande, Rose Hendrix, Snehal Jauhri, Shuo Liu, Nur Muhammad Mahi Shafiullah, Maya Guru, Ainaz Eftekhar, Karen Farley, Donovan Clay, Jiafei Duan, Arjun Guru, Piper Wolters, Alvaro Herrasti, Ying-Chun Lee, Georgia Chalvatzaki, Yuchen Cui, Ali Farhadi, Dieter Fox, Ranjay Krishna 2/11/2026

MolmoSpaces: A Large-Scale Open Ecosystem for Robot Navigation and Manipulation

MolmoSpaces open ecosystem for large-scale benchmarking of robot navigation and manipulation policies with diverse scenarios.

HF Wayne Chi, Yixiong Fang, Arnav Yayavaram, Siddharth Yayavaram, Seth Karten, Qiuhong Anna Wei, Runkun Chen, Alexander Wang, Valerie Chen, Ameet Talwalkar, Chris Donahue 2/11/2026

GameDevBench: Evaluating Agentic Capabilities Through Game Development

GameDevBench evaluation framework tests multimodal AI agent capabilities on game development tasks combining code, shaders, sprites, and animations.

HF Yitian Gong, Kuangwei Chen, Zhaoye Fei, Xiaogui Yang, Ke Chen, Yang Wang, Kexin Huang, Mingshu Chen, Ruixiao Li, Qingyuan Cheng, Shimin Li, Xipeng Qiu 2/11/2026

MOSS-Audio-Tokenizer: Scaling Audio Tokenizers for Future Audio Foundation Models

MOSS-Audio-Tokenizer proposes end-to-end discrete audio tokenization using homogeneous architectures for improved reconstruction and scaling in audio foundation models.

HF Checheng Yu, Chonghao Sima, Gangcheng Jiang, Hai Zhang, Haoguang Mai, Hongyang Li, Huijie Wang, Jin Chen, Kaiyang Wu, Li Chen, Lirui Zhao, Modi Shi, Ping Luo, Qingwen Bu, Shijia Peng, Tianyu Li, Yibo Yuan 2/9/2026

χ_{0}: Resource-Aware Robust Manipulation via Taming Distributional Inconsistencies

χ0 identifies distributional shift across human demonstrations, policy inductive bias, and test-time execution as robustness bottleneck in robotic manipulation, proposing alignment approach.

HF Zhenyuan Zhang, Xianzhang Jia, Zhiqin Yang, Zhenbo Song, Wei Xue, Sirui Han, Yike Guo 2/8/2026

MemFly: On-the-Fly Memory Optimization via Information Bottleneck

MemFly: memory optimization framework using information bottleneck principles for LLM agents to balance compression and retrieval precision in long-term memory.