Ax Jiaquan Zhang, Chaoning Zhang, Shuxu Chen, Xudong Wang, Zhenzhen Huang, Pengcheng Zheng, Shuai Yuan, Sheng Zheng, Qigan Sun, Jie Zou, Lik-Hang Lee, Yang Yang 3/3/2026

Learning Global Hypothesis Space for Enhancing Synergistic Reasoning Chain

Global Hypothesis Space method improves Chain-of-Thought reasoning by enabling holistic exploration of solution space rather than greedy step-by-step generation.

Ax Yiheng Shu, Saisri Padmaja Jonnalagedda, Xiang Gao, Bernal Jim\'enez Guti\'errez, Weijian Qi, Kamalika Das, Huan Sun, Yu Su 3/3/2026

REMem: Reasoning with Episodic Memory in Language Agent

REMem introduces episodic memory and spatiotemporal reasoning to language agents, enabling recollection and reasoning over interaction histories.

Ax Adrian Robert Minut, Hazem Dewidar, Iacopo Masi 3/3/2026

Spilled Energy in Large Language Models

Interprets LLM softmax layer as Energy-Based Model to track 'energy spills' correlating with factual errors and biases during decoding.

Ax Xuhui Ren, Shaokang Dong, Chen Yang, Qing Gao, Yunbin Zhao, Yongsheng Liu, Xinwei Geng, Xiang Li, Demei Yan, Yanqing Li, Chenhao Huang, Dingwei Zhu, Junjie Ye, Boxuan Yue, Yingnan Fu, Mengzhe Lv, Zezeng Feng, Boshen Zhou, Bocheng Wang, Xuanjing Huang, Yu-Gang Jiang, Tao Gui, Qi Zhang, Yunke Zhang 3/3/2026

MagicAgent: Towards Generalized Agent Planning

MagicAgent framework enables generalized agent planning across heterogeneous tasks using LLMs, addressing data scarcity and task conflicts.

Ax Xiaoxi Li, Wenxiang Jiao, Jiarui Jin, Shijian Wang, Guanting Dong, Jiajie Jin, Hao Wang, Yinuo Wang, Ji-Rong Wen, Yuan Lu, Zhicheng Dou 3/3/2026

OmniGAIA: Towards Native Omni-Modal AI Agents

OmniGAIA benchmark for evaluating multi-modal AI agents combining vision, audio, and language with reasoning and tool usage capabilities.

Ax Tianjin Huang, Zhangyang Wang, Haotian Hu, Zhenyu Zhang, Gaojie Jin, Xiang Li, Li Shen, Jiaxing Shang, Tianlong Chen, Ke Li, Lu Liu, Qingsong Wen, Shiwei Liu 3/3/2026

GradientStabilizer:Fix the Norm, Not the Gradient

GradientStabilizer method addressing training instability from gradient-norm spikes in deep learning without requiring threshold tuning.

Ax Siming Huang, Yuliang Xu, Mingmeng Geng, Yao Wan, Dongping Chen 3/3/2026

Wikipedia in the Era of LLMs: Evolution and Risks

Framework analyzing LLM impact on Wikipedia content and page views with simulations exploring potential risks from automated contributions.

Ax Zangwei Zheng, Xiangyu Peng, Yuxuan Lou, Chenhui Shen, Tom Young, Xinying Guo, Binluo Wang, Hang Xu, Hongxin Liu, Mingyan Jiang, Wenjun Li, Yuhui Wang, Anbang Ye, Gang Ren, Qianran Ma, Wanying Liang, Xiang Lian, Xiwen Wu, Yuting Zhong, Zhuangyan Li, Chaoyu Gong, Guojun Lei, Leijun Cheng, Limin Zhang, Minghao Li, Ruijie Zhang, Silan Hu, Shijie Huang, Xiaokang Wang, Yuanheng Zhao, Yuqi Wang, Ziang Wei, Yang You 3/3/2026

Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k

Open-Sora 2.0 demonstrates training a commercial-grade video generation model for $200k, addressing cost-effectiveness in large-scale model training.

Ax Chanhyuk Lee, Jiho Choi, Chanryeol Lee, Donggyun Kim, Seunghoon Hong 3/3/2026

AdaRank: Adaptive Rank Pruning for Enhanced Model Merging

AdaRank: adaptive rank selection method for SVD-based model merging that reduces cross-task interference and improves multi-task learning performance.

Ax Kazuki Fujii, Yukito Tajima, Sakae Mizuki, Masaki Kawamura, Hinari Shimada, Taihei Shiotani, Koshiro Saito, Masanari Oi, Taishi Nakamura, Takumi Okamoto, Shigeki Ishida, Kakeru Hattori, Youmi Ma, Hiroya Takamura, Rio Yokota, Jun Sakuma, Naoaki Okazaki 3/3/2026

Rewriting Pre-Training Data Boosts LLM Performance in Math and Code

SwallowCode and MathShallow datasets with systematically rewritten pre-training data significantly improve LLM performance in code and math reasoning under open licenses.

Ax Yuhui Wang, Rongyi Zhu, Ting Wang 3/3/2026

Self-Destructive Language Model

Defense mechanism against harmful fine-tuning attacks on LLMs by reducing model trainability on harmful data while maintaining safety and normal performance.

Ax Guangda Liu, Chengwei Li, Zhenyu Ning, Jing Lin, Yiwu Yao, Danning Ke, Minyi Guo, Jieru Zhao 3/3/2026

FreeKV: Boosting KV Cache Retrieval for Efficient LLM Inference

FreeKV: efficient KV cache retrieval method for long-context LLM inference that improves compression methods and reduces accuracy loss during context extension.