Ax Jaechul Roh, Eugene Bagdasarian, Hamed Haddadi, Ali Shahin Shamsabadi 2/17/2026

SPILLage: Agentic Oversharing on the Web

Studies how LLM-powered web agents handle user resources and potential data leakage when automating tasks across live websites.

Ax Yiheng Shu, Saisri Padmaja Jonnalagedda, Xiang Gao, Bernal Jim\'enez Guti\'errez, Weijian Qi, Kamalika Das, Huan Sun, Yu Su 2/17/2026

REMem: Reasoning with Episodic Memory in Language Agent

REMem: episodic memory system for language agents enabling spatiotemporal context recollection and reasoning over interaction histories.

Ax Yuyu Guo, Wenjie Yang, Siyuan Yang, Ziyang Liu, Cheng Chen, Yuan Wei, Yun Hu, Yang Huang, Guoliang Hao, Dongsheng Yuan, Jianming Wang, Xin Chen, Hang Yu, Lei Lei, Peng Di 2/17/2026

OpAgent: Operator Agent for Web Navigation

OpAgent: autonomous web navigation agent handling real-world website complexity via supervised fine-tuning and offline RL with online adaptation.

Ax Kun Gao, Katsumi Inoue, Yongzhi Cao, Hanpin Wang, Feng Yang 2/17/2026

Differentiable Rule Induction from Raw Sequence Inputs

Differentiable rule induction from raw sequence inputs combining ILP with neural networks for interpretable rule learning without symbolic datasets.

Ax Joseph Corneli 2/17/2026

A First Proof Sprint

Multi-agent proof sprint combining rapid draft generation with adversarial verification and targeted repair for research-level mathematical problems.

Ax Ziming Wang, Xiang Wang, Kailong Peng, Lang Qin, Juan Gabriel Kostelec, Christos Sourmpis, Axel Laborieux, Qinghai Guo 2/17/2026

AllMem: A Memory-centric Recipe for Efficient Long-context Modeling

AllMem: hybrid architecture combining Sliding Window Attention with Test-Time Training memory networks to improve LLM efficiency on long-sequence tasks.

Ax Lve Meng (University of Science,Technology of China, Zhongguancun Academy), Weilong Zhao (Universit\'e Paris Cit\'e), Yanzhi Zhang (Zhongguancun Academy), Haoxiang Guan (Zhongguancun Academy), Jiyan He (Zhongguancun Academy) 2/17/2026

Can a Lightweight Automated AI Pipeline Solve Research-Level Mathematical Problems?

Automated lightweight AI pipeline using LLMs to solve research-level mathematical problems through natural-language prompting and auto-formalization.

Ax Linjie Xu, Yanlin Zhang, Quan Gan, Minjie Wang, David Wipf 2/17/2026

No Need to Train Your RDB Foundation Model

Foundation model approach for relational databases using in-context learning to predict across heterogeneous tabular data without retraining.

Ax Yangxinyu Xie, Tao Wang, Soham Mallick, Yan Sun, Georgy Noarov, Mengxin Yu, Tanwi Mallick, Weijie J. Su, Edgar Dobriban 2/17/2026

Statistical Early Stopping for Reasoning Models

Statistically principled early stopping methods monitoring uncertainty signals during LLM reasoning generation to prevent unnecessary computation from overthinking.

Ax Mingfei Lu, Mengjia Wu, Feng Liu, Jiawei Xu, Weikai Li, Haoyang Wang, Zhengdong Hu, Ying Ding, Yizhou Sun, Jie Lu, Yi Zhang 2/17/2026

Choosing How to Remember: Adaptive Memory Structures for LLM Agents

Adaptive memory structures for LLM agents that dynamically select memory organization based on interaction context for improved long-horizon performance.

Ax Weiming Zhang, Jihong Wang, Jiamu Zhou, Qingyao Li, Xinbei Ma, Congmin Zheng, Xingyu Lou, Weiwen Liu, Zhuosheng Zhang, Jun Wang, Yong Yu, Weinan Zhang 2/17/2026

Plan-MCTS: Plan Exploration for Action Exploitation in Web Navigation

Plan-MCTS framework combining tree search with LLMs for improved web navigation by addressing sparse valid paths and noisy context challenges.

Ax Kazuo Yano, Jonghyeok Lee, Tae Ishitomi, Hironobu Kawaguchi, Akira Koyama, Masakuni Ota, Yuki Ota, Nobuo Sato, Keita Shimada, Sho Takematsu, Ayaka Tobinai, Satomi Tsuji, Kazunori Yanagi, Keiko Yano, Manabu Harada, Yuki Matsuda, Kazunori Matsumoto, Kenichi Matsumura, Hamae Matsuo, Yumi Miyazaki, Kotaro Murai, Tatsuya Ohshita, Marie Seki, Shun Tanoue, Tatsuki Terakado, Yuko Ichimaru, Mirei Saito, Akihiro Otsuka, Koji Ara 2/17/2026

Algebraic Quantum Intelligence: A New Framework for Reproducible Machine Creativity

Proposes algebraic quantum intelligence framework to improve creative output in LLMs by addressing structural constraints on generation spaces.

Ax Haibo Tong, Feifei Zhao, Linghao Feng, Ruoyu Wu, Ruolin Chen, Lu Jia, Zhou Zhao, Jindong Li, Tenglong Li, Erliang Lin, Shuai Yang, Enmeng Lu, Yinqian Sun, Qian Zhang, Zizhe Ruan, Zeyang Yue, Ping Wu, Huangrui Li, Chengyi Sun, Yi Zeng 2/17/2026

ForesightSafety Bench: A Frontier Risk Evaluation and Governance Framework towards Safe AI

ForesightSafety Bench evaluates frontier AI risks across multiple dimensions addressing systemic risks from increasingly autonomous goal-directed AI systems.

Ax Zheng Chu, Xiao Wang, Jack Hong, Huiming Fan, Yuqi Huang, Yue Yang, Guohai Xu, Chenxiao Zhao, Cheng Xiang, Shengchao Hu, Dongdong Kuang, Ming Liu, Bing Qin, Xing Yu 2/17/2026

REDSearcher: A Scalable and Cost-Efficient Framework for Long-Horizon Search Agents

REDSearcher framework optimizes LLMs for deep search tasks by addressing sparse high-quality trajectories and high interaction costs in long-horizon reasoning.

Ax Samuele Marro, Jialin Yu, Emanuele La Malfa, Oishi Deb, Jiawei Li, Yibo Yang, Ebey Abraham, Sunando Sengupta, Eric Sommerlade, Michael Wooldridge, Philip Torr 2/17/2026

Benchmarking at the Edge of Comprehension

Examines saturation of LLM benchmarks and proposes solutions as frontier models increasingly saturate new evaluations shortly after publication.

Ax Dongrui Liu, Yi Yu, Jie Zhang, Guanxu Chen, Qihao Lin, Hanxi Zhu, Lige Huang, Yijin Zhou, Peng Wang, Shuai Shao, Boxuan Zhang, Zicheng Liu, Jingwei Sun, Yu Li, Yuejin Xie, Jiaxuan Guo, Jia Xu, Chaochao Lu, Bowen Zhou, Xia Hu, Jing Shao 2/17/2026

Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report v1.5

Comprehensive frontier AI risk assessment framework evaluating risks from advanced LLMs and agentic AI across five critical dimensions.