Ax Noam Koren, Rafael Moschopoulos, Kira Radinsky, Elad Hazan 15d ago

SFO: Learning PDE Operators via Spectral Filtering

Spectral Filtering Operator (SFO): neural operator for solving PDEs using Universal Spectral Basis to capture long-range nonlocal interactions.

Ax Nadav Benedek, Tomer Koren, Ohad Fried 15d ago

Gefen: Optimized Stochastic Optimizer

Gefen: memory-efficient optimizer reducing AdamW footprint by ~8x through moment state sharing and learned quantization for large-scale pretraining.

Ax Yunhe Li, Hao Shi, Wenhao Liu, Mengzhe Ruan, Hanxu Hou, Zhongxiang Dai, Shuang Qiu, Linqi Song 15d ago

DemoPSD: Disagreement-Modulated Policy Self-Distillation

DemoPSD: self-distillation method for training LLMs to reason by modulating policy disagreement, reducing overfitting and improving generalization.

Ax Mao-Lin Luo, Zhe-Xu Wang, Zi-Hao Zhou, Bo Ye, Jian Zhao, Min-Ling Zhang, Tong Wei 15d ago

RL Forgets! Towards Continual Policy Optimization

Study showing reinforcement learning for vision-language model adaptation exhibits catastrophic forgetting, challenging assumptions about RL continual learning.

Ax Xiaolong Huang, Benjamin Th\'erien, James Harrison, Eugene Belilovsky 15d ago

Efficient Long-Horizon Learning for Learned Optimization

Meta-learning approach to train neural network optimizers that outperform hand-designed optimizers like Adam, improving long-horizon training efficiency.