Ax Shijia Liao, Yuxuan Wang, Songting Liu, Yifan Cheng, Ruoyi Zhang, Tianyu Li, Shidong Li, Yisheng Zheng, Xingwei Liu, Qingzheng Wang, Zhizhuo Zhou, Jiahua Liu, Xin Chen, Dawei Han 3/11/2026

Fish Audio S2 Technical Report

Fish Audio S2: open-source text-to-speech system with instruction-following control via natural language descriptions.

Ax Tam Nguyen, Moses Ndebugre, Dheeraj Arremsetty 3/11/2026

Security Considerations for Multi-agent Systems

Security framework identifying distinct vulnerabilities in multi-agent systems with delegated tool authority and inter-agent communication.

Ax Tenny Yin, Zhiting Mei, Zhonghe Zheng, Miyu Yamane, David Wang, Jade Sceats, Samuel M. Bateman, Lihan Zha, Apurva Badithela, Ola Shorinwa, Anirudha Majumdar 3/11/2026

PlayWorld: Learning Robot World Models from Autonomous Play

PlayWorld: autonomous pipeline training action-conditioned video models for robot simulators from large-scale datasets.

Ax Xingyu Bruce Liu, Mira Dontcheva, Dingzeyu Li 3/11/2026

A Text-Native Interface for Generative Video Authoring

Doki is a text-native interface for generative video creation, enabling users to author videos through natural language writing instead of specialized video editing tools.

Ax Taesung Kwon, Lorenzo Bianchi, Lennart Wittke, Felix Watine, Fabio Carrara, Jong Chul Ye, Romann Weber, Vinicius Azevedo 3/11/2026

Reviving ConvNeXt for Efficient Convolutional Diffusion Models

Fully convolutional diffusion model using ConvNets for efficient generative modeling compared to transformer alternatives.

Ax Nicolas Schischka, Nikhil Gosala, B Ravi Kiran, Senthil Yogamani, Abhinav Valada 3/11/2026

Open-World Motion Forecasting

Motion forecasting system for autonomous vehicles handling open-world scenarios with imperfect perception and evolving object taxonomy.