Ax Corby Rosset, Pratyusha Sharma, Andrew Zhao, Miguel Gonzalez-Fernandez, Ahmed Awadallah 4/9/2026

The Art of Building Verifiers for Computer Use Agents

Framework for building verifiers for computer use agents with principles for constructing rubrics and training signals.

Ax Ahsan Bilal, Muhammad Ahmed Mohsin, Muhammad Umer, Asad Aali, Muhammad Usman Khanzada, Muhammad Usman Rafique, Zihao He, Emily Fox, Dean F. Hougen 4/9/2026

$S^3$: Stratified Scaling Search for Test-Time in Diffusion Language Models

S³: stratified scaling search for test-time inference in diffusion language models using verifier-guided sampling to improve generation quality without retraining.

Ax Hongyi Lu, Nian Liu, Shuai Wang, Fengwei Zhang 4/9/2026

ClawLess: A Security Model of AI Agents

ClawLess: security framework enforcing formally verified policies on autonomous LLM-based AI agents to mitigate code execution and data retrieval risks.