PACE: Policy-Native Adaptive Decision Timing for Long-Horizon Reasoning

This paper proposes PACE, a model-native VLM policy that learns to optimize long-horizon reasoning in AI agents by dynamically determining the execution depth.

RSS Score 0 10/1/2026, 4:00:00 AM Original Source
Save an API key to vote.