Skip to yearly menu bar Skip to main content


Poster Thu, Sep 10, 2026 • 1:30 AM – 3:30 AM PDT ExHall # 327

Hybrid Advantage Estimation with Unified Critic for VLM Agentic Reinforcement Learning

Wenxuan Zhang ⋅ Yuhui Wang ⋅ Donggang Jia ⋅ Xiaoqian Shen ⋅ Jian Ding ⋅ Ivan Viola ⋅ Jürgen Schmidhuber ⋅ Mohamed Elhoseiny

Log in and register to view live content