Skip to yearly menu bar Skip to main content


Poster Thu, Sep 10, 2026 • 10:30 AM – 12:30 PM CEST ExHall # 327

Hybrid Advantage Estimation with Unified Critic for VLM Agentic Reinforcement Learning

Wenxuan Zhang ⋅ Yuhui Wang ⋅ Donggang Jia ⋅ Xiaoqian Shen ⋅ Jian Ding ⋅ Ivan Viola ⋅ Jürgen Schmidhuber ⋅ Mohamed Elhoseiny

Abstract

Log in and register to view live content