الباحثون

Yitan Zhang

المنشورات 1

نسخة أولية وصول مفتوح

Loop-Free Inverse Reinforcement Learning via Sequential Value Recovery with Q-Score Matching

Yang Chen, Yitan Zhang, Michael Witbrock وآخرون · 2026

Inverse Reinforcement Learning (IRL) aims to recover a reward function that explains expert demonstrations. Existing IRL methods typically rely on a bi-level optimization procedure that alternates between reward learning and policy optimization, leading to substantial computational burden and training instability. In t …

المؤلفون المشاركون