الباحثون

Yesheng Liu

المنشورات 1

نسخة أولية وصول مفتوح

ImpossibleRubrics: Stress-Testing Generated Rubrics as Reward Signals

Bowen Qin, Yi Xie, Yesheng Liu وآخرون · 2026

Language model-generated rubrics are increasingly used as reward signals for rubric-based reinforcement learning, LLM-as-a-judge evaluation, and automated grading. Such rubrics are reliable only if they reward honest answers over adversarial answers optimized to exploit them. Yet their robustness to such optimization r …

المؤلفون المشاركون