Similarity as Reward Alignment: Robust and Versatile Preference-based Reinforcement Learning
A new contrastive framework called SARA aims to improve the robustness of preference-based reinforcement learning against noisy or inaccurate human labeling.