One Adapts to Any: Meta Reward Modeling for Personalized LLM Alignment
Our paper “One Adapts to Any: Meta Reward Modeling for Personalized LLM Alignment” is accepted in SIGIR 2026. It presents a meta reward modeling approach that adapts alignment to diverse individual preferences.