Rethinking Personalized Generation: Test-Time Alignment via Factorized Ranking Models Paper • 2609.35695 • Published 9 days ago • 11
Smaller Models, Better Rejects: Preference Distillation Scaling Paper • 2609.38987 • Published 7 days ago • 24
Personalized RewardBench: Evaluating Reward Models with Human Aligned Personalization Paper • 2604.07343 • Published Apr 8 • 11