Rethinking Personalized Generation: Test-Time Alignment via Factorized Ranking Models Paper • 2609.35695 • Published 10 days ago • 11
Smaller Models, Better Rejects: Preference Distillation Scaling Paper • 2609.38987 • Published 8 days ago • 28
Personalized RewardBench: Evaluating Reward Models with Human Aligned Personalization Paper • 2604.07343 • Published Apr 8 • 11