PAPER·July 31, 2026OSReward: Instituting Standardized Evaluation for Cross-Platform Computer-Use Reward ModelsarXiv
PAPER·July 28, 2026Codifying the Judge: Scalable Evaluation via Program DistillationHugging Face Papers
PAPER·June 1, 2026The Flip Side of RLHF: On-Policy Feedback for Reward Model Self-Supervised ImprovementHugging Face Papers
PAPER·May 29, 2026RUBRIC-ARROW: Alternating Pointwise Rubric Reward Modeling for LLM Post-training in Non-verifiable DomainsHugging Face Papers
PAPER·May 27, 2026CroCo: Cross-Lingual Contrastive Preference Tuning on Self-GenerationsHugging Face Papers
PAPER·May 19, 2026SafeDiffusion-R1: Online Reward Steering for Safe Diffusion Post-TrainingHugging Face Papers
PAPER·May 14, 2026Edit-Compass & EditReward-Compass: A Unified Benchmark for Image Editing and Reward ModelingHugging Face Papers