A new paper introduces rubric-based rewards for aligning grounded question answering models. The framework generates query-specific rubrics from retrieved evidence and splits quality into fine-grained dimensions. It improves composition, grounding, and instruction-following over scalar reward baselines.
Opening Kapyn…