kapynResearch

From Preferences to Principles: Rubric-Based Alignment for Grounded Knowledge Answers

A new paper introduces rubric-based rewards for aligning grounded question answering models. The framework generates query-specific rubrics from retrieved evidence and splits quality into fine-grained dimensions. It improves composition, grounding, and instruction-following over scalar reward baselines.

Apple ML Research·Aug 27, 2026

Opening Kapyn…