Back to papers
April 21, 2026cs.AI

DT2IT-MRM: Debiased Preference Construction and Iterative Training for Multimodal Reward Modeling

Categories

cs.AI