Explore
AI Tools
New Tools
AI Agents
One9 Worker
LLMs
RAG & Vector DBs
Research
Assemble a stack
Founder Stacks
Compare
How We Rate
About
$
/
₹
⌘K
Sign up free
Login
Back to papers
April 21, 2026
cs.AI
DT2IT-MRM: Debiased Preference Construction and Iterative Training for Multimodal Reward Modeling
Zhihong Zhang
,
Jie Zhao
,
Xiaojian Huang
,
Jin Xu
,
Zhuodong Luo
,
Xin Liu
,
Jiansheng Wei
,
Xuejin Chen
Original Abstract
Read on arXiv
Download PDF
Categories
cs.AI