模型Human Preference Score v3
HPSv3
用于评估图像生成质量的人类偏好分数奖励模型,通过学习人类偏好数据来对生成图像进行质量打分
时间轴 (近 90 天)
10月5日
在 Pick-a-Pic 数据集上以 DreamSim 作为多样性度量,以 FLUX.1-dev 为基础模型、HPSv3 为奖励模型时,SatisDive 相比 FK steering 将最差候选奖励最多提升 0.43
待验证50%
10月5日
HPSv3 和 ImageReward 均为人类偏好奖励模型,通过在大规模人工标注的图像偏好数据集上训练来预测人类对生成图像的满意度评分
待验证50%