UFO:面向多模态图像生成全条件对齐的评估链
UFO 是一个统一框架,用于评估多模态图像生成系统是否能同时满足文本和视觉条件。该方法将整体对齐目标拆分为细粒度、相互解耦的原子评估单元,并通过通用或专用功能调用逐一验证。实验表明,在参与评测的方法中,UFO 与人工偏好的相关性最高,平均相关性提升了 15.25%。研究人员还提出 UFO-Bench,用于在文本与视觉条件的多种交互场景下全面评估图像定制模型。
本文来源:Hugging Face,仅供学习参考,版权归原作者所有。