SolveEdit:评测生成模型视觉问题解决能力的基准
SolveEdit 是一项评测模型通过场景变换解决视觉问题能力的基准。模型需要根据图像和目标推断并执行必要的修改,同时保留无关内容。该基准包含 2,728 个案例,不依赖单一参考图像,同时衡量目标完成情况和意外改动。受测模型中的最高得分为 57.0。两阶段视觉规划器在三种受测图像生成模型上的平均得分提升了 9.1 分;GPT-Image-2 的得分则从 57.0 提高到 71.6。
本文来源:Hugging Face,仅供学习参考,版权归原作者所有。