原文跳转提示
此资讯内容来源于外部网站,将在 60 秒后自动跳转到原文页面
https://arxiv.org/abs/2609.35504
立即前往原文

SolveEdit:评测生成模型视觉问题解决能力的基准

SolveEdit 是一项评测模型通过场景变换解决视觉问题能力的基准。模型需要根据图像和目标推断并执行必要的修改,同时保留无关内容。该基准包含 2,728 个案例,不依赖单一参考图像,同时衡量目标完成情况和意外改动。受测模型中的最高得分为 57.0。两阶段视觉规划器在三种受测图像生成模型上的平均得分提升了 9.1 分;GPT-Image-2 的得分则从 57.0 提高到 71.6。
行业资讯 研究 2026-09-29 13:01:03 271 阅读 阅读约 1 分钟 来源:Hugging Face
本文来源:Hugging Face,仅供学习参考,版权归原作者所有。