RefineEdit:基于生成式细化网络的免训练 Prompt-to-Prompt 图像编辑
RefineEdit 是一种无需额外训练的文本引导图像编辑框架。它通过对二进制图像编码进行全局细化,将编辑区域定位与内容生成结合起来,使系统能够随着图像生成过程重新评估需要修改的区域。编辑分支从源图像的中间状态初始化,并与源分支比较,以选择可编辑的位置和比特。自适应空间冻结和临时比特锁定用于限制掩码不必要的扩张。该方法不需要额外训练、外部掩码或注意力控制。在 PIE-Bench 的九类编辑任务中,作者报告称,RefineEdit 在背景保持方面的 PSNR、LPIPS、MSE 和 SSIM 指标,以及整幅图像和编辑区域的 CLIP 分数上,均取得了参与比较方法中的最佳结果。
本文来源:Hugging Face,仅供学习参考,版权归原作者所有。