原文跳转提示
此资讯内容来源于外部网站,将在 60 秒后自动跳转到原文页面
https://arxiv.org/abs/2608.16328
立即前往原文

GRNEdit:从生成式精炼网络的二元证据视角实现高效通用视频编辑

GRNEdit 是一个面向指令式通用视频编辑的轻量级两阶段框架。它将编辑意图表示为对单个比特进行保留或翻转的局部决策,再由生成式精炼网络将这些决策整合为连贯的视觉语义。专门设计的空条件表示“不编辑”,有助于保留源内容。模型仅使用 0.6 百万对训练数据和不到 3% 的条件参数进行训练;GRNEdit-2B 和 GRNEdit-8B 在 OpenVE-Bench 上分别获得 4.03 和 4.18 分。2B 模型超过了多个拥有 140 亿参数的开源编辑器,8B 模型的表现则与领先的开源编辑器相当。
行业资讯 应用 AI模型 研究 2026-08-18 18:01:21 718 阅读 阅读约 1 分钟 来源:Hugging Face
本文来源:Hugging Face,仅供学习参考,版权归原作者所有。