原文跳转提示
此资讯内容来源于外部网站,将在 60 秒后自动跳转到原文页面
https://arxiv.org/abs/2609.06652
立即前往原文

VidaForge:面向视频预训练数据配方的开放研究基础设施

VidaForge 是一个用于研究视频数据配方如何影响模型预训练的开放研究基础设施。它将从原始视频到训练数据集的处理过程表示为可执行的五阶段工作流,并保留每个样本的生成来源。研究人员可以调整其中的具体决策来构建不同的数据集,而无需重新搭建整套基础设施。使用 Wan 2.1 和 V-JEPA 2.1 的实验表明,覆盖范围更广的数据配方在下游基准测试中取得了最高分,但基于损失的评估则偏好其他配方。该项目还发布了 VIDAFORGE-3M,包含 314 万个场景级视频片段,总时长达 6,475 小时,并提供细粒度标注和数据筛选信号。
行业资讯 AI模型 研究 开源 2026-09-09 11:31:00 896 阅读 阅读约 1 分钟 来源:Hugging Face
本文来源:Hugging Face,仅供学习参考,版权归原作者所有。