ResAdapter-字节跳动推出的AI图像分辨率适配器
ResAdapter是一款由字节跳动开发的扩散模型分辨率适配器,它能够在保持风格域一致性的同时,生成任意分辨率和宽高比的图像。
ActAnywhere-Adobe发布的视频生成模型
ActAnywhere是一个由Stanford University和Adobe Research开发的AI模型,专注于自动化视频背景生成。它通过接收前景主体的
Animate Anyone: 创新的图像到视频角色动画合成
"Animate Anyone"是一个由阿里巴巴集团智能计算研究所开发的项目,它使用先进的扩散模型和特殊的框架来生成角色动画。这个技术能够从
W.A.L.T:通过扩散模型生成逼真视频的AI模型
近日,谷歌与李飞飞的斯坦福团队携手推出了基于Transformer的视频生成模型W.A.L.T。该模型利用因果编码器和窗口注意的变压器架构,成功将图像和视频压缩
AniPortrait-根据音频和静态人脸图片生成逼真的动态视频
AniPortrait是一款由腾讯研究人员开发的音频驱动的肖像动画合成框架,能够根据音频和静态人脸图片生成逼真的动态视频。它通过提取音频中的3D面部表情和唇动信
OOTDiffusion-高度可控的虚拟服装试穿AI工具
OOTDiffusion是一个高度可控的虚拟服装试穿AI工具,它利用潜在扩散模型(latent diffusion model)的先进技术,实现了高质量的服装图
DreaMoving:基于扩散模型的可控视频生成框架
DreaMoving是一个先进的视频生成框架,利用扩散模型技术,能够根据用户指定的身份和姿势序列,创造出高质量、定制化的人类视频内容。
MobileDiffusion-谷歌推出的移动端AI绘画模型
MobileDiffusion是谷歌推出的专为移动设备设计的高效潜在扩散模型,可以为各种领域生成高质量的多样化图像
Show-1:文本生成视频AI模型
Show-1 是一个由新加坡国立大学的 Show Lab 开发的文本到视频生成模型,该模型可以将文本描述转化为高质量视频。该模型结合了像素基础和潜在基础的视频扩
MagicAnimate: 将静态人物图片变成逼真动画
MagicAnimate是一个创新的项目,使用扩散模型实现时间一致性的人类图像动画,提供真实感强且多样化的动画生成能力。
Lumiere-谷歌发布的最新AI视频生成模型
Lumiere是谷歌发布的一个文本到视频扩散模型,旨在生成展现真实、多样且连贯运动的视频。
promptoMANIA-AI绘画提示词生成器
PromptoMania 是一个 AI 艺术提示词生成器,它能为任何文本到图像扩散模型生成惊人而详细的提示词。