AI 图像与视频生成 精选AI Agent技能库
AI 图像与视频生成分类下的高质量技能
MuAPI 媒体编辑与增强
一套强大的 AI 驱动媒体处理套件,用于程序化图像编辑、视频唇形同步和视觉效果增强。
Auto Video Analyzer
一个跨平台的 AI 技能,可从视频中提取关键帧,并使用 FFmpeg 和特定平台脚本执行自动化视觉分析。
Ace Banana2 图像生成
一种利用 AceData Nano Banana API 进行高分辨率图像创建和转换的高级 AI 影像技能。
历史上的今天艺术技能
一个本地 AI 图像生成流水线,根据 Wikipedia 历史上的今天事件自动创作每日历史艺术。
Flux 图像生成
使用 Black Forest Labs Flux 模型,以行业领先的速度和准确性生成高质量、写实风格的 AI 图像。
BNBOT 吉祥物生成器
一种 AI 图像生成技能,旨在为社交媒体和 UI 使用场景创建一致的、品牌化的龙虾机器人吉祥物插图。
rembg
一种专门的 AI 技能,利用深度学习模型移除图像背景并生成高质量的透明 PNG 文件。
Photo Cinematic Editor
一个由 Python 驱动的图像处理工具包,使用 Pillow 和 NumPy 进行专业电影级色彩分级和高级照片修饰。
ccy-txt2img
一个轻量级的本地图像生成技能,用于在无需外部 API 的情况下渲染文本、形状和基于规则的绘图。
MiniMax CLI (mmx)
一个全面的多模态命令行工具,用于生成和分析 AI 驱动的文本、图像、视频、音乐和语音。
视频分镜生成
一个复杂的 AI 智能体技能,用于生成多模态视频分镜并将其直接渲染到工作区 canvas 上。
idea2video
一个复杂的 AI 视频生成管线,将故事开发、角色设计和镜头渲染编排进单一的自动化工作流中。
dlazy-one-click-generation
一个专业的短视频生成流水线,通过单个命令自动执行脚本编写、语音合成和背景音乐集成。
ARTCLAW AI Creative Suite
一套全面的基于 CLI 的 AI 内容创作套件,用于在智能体工作流中生成图像、视频并进行多模态分析。
百度易剪视觉技能
一款专为工业和商业环境设计的高精度、高性价比图像及视频分析专业视觉 AI 技能。
Hyper3D Rodin Gen-2 3D模型生成技能
使用先进的 Hyper3D Rodin Gen-2 API 引擎将 2D 图像和文本提示词转化为生产级 3D 资产。
Tesseract OCR 图像文本提取
一个强大的图像转文本提取技能,由 Tesseract.js 驱动,可在 Node.js 环境中实现高精度 OCR。
Text to Video Ollama
一种专门的 AI 技能,利用本地 Ollama 驱动的工作流将文本提示词和文档转换为高清视频。
Higgsfield Soul 角色训练
创建个性化 AI 身份模型,在图像和视频中实现一致且忠实的脸部生成。
HunyuanImage 3.0 (huny-img)
一个专业级的图像生成技能,利用腾讯 HunyuanImage 3.0 执行高保真文本生成图像及图像生成图像任务。