AI 图像与视频生成 精选AI Agent技能库
AI 图像与视频生成分类下的高质量技能
Gemini Image Simple
一款零依赖的 Python 工具,利用 Gemini API 和 Nano Banana Pro 模型生成及编辑高质量图像。
Freepik AI 多模态生成
一个全面的多模态 AI 技能,通过 Freepik API 生成和编辑图像、视频、图标及音频。
Shellbot 产品视频
一个基于 AI 的工作流,使用 Remotion、React 和 AIDA 框架构建以转化为核心的产品营销视频。
DJI 视频备份
一个用于将 DJI 相机素材从 SD 卡自动传输并索引到网络存储解决方案的自动化实用程序。
MS-Qwen-VL 视觉分析
一个强大的多模态视觉分析工具,利用 ModelScope API 调动 Qwen3-VL 进行图像识别和 OCR。
表格图像生成器
一个高性能的 Node.js 实用程序,可将 JSON 数组转换为针对即时通讯平台优化的精美 PNG 表格。
Grok Imagine 视频
一个针对 xAI Grok Imagine API 的全面集成,支持文本生成图像、文本生成视频以及自然语言媒体编辑。
Seedance 2.0 多模态视频提示词工程师
一种利用 Seedance 2.0 @ 引用系统构建多模态 AI 视频提示词的专业技能。
视频生成器 (Remotion)
一个程序化视频制作引擎,使用 Remotion 将品牌数据转化为基于 React 的专业动态图形。
ComfyUI 本地图像生成
Openclaw Skills 的一个本地图像生成技能,通过 ComfyUI 工作流实现私密、高性能的视觉创作。
Gemini TG 图像生成
一个专门的自动化技能,通过 OpenRouter 使用 Google Gemini 生成图像,并立即交付给 Telegram 用户。
DrawThings 图像生成
一个高性能的本地图像生成技能,通过 API 与 DrawThings 对接,在 macOS 上提供 Stable Diffusion 能力。
AI 图像生成 (gen-image)
一个高性能技能,通过 SiliconFlow API 使用行业领先的 FLUX 和 Kolors 模型生成 AI 图像。
3D 模型生成
一项 AI 驱动的技能,可将自然语言和参考图像转换为带有 PBR 纹理的高质量 3D 模型。
年龄变换
一款先进的 AI 驱动技能,用于生成逼真的面部老化演变和年轻化回归效果。
动漫头像生成
一款多功能 AI 工具,可通过 API 创建个性化动漫头像、角色设计以及实现照片到动漫的转换。
漫画分镜生成
一个全面的 AI 技能,可根据文本和照片生成多格漫画条、漫画页面以及一致的角色艺术。
深度图生成
轻松将 2D 图像转换为详细的灰度或度量深度图,用于高级 3D 可视化和空间计算。
Discord 图形生成
一款 AI 驱动的设计工具,用于为 Discord 服务器生成专业且经过优化的图形,包括图标、横幅和角色徽章。
each::sense
一个用于生成式媒体的智能编排层,自动选择最佳 AI 模型来创建高端图像、视频和营销资产。