AI 图像与视频生成 精选AI Agent技能库
AI 图像与视频生成分类下的高质量技能
Gemini Image Generation
一个强大的 AI 技能,通过 Wisdom Gate API 使用 Google Gemini 模型生成 4K 图像并执行多轮视觉优化。
Nano Banana 2 图像生成器
一款由 Gemini 3.1 Flash 模型驱动的专业级 AI 图像生成与编辑工具,通过优化的 proxy 服务提供支持。
智能巡检
一个自动化的视觉监控系统,利用 AI 视觉模型通过监控摄像头进行工作场所检查和安全巡逻。
Vidu AI 视频生成
一个强大的 AI 视频生成技能,利用 Vidu Q3-Pro 和 2.0 模型,通过 Atlas Cloud API 创建电影剪辑、动画和角色一致的视频。
Wan-T2I: 阿里云 DashScope Wan2.6 图像生成器
一个专业的文本生成图像技能,利用 阿里云 DashScope Wan2.6-t2i 模型生成高保真视觉内容。
Crazyrouter Image Gen
一个多功能的 Openclaw Skills AI 图像生成工具,通过统一的 API 连接到 DALL-E、Gemini 和 Imagen。
ComfyUI Feishu Draw
连接本地 ComfyUI 图像生成与飞书通讯的桥梁,实现将 AI 资产静默交付至团队聊天。
Sogni AI 图像与视频生成
一个高性能 AI 媒体技能,通过 Sogni AI 去中心化 GPU 基础设施生成专业级图像和电影级视频。
For Beginners AI Image
一款初学者友好的 AI 工具,通过云端渲染流水线将静态图像转换为带有过渡和音乐的专业级视频。
Cloudflare Workers AI Image
一个专业的技能工具,用于在你的 agent 工作流中直接通过 Cloudflare Workers AI 生成和编辑图像。
GPT-image-2 ShiyunApi 图像生成与编辑
一个复杂的 AI 技能,用于根据文本生成高质量图像,并通过 ShiyunApi 使用 GPT-image-2 模型执行高级的图像到图像编辑。
ComfyUI DirectML AMD Skill
一套专门用于在 Windows DirectML 上设置和优化 AMD GPU ComfyUI 的自动化工具包。
Deepfake 意识指南
一个全面的媒体素养框架,用于识别 AI 生成的合成媒体并保护个人免受数字虚假信息的侵害。
Image 3D Scene Reconstruction
一款专业级工具,利用度量深度估计从单张 2D 图像中重建 3D 场景结构、深度图和点云。
Music Generator HD
一款 AI 驱动的音乐和视频生成引擎,通过云端 GPU 处理将文本提示转换为高清媒体资产。
AI 摄影助手
一款面向 AI 摄影馆的智能数字礼宾,负责处理服务介绍、风格推荐及自动化下单流程。
Audio Visualizer Generator
一款 AI 驱动的自动化技能,利用云端渲染将音频轨道转换为高质量的波形可视化视频。
AI Video Enhancer 4K
一款由云端驱动的 AI 视频放大器,可在几分钟内将低分辨率素材转换为高清 4K 内容。
AI Video Translator
一款云端驱动的翻译工具,可在数分钟内为视频文件生成配音音频和同步字幕。
AI 视频配音
一种基于 AI 驱动的自动化配音技能,使用云端 GPU 渲染将视频文件翻译并配音成多种语言。