AI 图像与视频生成 精选AI Agent技能库
AI 图像与视频生成分类下的高质量技能
Infinimo AI Design Image Creator
一个 AI 编码 Agent 技能,用于通过 Infinimo AI Design API 以编程方式生成、自定义和轮询高质量的电商和生活方式图像。
Live Highlight Slicer
一个旨在检测直播录像中高能量时刻并将其切片为高光视频的自动化工具。
Ghost Eye
Ghost Eye 作为一个图像预处理桥梁,将视觉数据转换为丰富的 OCR 文本和场景描述,以便纯文本 LLMs 使用。
生成质量检查清单
用于 Agent 侧 QA 的 Openclaw Skills,在批准前使用核心和特定模型的检查清单来审查生成的图像、视频和音频。
Spark Media
Spark Media 将提示词和参考图像转换为生成的图像和视频,为 Openclaw Skills 提供同步图像输出和异步视频任务轮询。
Text in Image Generation
一个专门的工作流,用于生成具有准确、清晰且具有设计感文本图层的高保真图像。
视觉与媒体理解
Openclaw Skills 将媒体输入转换为基于事实的文本输出,如字幕、OCR、转录、摘要、标签和结构化 JSON。
修复与放大图像
Openclaw Skills 使用合适的模型修复模糊、有噪点或低分辨率的图像,从而获得更清晰、更忠实的效果。
Talking Avatar
Openclaw Skills Talking Avatar 根据脚本或音频,将肖像、头像或现有视频转化为同步的镜头前发言人。
视频重构
Openclaw Skills 通过扩展场景而不是裁剪主体,将视频重构为新的宽高比。
Photoreal Stills
一种先进的 AI 生成技能,通过提示光学行为、真实相机属性和刻意的不完美,来消除合成渲染伪影。
标志与矢量图
Openclaw Skills 可以创建真实的 SVG 标志,或将光栅图像转换为在任何尺寸下都保持清晰的可编辑矢量艺术。
图像转 3D 资产
Openclaw Skills 将照片或提示词转换为生产就绪的 GLB 3D 资产,具有可控的拓扑、材质和多边形预算。
2D 游戏资产
用于 2D 游戏资产的 Openclaw Skills 可以生成具有统一视觉风格的协调精灵集、图标、贴纸和透明切图。
受控生成 (ControlNet)
通过 ControlNet 驱动的生成,在改变图像风格、主体或细节处理的同时,保留其结构。
复合场景
复合场景通过协调位置、比例、光照和透视,将多张真实图像融合为一个协调的 AI 生成场景。
电影级视频
使用精确的电影级提示词和实时模型感知工作流,生成感觉像是实拍而非合成的、由镜头主导的短视频。
角色一致性
用于角色一致性的 Openclaw Skills 可以生成新的 AI 图像,并在不同的场景、姿势、服装和风格中保持同一主体可被识别。
Desktop Pet Workshop
一个专门的工作流,用于将真实世界的照片转换为可定制的、互动的桌面宠物,并打包为原生的 Windows 和 macOS 应用程序。
ImagineVid AI Generation
ImagineVid AI Generation 允许连接的 agent 安全地发现能力、报价 credit、创建媒体,并监控 image、video 和 music 任务。