AI 图像与视频生成 精选AI Agent技能库
AI 图像与视频生成分类下的高质量技能
VVMAI Image Gen
一个专门的 AI 图像生成技能,通过对接 VVMAI 的 OpenAI 兼容 API,利用命令行提示词生成高质量视觉效果。
Comfy Story Video
一个利用 ComfyUI 和文本转语音自动生成带旁白儿童故事视频的自动化流水线。
NewAPI Banana Skill
一个为 Openclaw 智能体设计的创意 AI 图像生成技能,利用 nano-banana 和 Gemini 模型创建高保真视觉内容。
ComfyUI Bridge
一个将您的 AI 代理连接到自托管 ComfyUI 实例的本地桥梁,用于私密、高性能的图像生成和处理。
SAM Background Removal
一款基于 AI 的图像分割工具,利用 Meta 的 Segment Anything Model 提取前景主体并移除背景。
Remotion Video Skill
一种利用 Remotion 和 React 构建高质量动画和产品演示的程序化视频创作技能。
栗由点心铺创意助手
一个专门用于角色设计、故事创作和 Stable Diffusion 提示词优化的数字动画 IP 助手。
Gemini Image Generator
一款适用于 Openclaw 智能体、由 Google Gemini 模型驱动的多功能 AI 图像生成和编辑工具。
muapi-nano-banana
一种专门用于生成高保真图像的技能,利用基于 Gemini 3 架构的结构化创意简报和推理驱动逻辑。
萤石多模态分析
一个为 Openclaw Skills 设计的强大多模态 AI 技能,可自动抓取摄像头图像并使用萤石 AI 引擎执行智能场景分析。
ClawCap Avatar Accessory Skill
ClawCap 是一个 AI 驱动的工作流,旨在自动将头饰和配饰合成到头像图片上,同时保持完美的风格和光影一致性。
Antigravity Image Gen
一个高性能的图像生成技能,利用 Google 内部 API 进行原生的、高质量的视觉内容创作。
图像理解 (Minimax)
一种视觉语言模型技能,使 AI 智能体能够使用 Minimax Coding Plan API 描述和分析图像。
Picasso TikTok
一个端到端的视频自动化引擎,利用 AI 数字人和同步字幕将脚本转换为高质量的 TikTok 和 Reels 视频。
Image Gen Coze
一款面向 Openclaw 的专业图像生成技能,利用 Coze 工作流和 Seedream 4.5 模型从文本提示词创建高质量视觉效果。
裁剪图像技能
一种高性能的图像裁剪技能,使 AI Agent 能够将本地文件或远程 URL 处理为生产就绪的资产。
豆包 Seed 图像分析技能
一个专门的 CLI 工具,利用字节跳动豆包视觉模型为用户和 AI 代理分析并描述图像内容。
Pollinations Sketch Note
一款 AI 驱动的工具,通过自动化研究和摘要将主题转化为手绘风格的知识卡片。
VAPI Image Gen
一个专门通过 VAPI 的 OpenAI 兼容接口生成 AI 图像的工具,支持多种模型系列和本地存储选项。
Trio Stream Vision
Trio Stream Vision 利用自然语言视觉模型实时分析 YouTube 直播和 RTSP 流,以检测事件并生成摘要。