AI 图像与视频生成 精选AI Agent技能库
AI 图像与视频生成分类下的高质量技能
即梦 AI 4.0 图像生成
一款高性能 AI 图像生成技能,利用即梦 AI 4.0 实现文生图和图生图工作流,并支持可选的飞书集成。
AI 游戏资产生成
一套全面的自动化工具包,旨在使用最先进的 AI 模型生成可用于生产环境的 2D、3D 和音频游戏资产。
Google Veo 3.x 视频生成
通过精简的 CLI 工作流,利用 Google Veo 3.x 和 Gemini API 生成高质量的 AI 视频和多段剪辑。
ZenMux 图像生成
一种复杂的图像生成技能,利用 ZenMux API 和 Gemini 3 Pro 通过 CLI 创建、修改和融合高保真视觉效果。
多模态分析器
一款基于 GLM-4.6V 模型的先进 AI 工具,用于深度理解图像、视频和复杂文档。
NVIDIA FLUX 图像生成
一款高性能 AI 工具,可通过简单的 CLI 命令利用 NVIDIA FLUX 模型生成和编辑图像。
Gemini 图像生成器
一款由 Gemini 模型驱动的高级 AI 图像生成与编辑工具,用于创建图标、海报和复杂的合成图像。
Clawra Selfie
一款 AI 驱动的技能,使用 MiniMax 或 fal.ai 生成风格化自拍,并自动广播到各种即时通讯频道。
火山引擎图像生成
一个专门用于通过火山引擎 Ark API 从文本描述生成高质量图像的技能。
Kling 3.0 Omni 视频生成器
一个高性能的 AI 智能体技能,利用 Kling 3.0 Omni 模型生成电影级质量的视频和音频同步内容。
Seedance 提示词设计器
一款智能提示词工程工具,可将多模态资产和创意意图转化为 Seedance 2.0 模型的结构化视频生成提示词。
过渡设计
一款人工智能驱动的设计工具,通过分析剪辑边界和叙事意图,生成精确到帧的视频过渡指令。
视频拆解
一项先进的视频分析技能,提供高水平的技术质量评估和详尽的逐镜头叙事拆解。
视频放大器
一款多模型 AI 视频增强工具,可将低分辨率或有噪点的素材转化为电影级的 4K 画质。
豆包图文及视频技能
一个全面的 AI 技能,通过字节跳动豆包 API 生成高质量图像、视频并进行智能图像编辑。
Seedream 图像生成插件
一款专业的 AI 图像生成插件,利用 Seedream 4.5 API 通过智能提示词优化来创建、编辑和融合高质量视觉内容。
Text-Preserve 多语言图像渲染
一种先进的 AI 智能体技能,通过基于 Canvas 的流水线预渲染非拉丁字符,防止 AI 生成图像中的文本受损。
中医视频工厂
一个自动化的工作流,用于生成从话题研究到 AI 提示词的完整健康视频制作方案。
马良图像生成与编辑
一个为 Openclaw Skills 智能体打造的 AI 驱动图像生成与编辑技能,利用 Google Gemini 模型进行高质量视觉创作。
Grok 图像 API
一个兼容 OpenAI 的接口,通过 Openclaw Skills 框架实现自动化图像生成与编辑。