AI 图像与视频生成 精选AI Agent技能库
AI 图像与视频生成分类下的高质量技能
SenseAudio Songmaker
SenseAudio Songmaker 是一款综合性的 AI 驱动工具,能够处理歌词创作和音乐作曲,根据简单的文本描述创建完整的音频轨道。
SenseAudio Jingle Forge
一个专门将品牌名称和语气关键词转化为 5-15 秒专业音乐顺口溜和音频 logo 的工具。
RunningHub Skill
一个全面的多媒体生成技能,提供 170+ 个 AI 接口访问权限,用于创作包括视频、3D 和音频在内的创意内容。
Pixwith Media Generation
一个为 Openclaw Skills 打造的多功能 AI 媒体生成技能,连接了 40 多个最先进的视频和图像模型。
ComfyUI Image Generation
将您的 AI agent 连接到本地 ComfyUI 实例,使用自然语言提示词以编程方式生成图像。
统一视频歌词与动画创作工具
一个全面的短视频制作工具包,用于在多个 AI 生成的场景和音乐歌词中保持角色一致性。
语音文本转 Meme 技能
一种专门的 AI 技能,可根据情感和语调将语音转文本输入转换为富有表现力、可直接用于聊天的 Meme 图像。
Mood Canvas
一个专门将模糊的美学想法转化为结构化、可操作的创意指导视觉蓝图的工具。
RunningHub
一个专业的云平台,用于运行 ComfyUI 工作流,通过强大的 API 生成 AI 图像和视频。
Novita 多模态执行
一个全面的多模态技能,用于使用 Novita AI API 执行文本生成图像、视频生成和语音转文本任务。
Social Card
一个强大的基于 Python 的工具,仅需一个本地依赖即可通过编程方式生成社交媒体预览图和 Open Graph 卡片。
豆包视频分析
一个 AI 驱动的技能,利用 Doubao 2.0 模型从本地和远程视频文件中分析并提取视觉洞察。
VIN 识别 OCR
一款专业的 OCR 技能,用于从挡风玻璃或登记照片中识别车辆识别号码和制造商详情。
产品图像放大器
增强电子商务产品图像的清晰度和分辨率,使其在产品列表、PDP 和数字广告中具备商业可行性。
fal-ai 集成用于 AI Agents
一个强大的集成,用于通过 fal.ai 队列 API 运行托管的图像、视频和音频生成 AI 模型。
Math Arithmetic OCR
一个 AI 技能,利用腾讯云 ArithmeticOCR 从图像中识别并数字化 K12 数学公式和方程式。
HD AIGC Skills
一个全面的 AIGC 客户端,用于在 Openclaw 生态系统中使用 Seedream 和 Kling 等模型生成高分辨率 AI 图像和视频。
Doubao Image Generator
一个专门通过基于 prompt 的接口,直接使用 Volcengine Doubao 模型生成高质量 AI 图像的技能。
LLM Video Generator
一个强大的 AI 视频生成引擎,利用 CogVideoX-3 模型从文本描述或图像创建专业级视频。
宝玉文章插图师
一个先进的 AI 智能体技能,通过独特的 Type x Style 框架分析文章结构,生成视觉一致且具备上下文感知能力的插图。