AI 图像与视频生成 精选AI Agent技能库
AI 图像与视频生成分类下的高质量技能
ImageKit 技能 (oo-imagekit)
通过 ImageKit 技能将媒体资产优化、CDN 清除和文件操作直接集成到您的 AI 工作流中。
HiAPI HappyHorse 1.0 Video
一款 AI 驱动的文字转视频生成工具,利用 HiAPI HappyHorse 1.0 直接从您的终端生成自定义电影剪辑。
Sketch2CAD
Sketch2CAD 自动识别上传的手绘草图照片中的形状和尺寸,生成标准的 AutoCAD 兼容 DXF 文件。
Qwen Image Generation & Editing
一款先进的AI驱动图像生成与编辑工具,利用阿里云 Qwen Image API 支持复杂的文本渲染、风格迁移和多图融合。
Video Review Skill
一种自动化视频质量审核和安全合规工具,可提取技术指标、采样帧、运行并行视觉评估,并转录音频以检测违禁词。
Image Tools
这是一个由 ImageMagick 驱动的综合性、非破坏性图像编辑工具包,专为自动化 AI 开发工作流而打包。
Seal OCR (Sugon-Scnet)
一种专门用于识别、定位并从文档和发票的官方印章中提取文字及元数据的 OCR 工具。
Spark Image
专为 Openclaw Skills 设计的高分辨率 AI 文字转图像技能,利用 Volcano Engine API 直接在代理界面中渲染高质量艺术作品。
Creative Media
一个零配置、多模态的创意媒体运行时,供 AI 代理生成图像、视频、音频和 3D 资产,无需提供 API keys。
Image to 3D
一个无需配置、托管运行时的 CLI skill,可在无需提供商凭证的情况下,将 2D 图像转换为持久且托管的 3D glb 网格资产。
Blender Python 自动化 (bpy)
使用 Blender 的 Python API 实现 3D 资产生成、程序化建模、渲染和 3D 打印准备的自动化。
Jimeng AI Video Generation 3.0 (1080P)
一种先进的视频生成工具,利用 Volcengine 的 Jimeng AI 3.0 API,通过首尾帧插值合成高质量的 1080P 视频。
车辆行驶证 OCR
一款 AI 驱动的 OCR 技能,可自动将车辆行驶证(正反面)中的数据提取为结构化的 JSON 数据包。
ZeroHub Image API
一个先进的 Openclaw Skills 集成,适用于 zeroHub,可在您的 AI agent 环境中直接实现安全、自动化的文生图和图生图工作流。
IP Character Design to 3D Print Pipeline
一个自动化的端到端 AI 流水线,将角色提示词转换为生产级、流形 (manifold) 的 3D 打印 STL 文件。
deepsop-genvis
一种异步 AI 图像和视频生成技能,利用 AI Artist API 进行自动轮询,为您的 AI 智能体提供无缝的媒体生成能力。
guishu-gpt-image-2
一款 AI 驱动的图像生成 skill,旨在利用 Guishu Token gpt-image-2 API 以编程方式生成、存储和管理本地图像。
Geo-Tag Photos
一款 AI 驱动的照片地理定位工具,通过视觉识别全球地标并将坐标写入 EXIF 记录,从而重建 JPG 图像丢失的 GPS 元数据。
Douyin Downloader
一个基于 Python 的实用工具,用于直接从分享口令、短链接或网页 URL 提取并下载 Douyin 视频和图片合集。
Happy IMG2 直接生成技能
一个面向企业的 Openclaw 技能,使用 happy/gpt-image-2 模型进行高保真 Text-to-Image 和基于参考图的图像生成,并具备严格的验证机制。