AI 图像与视频生成 精选AI Agent技能库
AI 图像与视频生成分类下的高质量技能
Grounding - 多模态目标定位
一种复杂的多模态技能,使 AI 智能体能够使用 GLM-4.7V 检测、定位并在视觉上框选图像中的特定对象或文本。
Lindsay Selfie (Native)
一种专门的图像生成技能,使用包含 14 张图像的身份包来生成特定角色 Lindsay 的高度连贯、具备上下文感知的自拍照。
Node Camera
一款用于控制 Android Node 设备上 USB 摄像头的专业工具,支持高速快照和实时 JPEG 流媒体。
DALL-E 图像生成
一个强大的图像生成技能,利用 DALL-E 3 将文本提示词转化为高质量的视觉资产。
BizyAir 视频生成技能
一个利用 BizyAir API 将图像和提示词转化为电影级视频的高级异步视频生成助手。
Nova Video AI 图像与视频生成器
一个强大的 AI 技能,可通过 Nova Video OpenAPI 直接在您的 AI 代理中生成高分辨率图像和电影级视频。
Seedance 2.0 AI Video Generator
一个针对字节跳动 Seedance 2.0 模型的综合技能,实现无缝的 AI 视频创建和 API 管理。
图像转 3D 流水线
一个利用 AI 将产品图像转换为专业级 3D 模型的自动化端到端流水线。
Stella Selfie
生成角色一致的 AI 自拍图像,并通过多供应商支持直接发送至消息频道。
DashScope 图像生成
一个强大的 CLI 技能,通过符合 OpenAI 兼容标准的 Alibaba DashScope 端点使用 qwen-image-max 模型生成图像。
Neta Creative
一个全面的多媒体生成技能,供 AI 智能体通过 Neta API 创建图像、视频、歌曲和音乐视频。
Doubao Image Gen
一款专业的 AI 图像生成技能,利用 Doubao Seedream 模型进行高保真文本转图像转换和批量处理。
AI Image Generator
一个多功能的 AI 图像生成工具,通过单个 API 统一访问 DALL-E 和 Gemini 等多个模型。
STH Video Template Generation
一个自动化的视频生成流水线,旨在通过两阶段 Imagine MCP 流程创建对口型的竖屏歌曲模板视频。
Banana Pro Image Gen
一款多功能的 AI 图像生成工具,利用 Gemini 模型通过简单的文本提示词创建高质量的 Logo、白板草图和社交媒体素材。
ComfyUI 视频生成
一个用于使用 ComfyUI 和 LTX-2.3 模型套件生成 AI 视频的高性能自动化技能。
vwu.ai 的 Sora 模型
一个专门的技能,用于通过 vwu.ai 平台使用标准 API 协议访问和触发 Sora AI 视频生成模型。
YouTube Clipper KO
使用 Whisper、Claude 和 ffmpeg 自动将韩国 YouTube 视频转换为爆款短视频片段。
Antigravity 图像生成
一种高性能图像生成技能,通过 Google 内部 Antigravity 端点调用 Gemini 3 Pro 模型。
Apifox Image Generation
一款多功能 AI 图像生成工具,利用 Apifox API 将文本提示词转换为高分辨率视觉资产。