AI 图像与视频生成 精选AI Agent技能库
AI 图像与视频生成分类下的高质量技能
Aliyun MPS 视频翻译
一个功能强大的自动化 skill,用于管理阿里云 IMS 视频翻译任务,包括字幕、配音和面部处理。
ModelsLab 3D Generation
一个强大的 AI 技能,可将文字描述和 2D 图像转换为专业级 3D 模型和对象。
Python 图像中文字体渲染器
一个解决 Python 生成的图像和图表中中文乱码及表情符号显示问题的专业解决方案。
图像转数据
一种复杂的 AI 视觉技能,可从建筑照片和图纸中提取结构化数据、安全指标和进度测量值。
图像质量过滤器
一款自动化的计算机视觉工具,旨在检测并过滤掉数据集中模糊、光照不足或低分辨率的图像。
Media Analyzer
一款高性能媒体分析引擎,用于从音频和视频文件中提取深度元数据、关键帧和波形可视化数据。
Nanobanana 图像生成
由 Google Gemini API 提供支持的多功能图像生成与编辑工具,实现无缝的 AI 驱动视觉创作。
AI 智能缺陷检测
用于自动化工业质量控制和表面缺陷定位的高性能计算机视觉系统。
Image Collect
一个专门用于从图像中提取结构化知识、OCR 文本和摘要并存储在本地数据库中的工具。
Precision Coral Metrics API (YOLO+SAM)
一款利用 YOLOv11 和 MobileSAM 的工业级视觉技能,为海洋研究人员提供像素级完美的珊瑚覆盖率分析。
Circos Plot Generator
一个专门用于生成复杂的 Circos 配置文件以及基因组数据和细胞相互作用网络的高分辨率环形图的工具。
Blueprint Batch (x402)
一种大规模建筑蓝图分析工具,使用本地视觉 AI 以统一费用处理多达 500 张图像。
ntriq Video Intelligence Analyzer
一种多模态 AI skill,为视频和图像 URL 提供深度智能分析、virality 评分和结构化元数据。
Egomotion Estimation Skill
一个自动化工具,利用光流法和几何变换来估计摄像机运动,从而对平移、俯仰和推拉等视频移动进行分类。
动态对象遮罩
一种先进的运动检测技能,可在补偿全局摄像机运动的同时为移动对象生成稀疏二值遮罩。
视频分析 Skill
一种先进的 AI Skill,使编码 Agent 能够分析本地视频文件并提取结构化实体、角色档案和关系图谱。
视频脚本提取与 AI 分析
一款 AI 驱动的工具,用于上传本地 MP4 视频并利用大语言模型生成结构化的脚本分析。
Toolfolio
Toolfolio 是一款自动化视频分析工具,可检测镜头转场并识别 14 种摄像机运动类型,从而生成 AI 视频 Prompt。
智慧农业 (Smart Agriculture)
一款 AI 驱动的农业智能技能,为现代农业提供作物监测、病虫害诊断、天气风险评估和市场趋势追踪。
Aitubiao AI 3D 图表生成器
一款 AI 驱动的图表绘制技能,可将原始数值数据转化为具有可定制材质风格的绝美 3D 插图。