GPT 多模态视觉分析

一种强大的视觉分析技能,使 AI 智能体能够解释、比对图像并从中提取结构化数据,以及处理多帧视频序列。

lnj22
2026年4月15日
0 收藏
532 下载

安装与下载

1 ClawHub CLI

从源直接安装技能的最快方式。

npx clawhub@latest install pedestrian-traffic-counting-gpt-multimodal

2 手动安装

将技能文件夹复制到以下位置之一

全局模式 ~/.openclaw/skills/
工作区 {'/skills/'}

优先级:工作区 › 全局 › 内置

3 提示词安装

将此提示词复制到 Openclaw 即可自动安装。

请帮我使用 Clawhub 安装 skill-pedestrian-traffic-counting-gpt-multimodal。如果尚未安装 Clawhub,请先安装(npm i -g clawhub)。

更倾向于下载?

获取包含原生技能文件的ZIP压缩包。

下载技能 (.zip)

基本信息

名称 GPT 多模态视觉分析
Slug pedestrian-traffic-counting-gpt-multimodal
创建者 lnj22
创建时间 2026-04-15 21:36:02
更新时间 2026-08-23 19:03:08
收藏数 0
使用量 532
浏览量 12

概述

一种强大的视觉分析技能,使 AI 智能体能够解释、比对图像并从中提取结构化数据,以及处理多帧视频序列。