AI 语音与转录 精选AI Agent技能库
AI 语音与转录分类下的高质量技能
AI 语音克隆
一款高性能 AI 语音克隆技能,通过 SkillBoss API 以零加价利用 ElevenLabs 和多个顶级模型。
Whisper STT API
一个通过单一统一密钥访问的零加价 OpenAI Whisper 语音转文字 API 集成。
ElevenLabs TTS API
一个统一的 API 接口,通过单一 SkillBoss key 提供零加价的 ElevenLabs 文本转语音模型访问。
OpenAI Whisper API Hardened
一个高安全性的 CLI 技能,使用具有内置凭据保护的 OpenAI Whisper API 将音频转录为文本或 JSON。
Gemini Text-to-Speech (yummy-gen-voice)
一种高性能的文本转语音技能,利用 Google Gemini 模型通过 yummycli 界面生成单人或多角色音频。
audiopod: SkillBoss 音频处理
一套通用的 Openclaw Skills 音频工具包,通过单个 API 端点提供 AI 音乐生成、转录和高级音频处理功能。
短剧 TTS 合成
一种专门的文字转语音(TTS)技能,旨在将短剧脚本转换为听起来自然且富有情感的音频叙述。
缅甸语音频理解
一款由 Gemini 3.1 Flash Preview 模型驱动的缅甸语音频高精度转录工具。
lrshuAI 语音克隆
一种专业的 AI 驱动语音克隆技能,可根据参考音频样本合成新的语音。
lrshuAI 文本转语音
一个高性能文本转语音引擎,利用多种先进 AI 模型将书面文本转换为听感自然的真人语音。
TTS Synthesizer
一个多功能的文本转语音工具,供 AI 智能体使用 Microsoft Neural TTS 或兼容 OpenAI 的 API 生成自然流畅的语音响应。
Aliyun Qwen TTS Voice Design
一项通过阿里巴巴云百炼模型库(Model Studio)Qwen TTS VD 模型,根据自然语言描述设计可控合成语音的专业技能。
阿里云 Qwen TTS 语音克隆
一种专门用于克隆音色并使用阿里云百炼 Qwen 模型进行文本转语音(TTS)的 AI 技能。
Model Studio Qwen TTS
一个基于 AI 的文本转语音技能,利用阿里云 DashScope Qwen TTS 模型生成高质量的类人音频。
阿里云通义千问实时 TTS
一种高性能技能,利用阿里云百炼 Qwen 模型实现实时、低延迟的语音合成。
Aliyun Qwen LiveTranslate
一款专业的实时语音翻译技能,利用 Alibaba Cloud Qwen 模型实现低延迟多语言通信。
阿里云通义千问 ASR
一个强大的集成工具,用于使用阿里云百炼通义千问 ASR 模型进行非实时语音转录。
阿里云 CosyVoice 声音设计
通过阿里云 CosyVoice 使用自然语言描述设计自定义 AI 声音的强大集成工具。
阿里云 CosyVoice 语音克隆
通过使用阿里云 CosyVoice v3.5 引擎克隆公共参考音频,创建高保真自定义 AI 语音。
Bailian Qwen TTS
一个基于 Alibaba Qwen3-TTS 模型的 AI 语音合成 skill,提供高质量、多方言和多语言音频生成功能。