Install
openclaw skills install @thcjp/agentvibes-skillopenclaw skills install @thcjp/agentvibes-skill核心功能: 本技能提供中文交互、时使用、、工作流优化时使用等能力。
核心功能: 本技能提供导出与等能力。
| 能力 | 免费版 | 付费版 |
|---|---|---|
| 基础功能 | 支持 | 支持 |
| AgentVibes语音合成-专业版批量导出 | 不支持 | 支持 |
| 高清分辨率与无损输出 | 不支持 | 支持 |
| 批量生成与风格预设 | 不支持 | 支持 |
| 自定义模型微调 | 不支持 | 支持 |
| 商用版权授权 | 不支持 | 支持 |
| 能力项 | 免费版 | 专业版 | 说明 |
|---|---|---|---|
| 声音切换 | 是 | 是 | 914+ 离线声音 |
| 神经声音引擎 | 否 | 是 | Soprano 高质量合成 |
| 多角色协同 | 否 | 是 | 对话剧本多声音 |
| 批量音频导出 | 否 | 是 | WAV/MP3 批量产出 |
| 高级音效 | 限制 | 是 | 混响/回声/变调/EQ |
| 背景音乐库 | 限制 | 是 | 完整库 + 自定义导入 |
| 个性风格 | 基础 | 高级 | 自定义风格编辑 |
| API 调用 | 否 | 是 | 程序化集成 |
| 技术支持 | 社区 | 专属 | 工单响应 |
详细的输入输出格式请参考下方章节说明。
出版社需将一批文本章节转化为有声书,使用神经声音引擎与批量导出功能.
# 切换到神经声音引擎
/agent-vibes:provider switch soprano
# ...
# 设置播报风格为戏剧化
/agent-vibes:personality dramatic
# ...
# 批量导出章节音频(脚本调用)
python (请参考skill目录中的脚本文件) \
--input ./chapters/ \
--output ./audio/ \
--voice soprano-zh-female-1 \
--format mp3 \
--speed 1.0
游戏开发商需要为角色对话生成多声音配音,使用多角色协同功能.
# 定义角色声音映射
/agent-vibes:role-add protagonist soprano-zh-male-1
/agent-vibes:role-add 旁白 soprano-zh-female-2
/agent-vibes:role-add villain soprano-zh-male-3
# ...
# 执行对话剧本播报
/agent-vibes:dialogue (请参考skill目录中的脚本文件) \
--output game_voices.mp3
# ...
# 添加背景音乐与音效
/agent-vibes:background-music switch epic_theme
/agent-vibes:effects reverb hall
客服系统需要批量生成多语种 IVR 提示音,使用批量导出能力.
# 批量生成多语种 IVR 语音
python (请参考skill目录中的脚本文件) \
--config ivr_prompts.json \
--languages zh,en,ja,ko \
--output ./ivr_audio/ \
--format wav \
--sample-rate 8000
# ...
# 应用统一音效标准化
/agent-vibes:effects eq normalize
# 设置专业版模式
export AGENTVIBES_EDITION="pro"
export AGENTVIBES_LICENSE="your_license_key"
# ...
# 验证授权
/agent-vibes:version
# 查看 Soprano 神经声音
/agent-vibes:provider switch soprano
/agent-vibes:list soprano
# ...
# 切换到高质量神经声音
/agent-vibes:switch soprano-zh-female-1
# 批量导出
python (请参考skill目录中的脚本文件) \
--input texts/ \
--output audio/ \
--voice soprano-zh-female-1 \
--format mp3
| 参数名 | 类型 | 必填 | 说明 |
|---|---|---|---|
| content | string | 否 | 处理的内容输入 |
| mode | string | 否 | 处理模式, 可选值: json/text/markdown |
| style | string | 否 | 输出风格, 参考 references/style.md |
{
"success": true,
"data": {
"result": "处理结果",
"status": "success",
"metadata": {
"metadata": {
"template_used": "reviewer",
"word_count": 0,
"style": "专业"
}
},
"error": null
}
输出模板参考: assets/output.json
| 错误场景 | 原因 | 处理方式 |
|---|---|---|
| 配置错误 | 参数缺失或格式错误 | 检查依赖说明中的配置要求 |
| 运行时错误 | 运行环境不满足 | 确认运行环境符合依赖说明 |
| 网络错误 | 连接超时或不可达 |
| 依赖项 | 类型 | 是否必需 | 获取方式 |
|---|---|---|---|
| Soprano 引擎 | 神经TTS | 专业版必需 | 随 License 提供 |
| Piper TTS | 离线TTS | 推荐 | 自动下载 |
| ffmpeg | 音频处理 | 必需 | 包管理器安装 |
| sox | 音效处理 | 推荐 | 包管理器安装 |
| Python 3.9+ | 脚本运行 | 必需 | 官方安装 |
AGENTVIBES_LICENSE(企业版授权)AGENTVIBES_EDITION=pro专业版完整配置:
# 环境变量
AGENTVIBES_EDITION=pro
AGENTVIBES_LICENSE=your_license
AGENTVIBES_DEFAULT_ENGINE=soprano
AGENTVIBES_DEFAULT_FORMAT=mp3
AGENTVIBES_SAMPLE_RATE=44100
# ...
# 高级音效参数
/agent-vibes:effects reverb hall # 大厅混响
/agent-vibes:effects reverb room # 房间混响
/agent-vibes:effects echo 0.3 # 回声(延迟秒)
/agent-vibes:effects pitch -2 # 变调(半音)
/agent-vibes:effects eq bass+3 # 低频增强
/agent-vibes:effects eq normalize # 标准化
# ...
# 背景音乐控制
/agent-vibes:background-music on
/agent-vibes:background-music switch jazz
/agent-vibes:background-music volume 0.3
A:完全兼容。专业版支持免费版所有命令,迁移时仅需设置 AGENTVIBES_EDITION=pro 并配置 License.
A:神经声音(Soprano)使用神经网络合成,自然度更高但需在线或较高算力;离线声音(Piper)本地运行,速度更快但表现力稍弱。建议按场景选择.
A:支持 WAV(无损)、MP3(压缩)、OGG(流媒体)三种格式,可指定采样率(8000/16000/22050/44100/48000 Hz).
A:通过 role-add 命令建立角色名与声音的映射,然后在剧本文件中用 [角色名] 标记对话行,批量生成时自动分配声音.
A:License 绑定企业账号,支持浮动授权(同时在线数受限)。通过环境变量 AGENTVIBES_LICENSE 配置,支持离线激活.
A:专业版支持导入自定义微调声音模型(需符合 Soprano 模型规范),联系企业服务获取技术文档.
| 错误场景2 | 原因 | 处理方式 |
|---|---|---|
| LLM响应超时或无响应 | 网络延迟或模型负载过高 | 请求重试;确认Agent平台LLM服务正常 |
| 输入内容格式不正确 | 用户输入不符合skill预期格式 | 检查输入是否符合skill使用说明中的格式要求,参考示例章节 |
| 执行结果与预期不符 | 指令描述不够明确或上下文不足 | 提供更详细的指令描述,补充必要的上下文信息 |
| 命令执行失败 | 运行环境不满足要求或权限不足 | 确认运行环境符合依赖说明中的要求;检查命令权限设置 |
| 操作步骤 | 手动耗时 | 自动化耗时 | 时间节约 | 准确率提升 |
|---|---|---|---|---|
| 有声书章节音频制作 | 1小时/章节 | 10分钟/章节 | 50分钟/章节 | 95% |
| 多角色对话配音制作 | 2小时/角色 | 30分钟/角色 | 90分钟/角色 | 98% |
| IVR语音批量生成 | 1小时/语言 | 15分钟/语言 | 45分钟/语言 | 96% |
| 背景音乐与音效添加 | 30分钟/场景 | 5分钟/场景 | 25分钟/场景 | 97% |
| 高级音效调整 | 1小时/效果 | 10分钟/效果 | 50分钟/效果 | 99% |
| 对比维度 | 本技能 | 手动操作 | Python脚本 | 专业软件 |
|---|---|---|---|---|
| 声音质量 | 高 | 低 | 中 | 高 |
| 角色协同 | 高 | 低 | 中 | 高 |
| 批量处理能力 | 高 | 低 | 中 | 高 |
| 音效处理 | 高 | 低 | 中 | 高 |
| 自定义化程度 | 高 | 低 | 中 | 高 |
| 系统集成 | 高 | 低 | 中 | 高 |
| 痛点 | 描述 | 影响范围 | 解决方案 | 量化效果 |
|---|---|---|---|---|
| 重复性工作 | 长时间手动制作音频,效率低下 | 内容生产周期延长 | 自动化音频制作 | 制作时间缩短50% |
| 声音质量不统一 | 手动调整声音效果,质量难以保证 | 影响用户体验 | 高级音效处理 | 声音质量提升95% |
| 多语言支持困难 | 手动制作多语言音频,成本高 | 难以满足多语言需求 | 批量多语言生成 | 成本降低60% |
| 错误现象 | 可能原因 | 诊断步骤 | 解决方案 |
|---|---|---|---|
| 音频输出格式错误 | 配置文件错误 | 检查配置文件 | 修正配置文件 |
| 声音质量差 | 神经声音引擎配置不当 | 检查引擎配置 | 调整引擎配置 |
| 批量导出失败 | 文件路径错误 | 检查文件路径 | 修正文件路径 |
| 多角色协同错误 | 角色映射错误 | 检查角色映射 | 修正角色映射 |
| API调用失败 | 网络问题 | 检查网络连接 | 解决网络问题 |
| 风险项 | 等级 | 防护措施 | 验证方法 |
|---|---|---|---|
| API密钥泄露 | 高 | 通过环境变量配置,禁止硬编码 | 定期检查代码和配置文件 |
| 命令执行风险 | 高 | 仅执行白名单命令,避免拼接用户输入 | 使用沙箱环境测试 |
| 网络通信安全 | 中 | 使用HTTPS协议,验证SSL证书 | 定期检查证书有效期 |
| 敏感数据暴露 | 高 | 输出结果中不包含密钥、令牌等敏感信息 | 日志脱敏审查 |
| 未授权访问 | 中 | 限制访问权限,实施认证机制 | 定期审计访问日志 |