Install
openclaw skills install @noaheleven/local-tts本地文本转语音(TTS)。支持两种引擎:edge-tts(微软神经网络语音,音质自然,需联网,免费无需 key)和 pyttsx3(Windows SAPI 离线引擎,完全断网可用)。当用户/agent 需要把文本转成语音文件(mp3/wav)、生成语音播报、配音时使用。
openclaw skills install @noaheleven/local-tts把任意文本转成本地音频文件,给 agent 或脚本调用。
⚠️ 默认行为:不传任何参数 = 联网 edge-tts + 晓晓女声(zh-CN-XiaoxiaoNeural)。只有显式加
--offline才走离线引擎。
| 引擎 | 音质 | 联网 | 说明 |
|---|---|---|---|
| edge-tts(默认) | ⭐⭐⭐ 神经网络语音,自然 | 需要 | 微软 Edge 同款语音,免费无 key,中文可选晓晓/云希/晓伊等 20+ 音色 |
| pyttsx3(离线) | ⭐ 老式合成音 | 完全离线 | Windows 自带 SAPI(Huihui 中文),断网兜底 |
# 基础用法:edge-tts 神经网络语音(默认晓晓女声)
python scripts/tts.py "要合成的文本" -o 输出路径.mp3
# 生成后自动播放(统一转 wav 用 winsound 同步播放,阻塞到播完,不弹窗;仅 Windows)
python scripts/tts.py "文本" -o out.mp3 --play
# 指定音色(edge-tts)
python scripts/tts.py "文本" -o out.mp3 -v zh-CN-YunxiNeural
# 强制离线引擎(断网可用)
python scripts/tts.py "文本" -o out.wav --offline
# 列出 edge-tts 全部可用音色
python scripts/tts.py --list-voices
# 指定语速/音量(0.5~1.5,默认 1.0)
python scripts/tts.py "文本" -o out.mp3 -r 1.1 --volume 1.2
⚠️ 内容红线:语音只播报最终总结/结论内容。 严禁播放思考过程、执行过程、工具调用过程、中间日志等。若任务无总结,则不播。
触发方式对照:
--play(方案 A)--play(方案 B)--play(方案 C)播放技术要求(已固化,勿改)
winsound,--play 仅在 Windows 可用;其他平台只生成文件zh-CN-XiaoxiaoNeural 晓晓(女,温柔,默认)zh-CN-YunxiNeural 云希(男,阳光)zh-CN-YunyangNeural 云扬(男,新闻播报)zh-CN-XiaoyiNeural 晓伊(女,活泼)zh-CN-liaoning-XiaobeiNeural 晓北(女,东北话)--list-voices 或 edge-tts 官方列表pip install pyttsx3 edge-tts imageio-ffmpeg(imageio-ffmpeg 仅 --play 播放时用到)import 延迟到函数内:--list-voices/--offline 等场景不会因缺依赖而整体崩溃-o;未指定时固定生成到 本 skill 目录下 tts_output/(用脚本 __file__ 定位,与调用时工作目录无关)20260810_新闻早报.mp3),不用乱码/序号.mp3;离线引擎 → .wav--play 时的转码 wav 放系统临时目录(local_tts_play.wav),不会留在工作区--play 播放:统一静默转 wav 后 winsound 同步播放(阻塞到播完),不弹窗(ffmpeg 用 imageio-ffmpeg 隔离版,装于 venv 内);mp3 转码走临时目录 local_tts_play.wav