核心用法
lh-edge-tts 是一款基于 Python edge-tts 库的文本转语音技能,调用 Microsoft Edge 在线神经 TTS 服务生成高质量音频。支持触发词检测("tts"),可通过内置工具快速生成音频,也可使用命令行脚本实现深度定制。
主要功能:
- 语音合成:支持 40+ 种语言的神经语音(Neural voices)
- 参数调节:语速(±50%)、音高、音量精细控制
- 字幕生成:同步输出 VTT/SRT 格式字幕文件
- 偏好持久化:config_manager.py 保存用户默认设置
使用场景:多任务处理、无障碍辅助、驾驶/烹饪等无法阅读的场景。
显著优点
1. 零成本接入:无需 API 密钥,完全免费
2. 音质领先:Microsoft Neural TTS 引擎,接近真人自然度
3. 高度可定制:语速、音高、音色、输出格式均可调节
4. 多语言覆盖:中英日韩及欧洲主要语言均有优质语音
5. 开源生态:基于 edge-tts 开源项目,社区活跃
潜在局限
- 网络依赖:必须联网调用 Edge TTS 服务,无法离线使用
- 服务稳定性:依赖微软第三方服务,存在不可用风险
- 隐私考量:文本内容需发送至微软服务处理
- 无实时流式:需等待完整音频生成后返回
适合人群
- 内容创作者(视频配音、有声书制作)
- 无障碍需求用户(视障辅助、阅读障碍支持)
- 多语言学习者(发音示范、听力训练)
- 效率工具用户(文章朗读、新闻摘要收听)
常规风险
| 风险类型 | 说明 | 缓解措施 |
|---------|------|---------|
| 隐私泄露 | 文本上传至微软服务 | 避免处理敏感个人信息 |
| 服务中断 | 微软服务变更或限流 | 本地缓存备选方案 |
| 临时文件堆积 | 默认使用系统临时目录 | 定期清理或指定输出路径 |