核心用法
feishu-audio 解决 OpenClaw 原生 message 工具将音频作为普通文件发送、无法在飞书内直接播放的问题。它通过「上传→发送」两步 API 流程,把 TTS 生成的音频以 msg_type=audio 形式推送,用户在飞书会话中可直接点击播放,无需下载。
快速调用:
bash /root/.openclaw/skills/feishu-audio/scripts/send_audio.sh "内容" "接收者ID" [语音模型]
- 接收 ID 类型固定为
chat_id:群聊用oc_xxx,单聊用ou_xxx - 默认语音
zh-CN-XiaoyiNeural,可选中英男女声等多款 Azure TTS 音色
技术要点:
1. 上传阶段 file_type 必须填 opus(无论实际格式),否则返回 234001 错误
2. 发送阶段 msg_type 必须为 audio,否则显示为文件附件
显著优点
- 原生体验:飞书内直接播放,进度条、倍速、后台播放一应俱全
- 免配置:自动读取 OpenClaw 主配置中的飞书凭据,零手动密钥管理
- 多语言:内置中英等多语种语音模型,满足国际化团队需求
- 场景覆盖:语音报数、定时播报、告警通知等自动化场景一键落地
潜在缺点与局限性
- 接收 ID 类型写死为
chat_id,不支持email/user_id等其它寻址方式 - 依赖 OpenClaw 标准部署路径(
/root/.openclaw),自定义路径需手动改脚本 - 仅支持飞书开放平台 API,钉钉、企业微信等平台不兼容
- 语音合成质量取决于 Azure TTS 网络稳定性,离线环境不可用
适合人群
- 运维/开发者:需要向飞书群发送语音告警或播报
- 行政/HR:自动化语音报数、通知播报
- 任何使用 OpenClaw 且主力沟通工具为飞书的团队
常规风险
- 凭据泄露:脚本自动读取
openclaw.json,需确保该文件权限严格(建议 600) - API 限流:飞书开放平台有 QPS 与单日调用上限,高频场景需评估配额
- 内容合规:TTS 内容若涉敏感信息,仍受飞书内容安全策略管控