feishu-audio

🔊 音频秒转飞书语音消息

通过 FFmpeg 将音频转码为 Opus 格式,实现飞书可播放语音消息的发送,支持 TTS 集成。

收藏
3.2k
安装
1.2k
版本
1.0.0
CLS 安全扫描中
预计需要 3 分钟...

使用说明

核心用法

本技能提供本地音频文件到飞书语音消息的一键转换与发送能力。核心流程包含三步:首先利用 FFmpeg 将输入音频(MP3、WAV 等)转码为飞书要求的 Opus 格式(24000Hz 单声道);其次通过飞书 Open API 上传音频文件获取 file_key;最后调用消息接口发送 audio 类型消息。

技能提供 send_audio.sh 主脚本,支持两种调用模式:直接发送现有音频文件,或与 edge-tts 等 TTS 工具链组合,先合成语音再推送。接收者 Open ID 可通过环境变量预设或命令行参数动态指定。

显著优点

  • 格式兼容性佳:自动处理主流音频格式转码,屏蔽飞书 Opus 格式细节
  • 工作流整合:与 TTS 技能无缝衔接,实现"文本→语音→消息"全自动化
  • 部署轻量:仅依赖 FFmpeg 和飞书标准 API,无额外服务端组件
  • 灵活触发:支持命令行直接调用,便于嵌入定时任务或 CI/CD 流程

潜在缺点与局限性

  • 环境依赖刚性:必须预装 FFmpeg 且版本需支持 libopus 编码器
  • 认证配置繁琐:需人工配置 FEISHU_APP_ID/SECRET 等环境变量,缺乏交互式配置向导
  • 无内置语音合成:自身不产生音频,依赖外部 TTS 工具生成源文件
  • 单文件处理:未实现批量音频发送或消息模板管理能力
  • 网络稳定性敏感:上传和发送环节依赖飞书 API 可用性,无本地重试队列

适合人群

  • 运维/开发人员:需向飞书群聊或用户自动推送语音告警、播报通知
  • 内容运营者:批量生成并分发语音内容,结合 TTS 实现个性化播报
  • 智能家居/IoT 开发者:将设备状态转为语音消息推送到工作协同平台

常规风险

  • 凭证泄露风险:APP_SECRET 以环境变量存储,在多用户环境或日志中可能意外暴露
  • 文件残留风险:转换过程在 /tmp 生成中间文件,异常中断时可能未及时清理
  • API 限流风险:高频调用可能触发飞书频率限制,导致消息发送失败
  • 音频版权合规:发送第三方版权音频内容存在法律风险,需确保内容合规

feishu-audio 内容

scripts文件夹
手动下载zip · 3.0 kB
send_audio.shtext/x-shellscript
请选择文件