Aliyun Asr

🎙️ 纯语音识别,零语音干扰

阿里云语音识别技能,专为OpenClaw设计,实现纯语音转文本功能,支持飞书等多通道,零语音合成干扰。

收藏
7.1k
安装
3.1k
版本
1.0.5
CLS 安全扫描中
预计需要 3 分钟...

使用说明

核心功能与定位

Aliyun ASR 是 OpenClaw 生态中专用的纯语音识别技能,专注于将语音消息高效转换为文本,明确排除语音合成功能,避免 AI 回复产生语音干扰。这种"单向处理"设计使其在多通道客服、会议纪要等场景具有独特价值。

显著优点

1. 极简架构:功能单一明确,降低故障率与维护成本
2. 多通道原生支持:无缝集成飞书、Telegram、WhatsApp 等 OpenClaw 全通道

3. 企业级安全:强制 RAM 子账号、配置分离、最小权限原则

4. 格式兼容广:覆盖 MP3/WAV/OGG/FLAC/AMR/OPUS 主流音频格式

5. 零侵入集成:自动识别语音消息,无需用户手动触发

潜在局限

  • 云厂商锁定:依赖阿里云 NLS 服务,迁移成本较高
  • 网络依赖:实时转写需稳定连接阿里云上海节点
  • 隐私合规:语音数据流经阿里云,需确认企业数据出境/云服务商合规政策
  • 无离线能力:断网场景完全不可用

适合人群

  • 已部署 OpenClaw 且需要语音消息处理的企业用户
  • 飞书重度使用者(语音消息转纪要需求强烈)
  • 追求"纯文本工作流"、反感语音回复干扰效率的用户

常规风险

1. 密钥泄露风险aliyun-asr-config.json 含敏感凭据,需严格 chmod 600
2. 费用失控:阿里云 NLS 按调用量计费,高并发场景需设置用量告警

3. 识别准确率波动:方言、嘈杂环境、专业术语场景可能出现误识别

4. 区域可用性:默认 cn-shanghai,跨区域部署需评估延迟

Aliyun Asr 内容

手动下载zip · 5.3 kB
__init__.pytext/plain
请选择文件