Percept Voice Commands

🎙️ 语音唤醒,双手解放

为OpenClaw代理提供语音唤醒词检测与指令执行,支持邮件、日程、提醒等免手操作,需配合Percept监听服务运行。

收藏
5.3k
安装
1.3k
版本
1.0.0
CLS 安全扫描中
预计需要 3 分钟...

使用说明

核心用法

percept-voice-cmd 是 Percept 生态中的语音控制中枢,通过监听环境语音流,识别预设唤醒词(如"Hey Jarvis"),将后续语音指令路由至 OpenClaw 代理执行。核心能力包括:

  • 多模态指令支持:邮件发送、短信、日程查询、提醒设置、笔记记录、网络搜索及自定义命令
  • 智能缓冲机制:唤醒词触发后自动延长 5 秒缓冲区,并开启 10 秒连续指令窗口,避免重复唤醒
  • 双层意图解析:正则快速匹配优先,复杂指令自动降级至 LLM 解析
  • 联系人智能解析:自动关联 percept/data/contacts.json 地址簿完成人名到联系方式的映射

显著优点

1. 生态整合度高:与 Percept 监听层、OpenClaw 代理形成完整语音交互闭环
2. 低延迟响应:本地优先的正则匹配确保常用指令毫秒级响应

3. 安全授权机制:基于声纹的说话人白名单(speakers.json),未授权者仅记录不执行

4. 可扩展架构:自定义唤醒词与指令类型支持个性化工作流

潜在局限与风险

| 局限 | 说明 |
|------|------|
| **依赖链条复杂** | 必须同时运行 `percept-listen` 和 OpenClaw CLI,任一组件故障导致服务中断 |
| **隐私敏感** | 持续监听音频流,本地虽经授权管理,但语音数据缓冲存在泄露风险 |
| **误唤醒问题** | 默认唤醒词如"take notes"为常见短语,日常对话中可能触发误操作 |
| **LLM 成本** | 复杂指令解析依赖外部 LLM,高频使用产生额外 API 费用 |
| **本地化不足** | 联系人解析依赖固定 JSON 文件,无实时通讯录同步能力 |

适合人群

  • OpenClaw/Percept 生态的深度用户,已部署本地监听基础设施
  • 需要免手操作电脑的技术工作者(开发者、数据分析师)
  • 注重隐私、倾向本地语音处理而非云端方案的用户

常规风险提示

  • 供应链安全:GitHub 仓库 GetPercept/percept 为单一来源,需关注更新签名验证
  • 权限扩张:OpenClaw 代理通常具备系统级操作能力,语音指令误识别可能导致不可逆操作(如误发邮件)
  • 配置安全speakers.jsoncontacts.json 以明文存储敏感信息,需确保文件系统权限严格限制

---

注:安全认证报告为占位生成,未执行实际漏洞扫描,生产环境部署前建议进行独立安全审计。

Percept Voice Commands 内容

手动下载zip · 2.5 kB
skill-card.mdtext/markdown
请选择文件