核心用法
percept-listen 是一个面向 OpenClaw 代理的音频感知技能,通过连接可穿戴麦克风(Omi 吊坠或 Apple Watch)实现环境对话的实时捕获与转录。用户通过 pip install getpercept 本地部署 Percept 服务器,配置 Webhook 接收设备转录数据,即可让代理"听见"周围对话。
显著优点
- 完全本地处理:音频转录由手机端完成,传输仅为文本片段,Percept 服务器本地存储至 SQLite,音频数据不离开用户设备
- 结构化数据输出:自动生成带说话人标签、时间戳的对话记录,支持 FTS5 全文检索
- 硬件生态兼容:支持 Omi 吊坠(开源可穿戴 AI 设备)和 Apple Watch 双平台
- 实时流式接入:提供
/tmp/percept-live.txt实时转录文件,便于代理即时读取
潜在缺点与局限性
- 部署门槛较高:需自行搭建本地服务器、配置内网穿透(Cloudflare/ngrok/Tailscale)、绑定 Webhook,技术门槛显著高于纯云端方案
- 依赖特定硬件:必须使用 Omi 吊坠或 Apple Watch,无通用麦克风支持
- 功能边界模糊:自述为"未执行安全扫描"的占位报告,实际安全机制需用户自行审计
- 生态早期阶段:GitHub 仓库活跃度与长期维护承诺不明
适合人群
- 注重隐私的 OpenClaw 高级用户,愿为本地部署接受技术复杂度
- 已拥有 Omi 吊坠或 Apple Watch 的硬件早期采用者
- 需要代理具备"环境感知"能力的自动化工作流构建者
常规风险
- Webhook 暴露风险:内网穿透配置不当可能导致转录数据暴露于公网
- 本地数据安全:SQLite 数据库以明文存储对话记录,无内置加密机制
- 供应链风险:
getperceptPyPI 包与 Omi 固件的安全审计状态未知 - 隐私合规:未经他人同意采集环境对话可能违反 GDPR/CCPA 等法规