核心用法
Smart Memory 是专为 AI Agent 设计的上下文感知记忆系统,采用 SQLite 单文件数据库,无需外部服务或 API 密钥。核心功能包括:
1. 双模式检索:
- Fast Mode:直接向量相似性搜索,适合简单查找、快速事实检索(约 100-10,000 chunks/sec)
- Focus Mode:通过 Focus Agent 多轮策展(检索→排序→综合→输出),适合复杂决策、多事实合成
2. 混合搜索算法:FTS5 关键词搜索(BM25)+ 语义向量搜索,加权融合(70% 向量 + 30% 关键词)
3. 零配置部署:安装后立即工作,支持可选的 sqlite-vec 扩展提升性能
显著优点
- 完全本地化:Transformers.js 运行嵌入模型,无网络依赖、无 API 成本
- 混合检索质量:BM25 捕获精确词元,向量捕获语义意图,显著优于单一方法
- Focus Agent 智能策展:对复杂查询自动进行相关性加权、来源提升、时效性加权和叙事合成
- 无缝迁移:作为 OpenClaw 记忆系统的即插即用替代方案
- 可扩展性:SQLite 后端支持无限规模(理论上限 140TB)
潜在缺点与局限性
- 性能折衷:Focus Mode 增加 50-100ms 延迟,不适合对延迟敏感的简单查询
- 嵌入质量依赖:本地嵌入模型(约 384-768 维)可能弱于 OpenAI text-embedding-3-large 等商业 API
- 策展主观性:Focus Agent 的合成叙事可能遗漏原始文本的微妙语义
- 无分布式能力:单文件 SQLite 限制多实例同步场景
- 冷启动成本:首次同步大规模记忆库时嵌入计算耗时
适合人群
- 需要 本地优先、隐私敏感 记忆方案的 AI Agent 开发者
- 使用 OpenClaw 框架寻求更高检索质量的用户
- 处理 长上下文项目历史 的知识管理场景(如开发日志、决策记录)
- 希望 避免 LLM API 调用成本 的边缘部署场景
常规风险
| 风险类型 | 描述 | 缓解措施 |
|---------|------|---------|
| 检索幻觉 | Focus Mode 合成可能过度推断 | 保留原始 chunks 引用,置信度评分 |
| 嵌入漂移 | 模型更新导致向量空间不一致 | 版本锁定嵌入模型,定期全量重建 |
| 数据丢失 | SQLite 单点故障 | 常规备份 .db 文件,可导出为 SQL |
| 隐私泄露 | 本地模型仍需加载外部权重 | 审计 Transformers.js 依赖,离线环境 |
| 模式混淆 | Fast/Focus 选择不当影响结果质量 | CLI 提供 `--suggest` 智能推荐模式 |