核心功能
Airweave 是一款面向 AI Agent 的上下文检索基础设施,通过统一搜索层打通企业分散在多个 SaaS 应用中的数据资产。其核心能力包括:
搜索模式
- 混合检索(Hybrid):默认策略,结合语义理解与关键词匹配
- 语义搜索(Semantic):基于向量相似度,理解自然语言意图
- 关键词搜索(Keyword):精确匹配特定术语或文档标识
- 智能检索(Agentic):支持自主决策的上下文获取
数据连接器生态
覆盖主流协作与业务系统:Slack、GitHub、Notion、Jira、Confluence、Google Drive、Salesforce、Linear、SharePoint、Stripe 等,实现跨应用统一索引与实时同步。
检索参数体系
--temporal:时间权重调节(0-1),满足"最近讨论"等时序需求--strategy:检索策略切换--expand:查询扩展,自动拓宽检索范围--rerank:LLM 重排序优化结果质量
显著优势
| 维度 | 表现 |
|------|------|
| 集成广度 | 20+ 主流企业应用原生支持 |
| 检索灵活性 | 三种策略 + 时间感知 + 查询扩展 |
| 结果可信度 | 相关性评分机制(0.85+高置信使用) |
| 输出可控性 | 支持原始数据与AI生成答案双模式 |
潜在局限
1. 数据边界依赖:检索质量受限于企业已连接应用的数据完整性与同步时效
2. 权限复杂性:跨应用数据需统一授权治理,实际部署中可能面临细粒度访问控制挑战
3. 查询构建门槛:虽然支持自然语言,但复杂业务场景仍需理解检索参数调优逻辑
4. 供应商锁定风险:核心数据索引层依赖单一服务商
适用场景
- 企业知识问答:基于内部文档、Slack 讨论、Jira 工单回答"谁负责…""政策是…"等事实性问题
- 智能文档定位:快速定位分散在各系统的 API 文档、会议纪要、项目资料
- Agent 任务增强:为 AI Agent 提供实时上下文,如"检查我们的 Notion 文档后生成报告"
风险与合规考量
- 数据隐私:企业敏感数据经第三方基础设施索引,需评估数据处理协议(DPA)与合规认证
- API 密钥安全:依赖
AIRWEAVE_API_KEY进行身份验证,密钥泄露可能导致全量数据访问 - 结果准确性:0.5 以下相关性分数的结果存在误导风险,需人工复核机制
- 时序偏差:
--temporal参数依赖索引时间戳,若源应用同步延迟可能影响"最新"信息准确性
技术集成要点
Python 3 运行时依赖,通过环境变量注入认证凭证,支持程序化查询构建与结果处理。