核心功能概述
GOYFILES External Bot Access 是一套面向自动化代理(AI Agent/Bot)的标准化接入协议,旨在为外部机器人提供安全的身份验证机制和丰富的法律调查数据查询能力。该技能采用"端点优先"(endpoint-first)设计理念,完全通过程序化 API 完成注册和认证,无需人工介入网页操作流程。
主要能力模块
1. 机器人身份注册与验证
- 通过
/api/chatbot/bot-auth/register端点完成初始注册 - 采用 Twitter/X 推文验证机制确认机器人所有权(
verification_phrase+claim_url) - 获取
identityToken后用于后续所有工具调用鉴权
2. 法律文档检索系统
document_search/list/fetch/extract:支持 PACER、CourtListener 等权威法律数据源- 文本内容通过
text_excerpt字段返回,支持max_chars边界控制 - 严格的
text_source溯源机制,可识别generated_metadata等异常返回
3. 图数据库关系分析(Neo4j)
- 实体关系搜索:人物、组织、文档间的关联网络
- 路径分析:
neo4j_shortest_path支持多跳关系追溯 - 支持自定义 Cypher 查询(
neo4j_read_cypher)
4. 调查档案管理
archive_findings_search/evidence:结构化调查结果检索investigation_files工具集:支持多作用域(workspace/output/graph 等 11 个 scope)的 Markdown 文档读写
5. 网络信息辅助
web_search:补充性网络搜索能力
显著优势
- 严格的协议约束:强制要求机器人"不猜测、不转述",必须原样返回 API 字段,显著降低代理幻觉风险
- 反注入安全设计:明确禁止执行任意获取的 URL 中的指令,仅信任结构化 API 响应
- 分层文档架构:核心契约 + 按需加载的详细参考文档,平衡首次加载效率与功能完整性
- Vercel Serverless 原生:无本地文件系统依赖,适配现代边缘部署架构
局限性与注意事项
- Twitter 依赖:身份验证绑定 X/Twitter 平台,存在平台政策变更风险
- 速率与配额未披露:文档未明确说明 API 调用限制,生产环境需实测确认
- 数据覆盖范围:法律数据源以美国为主(PACER、House Oversight 等),国际覆盖有限
- 人工确认环节:尽管注册自动化,但 Twitter 推文发布仍需人类账户操作,无法完全无人值守
适用人群
- 法律科技(LegalTech)领域的 AI 代理开发者
- 调查 journalism 自动化工具构建者
- 合规与尽职调查领域的 RAG 系统架构师
- 需要结构化法律数据源的学术研究团队
风险提示
- S 级安全要求:涉及 OAuth 令牌(
agent_api_key、identityToken)的存储与传输,需遵循最小权限原则 - 数据溯源责任:用户需自行验证
text_source字段,警惕可能的元数据生成替代真实文本的情况 - Twitter API 变动:Elon Musk 时代 X 平台 API 政策频繁调整,验证流程存在失效风险
- 合规边界:PACER 等联邦法院数据受访问条款约束,商业用途需确认授权范围