tokenguard

🛡️ AI 智能体的 API 成本防火墙

PaxSwarm 开源的 API 成本守护工具,通过会话级预算追踪与硬限制机制,防止 AI Agent 产生失控的 API 调用费用,为开发者和团队提供可审计的支出管控。

收藏
3.5k
安装
999
版本
v1.0.0
CLS 安全性认证2026-05-19
点击查看完整报告 >

使用说明

核心用法

TokenGuard 是一款专为 AI Agent 设计的本地化 API 成本管控工具。其核心工作流围绕"预算前置检查-执行-成本记录"的闭环展开:用户通过 set 命令设定会话预算上限(默认 $20),在发起昂贵 API 调用前使用 check 命令进行预检,若预算充足则执行调用,完成后通过 log 记录实际支出。系统支持 extend 动态追加预算、、override 单次绕过限制等灵活机制,并提供完整的 history 审计追踪与 JSON 格式 export 导出功能。所有数据持久化于 ~/.tokenguard// 目录,按日自动重置或手动触发 reset

显著优点

零依赖纯本地架构:无需网络连接、无外部服务依赖,完全基于 Python 标准库实现,部署成本极低。 工程化集成友好:提供标准化退出码(0/1/2)与命令行接口,可无缝嵌入 Shell 脚本或 Python 子进程调用,示例代码即拿即用。 精细化成本感知:内置主流模型(Claude/GPT 系列)的每百万 token 定价参考表,辅助用户快速估算调用成本。 防御性设计:80% 预算阈值预警、硬限制阻断、单次绕过需显式声明,多重机制防止意外超支。 数据主权可控:MIT 开源协议,数据文件为纯 JSON 格式,用户完全掌握审计轨迹。

潜在缺点与局限性

单机会话隔离:预算状态绑定本地文件系统,无法在分布式多机部署的 Agent 集群间同步,多实例场景需自行解决状态一致性。 精度与币种局限:仅支持美元计价,最小单位为分,对需要多币种或更精细计费的场景覆盖不足。 无实时价格同步:内置定价表为静态参考,无法自动跟随厂商调价更新,长期使用可能产生估算偏差。 覆盖机制的信任假设override 命令虽需显式调用,但若 Agent 本身被恶意控制,仍可能成为绕过成本管控的通道。 缺乏可视化报表:仅提供命令行表格与原始 JSON 导出,无 Web 仪表盘或趋势分析能力。

适合的目标群体

独立开发者与小型团队:预算敏感、需要快速为个人项目或原型系统添加成本护栏。 AI Agent 框架构建者:需要将成本管控作为基础设施组件集成到更复杂的 Agent 编排系统中。 教育与实验场景:教学演示、学生作业、研究原型等需要"保险丝"机制防止意外高额账单的环境。 CI/CD 自动化测试:在持续集成流水线中限制测试用例的 API 调用成本,防止配置错误导致费用失控。

使用风险

数据持久化风险TOKENGUARD_DIR 环境变量允许自定义存储路径,若指向系统关键目录或共享存储,可能引发权限冲突或数据泄露。 状态丢失风险:会话数据存储于本地 JSON 文件,磁盘损坏、误删除或容器重启(未挂载持久卷)将导致历史记录与预算状态丢失。 估算误差累积check 命令依赖用户提供的预估成本,若实际调用因 token 消耗超预期而超支,系统仅在 log 阶段发现,此时费用已产生。 并发写入冲突:多进程同时操作同一 session.json 文件时存在竞态条件风险,极端情况下可能导致支出记录丢失或预算计算错误。 覆盖机制滥用:虽然 override 设计为单次有效,但频繁使用或脚本自动化调用可能削弱预算纪律,形成"狼来了"效应。

安全解读

核心用法

TokenGuard 是一款面向AI Agent的轻量级API成本监控工具,采用纯Python标准库实现,无需任何外部依赖。其核心工作流程围绕"预算预检-执行监控-事后审计"三阶段展开:

预算预检(Pre-flight):通过 tokenguard check <预估成本> 在执行昂贵API调用前验证预算充足性,返回退出码0/1供脚本判断;实时监控(Tracking):使用 tokenguard log <实际成本> 记录每次API调用的真实花费,自动累加至会话总额;限额管控(Enforcement):当累计消费触及设定阈值时,自动拦截后续操作并给出清晰的超额提示与应对选项(extend/reset/override)。

工具支持会话级数据隔离(默认每日自动重置)、环境变量自定义(TOKENGUARD_DIR/TOKENGUARD_DEFAULT_LIMIT)、JSON格式审计导出,并提供Shell命令行与Python subprocess两种集成模式,便于嵌入Agent工作流。

显著优点

1. 零依赖架构:仅依赖Python标准库(json/os/datetime等),彻底规避供应链攻击风险,部署成本极低
2. 防御性设计:硬限额机制(Hard Limit)从流程层面阻断超额消费,而非仅作告警;退出码设计便于CI/CD或Agent决策链集成

3. 隐私原生合规:所有数据本地化存储(~/.tokenguard/),零网络传输、零云端依赖,天然满足GDPR数据最小化原则

4. 审计可追溯:完整记录每笔消费的时间戳、金额、描述,支持JSON导出供长期分析

5. 弹性管控策略:提供override单次绕过、extend限额追加、reset会话清空等多档应急机制,兼顾安全性与灵活性

潜在缺点与局限性

1. 单机会话隔离:预算数据存储于本地文件系统,多机部署或容器化场景下需额外配置共享存储,否则预算无法跨实例同步
2. 无实时汇率/API定价同步:内置成本参考表为静态数据,实际API定价变动时需人工更新预估逻辑

3. T3来源风险:作者PaxSwarm为个人开发者账号,虽代码审查通过无恶意,但长期维护承诺与供应链安全需持续监控

4. 无多用户/多项目隔离:当前设计为单用户单机场景,缺乏企业级的项目维度预算拆分与权限管控

5. 估算依赖人工:check命令需调用方自行预估token成本,对复杂Agent工作流中动态生成的prompt难以精准预判

适合人群

  • 独立开发者/小团队:快速为个人Agent或内部工具添加成本护栏,无需搭建复杂监控系统
  • AI Agent原型验证阶段:在调用Claude/GPT-4等高价API时设置安全网,防止逻辑循环导致账单失控
  • 合规敏感场景:对数据出境严格限制的企业,需纯本地、无网络依赖的成本审计方案
  • CI/CD自动化测试:为集成测试中的API调用设置硬性预算上限,避免测试脚本异常导致费用激增

常规风险

1. 供应链更新风险:T3来源的后续版本可能引入未审计变更,建议fork后自行维护或定期重新CLS认证
2. 本地数据完整性:存储目录权限配置不当可能导致预算记录被篡改或读取,建议设置TOKENGUARD_DIR并限制700权限

3. 预估偏差累积:人工预估成本与实际计费可能存在gap,长期依赖check命令可能导致预算虚耗或冗余预留

4. 容器环境状态丢失:无持久化卷的容器重启后会话数据重置,可能造成预算管控盲区

tokenguard 内容

scripts文件夹
手动下载zip · 6.9 kB
tokenguard.pytext/plain
请选择文件