核心用法
gpt 是一款专为 OpenAI GPT API 设计的命令行工具,帮助开发者快速构建标准化的 API 请求载荷。主要功能模块包括:
聊天补全 (chat):从命令行参数生成 JSON 请求体,支持系统提示词、用户消息、模型选择(gpt-4o、gpt-4-turbo 等)及温度参数调节。
文本嵌入 (embed):生成 embedding API 请求,支持单文本输入或批量文件处理,兼容 text-embedding-3-small 等模型。
微调数据准备 (finetune):将 CSV 等源格式转换为 JSONL 训练数据,并提供格式校验功能,确保符合 OpenAI 微调规范。
成本估算 (cost):基于 token 数量和模型定价计算 API 调用成本,支持直接输入 token 数或从文件自动估算。
批量处理 (batch):从提示词列表生成多条 API 请求,输出 JSONL 格式便于批量提交。
格式转换 (convert):实现 JSONL 与 CSV 的双向转换,简化数据预处理流程。
显著优点
- 开发效率提升:无需手动拼接 JSON,一行命令生成标准请求体,减少格式错误
- 多场景覆盖:完整支持 chat、embeddings、fine-tuning 三大核心 API 类型
- 成本可控:内置定价表,开发阶段即可精确预算,避免意外账单
- 轻量依赖:仅要求 Bash 4+,无需复杂运行时环境,CI/CD 友好
潜在局限
- 非官方工具:由第三方 BytesAgain 维护,非 OpenAI 官方 SDK,更新可能滞后于 API 变更
- 功能边界:专注于请求生成,不包含实际 API 调用执行功能,需配合 curl 或其他 HTTP 客户端使用
- 文档深度有限:参数校验规则、错误处理机制等细节需用户自行探索
适合人群
- 需要频繁调试 GPT API 参数的开发者
- 构建数据流水线、批量处理任务的 AI 工程师
- 在 shell 环境中自动化 OpenAI 工作流的 DevOps 人员
- 学习 OpenAI API 格式的初学者(可作为交互式参考)
常规风险
1. API 密钥管理:工具本身不处理认证,但生成的请求需包含有效 API key,需确保密钥不泄露至日志或版本控制
2. 成本失控:批量生成大量请求时,建议先用 --tokens 配合 cost 命令预估,避免直接提交产生高额费用
3. 模型版本漂移:OpenAI 频繁更新模型列表,需关注工具版本(当前 v3.4.0)是否支持最新模型名称
4. 数据隐私:处理敏感数据生成微调集时,注意 JSONL 文件的存储权限,避免训练数据泄露