核心用法
openLesson Agent API Skill 是一个面向 AI Agent 设计的技能接口,允许 Agent 通过程序化方式与 openLesson 音频辅导平台交互。该平台采用苏格拉底式教学法,通过问答引导学生自主思考,而非直接提供答案。
主要功能模块:
1. 学习计划生成 (/api/agent/plan): 为指定主题创建有向图学习路径,可自定义学习周期(7-180天),系统自动分配3-25个会话节点
2. 会话启动 (/api/agent/session/start): 开启特定主题的苏格拉底式对话,返回会话ID及音频提交规范
3. 音频分析 (/api/agent/session/analyze): 接收base64编码的音频输入,分析学生的推理过程,返回"知识缺口评分"(gapScore)及跟进问题
4. 会话管理 (/api/agent/session/end 与 /summary): 结束会话并生成学习报告
关键技术约束:
- 纯音频交互:analyze端点仅接受音频输入,需将语音转为base64编码(支持webm/mp4/ogg格式)
- 必须使用完整域名
https://www.openlesson.academy,裸域名会因重定向丢失Authorization头 - 建议音频分片30-60秒提交,单片段不超过60秒
Agent 行为要求:
- 生成学习计划后,必须为用户安排所有会话的提醒(非日历技术集成,而是主动通知行为)
- 跟踪gapScore判断掌握程度,当
requiresFollowUp为true时需继续追问 - 使用
bash -c 'printf...'模式避免JSON转义问题
显著优点
1. 教育方法论先进:苏格拉底式提问迫使学习者主动建构知识,认知留存率显著高于被动接收
2. 个性化路径:基于有向图的学习计划,节点状态追踪(available/completed)支持自适应进度
3. 实时推理诊断:gapScore量化知识缺口(0-1范围),signals字段精确定位理解盲区
4. Agent原生设计:API接口专为自动化Agent设计,支持完整工作流编排
潜在局限
1. 音频唯一性限制:无法接收文本输入,必须依赖TTS/录音转换,增加延迟和错误环节
2. 无持久状态管理:会话ID仅内存存储,跨对话需重新建立上下文
3. 评分黑箱性:gapScore计算机制未公开,教育有效性依赖平台内部模型
4. 语言支持未明确:文档未说明支持的教学语言范围
适合人群
- 自驱型学习者:能耐受"被提问"的学习方式,而非追求即时答案
- Agent开发者:需集成结构化教育能力的AI应用
- 知识密集型领域:编程、数学、科学概念等需要深度推理的学科
- 需要学习督导的用户:Agent主动提醒机制适合缺乏自律的学习者
常规风险
- API密钥泄露:Bearer Token存储于环境变量,需防止shell历史泄露
- 音频数据隐私:语音内容上传至第三方平台,敏感话题需谨慎
- 教学依赖风险:过度依赖AI引导可能削弱自主提问能力
- 网络稳定性:音频上传对连接质量敏感,弱网环境体验下降