核心用法
GLM Master Skill 是一个纯文档型导航技能,本身不提供模型能力,而是作为 GLM 生态系统的官方入口索引。它将 GLM 官方技能按功能领域划分为三大板块:
- GLM-OCR 系列:通用 OCR(
glmocr)、表格提取(glmocr-table)、公式识别(glmocr-formula)、手写识别(glmocr-handwriting) - GLM-Image 系列:文生图(
glm-image-gen) - GLM-V 系列:图像/视频/文件描述(
glmv-caption)、视觉提示生成(glmv-prompt-gen)、简历筛选(glmv-resume-screen)
当用户提出具体需求时,Agent 需按以下流程操作:
1. 将用户意图映射到对应技能
2. 优先推荐 npx clawhub@latest install <skill-name> 安装
3. 如遇速率限制,引导用户等待或切换 GitHub 源
4. 打开目标技能的官方 SKILL.md 按指引配置
显著优点
- 官方权威性:所有链接指向
zai-org官方仓库,技能来源可信 - 零代码风险:刻意避免
subprocess和本地脚本执行,通过技能市场审核更顺畅 - 一站式导航:整合 OCR、图像生成、多模态理解等 9+ 个官方技能,降低用户搜索成本
- 安装降级路径:Clawhub 速率限制时提供 GitHub 源安装备选方案
- API 配置统一:明确共享
ZHIPU_API_KEY环境变量配置,避免重复说明
潜在局限
- 无实际执行能力:仅为"目录说明书",用户必须额外安装具体技能才能使用 GLM 能力
- 依赖外部安装:若 Clawhub 和 GitHub 均不可达,用户无法获取技能
- 版本同步延迟:文档内链接需人工维护,可能与实际仓库结构产生偏差
- 无交互式诊断:无法自动检测用户环境是否满足某个技能的运行要求
适合人群
- 初次接触 GLM 生态、需要了解官方技能全貌的开发者
- 在受限制环境中寻求"安全可过审"技能方案的技术团队
- 希望统一管理 Zhipu AI API Key 配置的多技能用户
常规风险
- 社交工程风险:文档中包含外部链接(GitHub、bigmodel.cn),需防范钓鱼替换
- API Key 泄露:用户需自行配置
ZHIPU_API_KEY,不当存储(如硬编码)会导致密钥暴露 - 依赖链风险:实际功能依赖下游技能的质量与维护状态,Master Skill 本身不做代码审查