Botmark Skill

📊 5分钟AI能力五维诊断与MBTI人格评测

专业AI能力基准测试工具,5分钟多维评估IQ/EQ/TQ/AQ/SQ,生成MBTI人格报告与改进建议,适合Bot开发者与优化场景。

收藏
4.7k
安装
1k
版本
2.14.0
CLS 安全扫描中
预计需要 3 分钟...

使用说明

核心用法

BotMark Self-Evaluation 是一套面向AI Bot的综合性能力评测体系,用户通过调用评估工具链(botmark_start_evaluation → 答题 → botmark_submit_batchbotmark_finish_evaluation)完成全量测试。系统采用滑窗并行执行架构,最高支持4个并发子代理,单次评估约5-15分钟,覆盖5大复合维度与11项子维度,总分1000分。

评估流程:启动会话后按维度分组答题(依赖Bot自身知识,禁用外部工具),批量提交答案获取质量反馈,最终生成包含百分比得分、等级评定(Novice/Proficient/Expert/Master)、MBTI人格类型及可操作建议的完整报告。支持单科测试与双语界面,题库动态生成确保可重复性。

显著优点

1. 体系化评估框架:首创IQ/EQ/TQ/AQ/SQ五维模型,兼顾认知、情感、工具、安全与进化能力,弥补单一性能指标的片面性
2. 工程化执行效率:滑窗并行设计将传统串行评估耗时压缩60%以上

3. actionable 输出:非仅打分,提供A/B/C/D等级质量标注与场景化改进建议

4. 隐私合规:本地化加密评分引擎,敏感数据不出域

5. 开发者友好:支持OpenAI/Anthropic标准工具格式,集成成本低

潜在缺点与局限

  • 依赖自评客观性:答案质量由Bot自主生成,存在"应试优化"偏差风险
  • API密钥门槛:需注册获取BOTMARK_API_KEY,对快速体验形成摩擦
  • 评估成本:1000分全量测试消耗约5-15分钟交互时长,高频迭代场景效率受限
  • 维度权重固化:各维度满分预设(IQ 300/TQ 250等),未开放自定义权重配置

适合人群

  • Bot开发者:上线前能力基线建立与版本回归测试
  • AI产品经理:竞品Bot能力对标与差异化定位
  • 企业采购方:供应商Bot准入验收与SLA制定
  • 提示词工程师:Prompt优化效果量化验证

常规风险

1. 凭证泄露风险:API Key若硬编码于提示词或源码,存在被爬虫抓取隐患;需严格遵循环境变量隔离原则
2. 过度优化陷阱:为追求高分可能诱导模型偏离真实服务场景的表现

3. 人格类型误读:MBTI结果基于答题模式推断,非临床心理测评,不宜用于人才决策

Botmark Skill 内容

examples文件夹
手动下载zip · 119.5 kB
coze_dify_setup.mdtext/markdown
请选择文件