核心用法
agentic-codex-dev 是一个纯文本审查技能,专为代理式(agentic)软件开发工作流设计。它不提供代码执行或远程操作能力,而是作为一层保守的审查机制,帮助用户将开发请求、代码差异、仓库记录或发布清单转化为结构化的范围规划和发布就绪评估。
典型使用场景包括:
- 范围界定交付计划(scoped delivery planning)
- 实施审查(implementation review)
- 公开接口检查(public-surface checks)
- 发布证据审查(release evidence review)
工作流程
1. 重述目标:明确请求的成果和最小安全范围
2. 识别影响面:定位受影响文件、公开接口、测试门控、发布门控及用户可见行为
3. 分离工作类型:区分实施工作、验证工作和发布工作
4. 安全措辞审查:检查面向客户的文案是否暴露私有操作、本地路径、凭证、内部注释或未批准的账户行为
5. 发布步骤评估:审查是否请求了发布或发布步骤,但不执行
6. 返回裁决:ready、ready_with_notes、blocked 或 do_not_ship
输出结构
Scope:审查对象Findings:按严重程度排序的具体问题Public surface:措辞或打包风险Verification:发布前应通过的测试或检查Verdict:四级裁决之一
显著优点
- 零执行风险:明确禁止所有远程变更命令(stage/commit/push/publish/delete/hide/transfer),从设计上消除误操作
- 保守安全立场:默认假设无 GitHub/ClawHub/浏览器登录权限,不推断凭证
- 隐私保护导向:主动扫描暴露敏感信息的客户文案
- 结构化输出:五级分类(Scope/Findings/Public surface/Verification/Verdict)便于决策追溯
- 无持久化副作用:除非用户单独请求文件产物,否则不创建项目记忆、分类账或报告
潜在局限
- 纯文本限制:无法自动获取仓库实际状态、运行测试或验证 CI 结果,依赖用户提供的信息完整性
- 裁决非最终:
ready类裁决基于审查时的输入快照,不保证后续变更的兼容性 - 无自动修复:识别问题后需人工介入,不提供补丁建议或自动修正
- 范围界定依赖用户:"最小安全范围"的判定需要用户对业务上下文有清晰认知
- 不覆盖运行时安全:专注静态审查,不涉及运行时的依赖漏洞或供应链攻击
适合人群
- 负责 Codex/GitHub/ClawHub 工作流发布的技术产品经理
- 需要预发布检查清单的开发者自治团队
- 在高合规环境(金融、医疗 SaaS)中需要留痕审查的 DevOps 工程师
- 使用代理式开发工具链但需人工门控的安全审查员
常规风险
- 输入污染风险:若用户提供的 diff 或仓库记录不完整,审查结论可能产生虚假安全感
- 裁决误用风险:
ready_with_notes与ready的边界模糊,可能被急于发布的团队选择性解读 - 技能边界模糊:用户可能误解 "review" 含义,期望获得自动修复而非评估报告
- 凭证推断压力:虽然明令禁止,但复杂场景下用户可能施压要求 "合理推断" 权限状态
安全等级说明
本技能主动设计为只读审查层,其安全价值体现在 "不做什么" 的边界约束上,而非传统意义上的漏洞防护。因此评为 S 级——在正确使用场景下风险可控,但需配套人工复核流程。