核心用法
audit-website 是一款面向AI Agent的网站审计技能,通过调用 squirrelscan CLI 对目标网站执行深度扫描。其核心工作流为三步:
1. Crawl(爬取):模拟浏览器和搜索引擎爬虫,发现并抓取页面
2. Analyze(分析):基于230+条规则对页面进行多维度检测
3. Report(报告):生成LLM优化的结构化报告,包含健康评分、问题分类、修复建议
支持三种覆盖模式:
- Quick:25页,仅种子页面+站点地图,适合CI快速检查
- Surface(默认):100页,智能URL模式采样,平衡效率与覆盖
- Full:500页,深度全量爬取,适合上线前全面审查
推荐输出格式为 --format llm,专为AI处理优化,比标准XML节省40% token。
显著优点
- 规则全面:21个类别、230+条检测规则,涵盖SEO技术、内容质量、性能、安全、无障碍、E-E-A-T、法律合规等
- 智能采样:Surface模式自动识别URL模式(如
/blog/{slug}),避免重复爬取相似页面 - AI原生优化:LLM格式输出直接支持自动化修复决策,减少人工解析
- 增量审计:支持
--diff和--regression-since对比历史基线,精准定位回归问题 - 并行修复:识别可并行处理的内容问题(alt文本、标题层级等),支持子代理批量执行
- 评分体系:0-100健康评分+1-10严重等级,量化改进效果
潜在局限
- 依赖外部CLI:需本地安装 squirrel 二进制文件,跨平台配置存在门槛
- 外部链接检测可能慢:大量外链可用性检查可能拖慢整体审计速度
- 内容判断依赖人工:断链修复、结构性变更等需人工确认,无法全自动决策
- 无实时预览:修复建议需应用到代码后才能验证效果,缺少即时视觉反馈
- 定价与许可未明:文档未披露商业授权模式,大规模CI使用可能存在成本顾虑
适合人群
- 网站开发者/DevOps:CI/CD集成,自动化质量门禁
- SEO专员:技术SEO诊断、排名问题排查
- 内容运营团队:批量内容质量审计(标题、描述、图片alt等)
- 产品经理:上线前合规检查、性能基线建立
- AI Agent开发者:构建自动化网站优化工作流
常规风险
| 风险类别 | 说明 | 缓解措施 |
|---------|------|---------|
| **性能影响** | Full模式深度爬取可能给目标站点造成负载 | 避开高峰时段,使用 `--max-pages` 限制 |
| **误报修复** | AI批量修复可能引入内容错误 | 关键变更人工审核,修复后重新审计验证 |
| **缓存失效** | `--refresh` 强制刷新可能遗漏间歇性问题 | 建立定期审计 schedule,结合 diff 模式监控 |
| **敏感数据暴露** | 安全规则可能检测出泄露的密钥/密码 | 确保报告存储安全,审计前确认测试环境隔离 |
| **外部依赖** | squirrel CLI 版本迭代可能破坏兼容性 | 锁定版本,关注官方更新日志 |
最佳实践建议
1. 迭代式修复:表面扫描→修复→深度扫描→精细调优,避免一次性大范围改动
2. 目标分数管理:起始<50分目标75+,50-70分目标85+,>85分追求95+(Grade A)
3. 并行化策略:内容类修复(alt文本、描述、标题层级)适合子代理并行,代码级元数据修复建议串行
4. 持续监控:结合 --diff 建立回归检测机制,将审计集成到部署流水线