Phase 24.2A · Site crawl workspace
网站抓取工作台
所有数据来自后端 /api/p24/* 真实接口;任何安全开关被关闭时,按钮自动禁用,API 也会同步拒绝。URL: /admin/sites-crawl?website_id=,先在 网站列表 选一个网站再打开。
正在读取抓取配置和最近一次 Run…
无法读取工作台数据。
需要 platform_super_admin 角色才能查看此工作台。
请先选择一个网站:网站列表
1. 扫描状态
暂无 Run。
- Run ID
- —
- 状态
- —
- 进度
- —
- 已发现 / 已抓取 / 失败 / 跳过
- —
- 下载字节
- —
- 执行时间
- —
2. 抓取配置(生效值)
- 最大页面
- —
- 最大 body 字节
- —
- obey_robots
- —
- tenant 配额
- —
- kill switch
- —
- SITE_CRAWL_ENABLED
- —
3. 操作
只有 super_admin 可以发 manual_override。所有按钮按当前 policy 自动启用/禁用。
4. 页面库存(最近 50)
| URL | 状态 | indexable | type | title | canonical | depth | entity |
|---|---|---|---|---|---|---|---|
| 暂无数据 | |||||||
5. 技术问题(open + acknowledged)
| severity | rule_code | 页面 | evidence | 状态 | 操作 |
|---|---|---|---|---|---|
| 暂无数据 | |||||
6. Diff(最近一次)
暂无 diff。运行两次以上的 Run 后将自动出现。
- 新增页面
- —
- 删除页面
- —
- Metadata 变化
- —
- 正文变化
- —
- 新问题
- —
- 已解决问题
- —
7. robots / sitemap
- robots 状态
- —
- sitemap 数量
- —
- sitemap URLs
- —
- blocked URLs
- —