爬虫请求统计数据,基于 User-Agent 识别
* 蜘蛛识别基于常见爬虫 User-Agent 规则匹配,部分非标准爬虫可能未被识别。统计仅记录匹配到的爬虫请求,不影响站点正常访问性能。
* 客户端识别基于浏览器 User-Agent 字符串解析,区分 PC/移动端及主流浏览器。统计过程消耗少量 CPU 资源。
HTTP 请求方式统计(GET / POST / HEAD 等)
* 统计来源于 Nginx 日志中的请求方法字段。覆盖 GET / POST / HEAD / PUT / DELETE / OPTIONS 等标准 HTTP 方法。
| # | IP | 归属地 | 运营商 | 请求数 | 流量 | 流量占比图 |
|---|
| 请先选择站点 |
* IP 归属地数据来自离线 GeoIP 库,精确度约 95%。开启全局 IP 统计会略微增加日志解析耗时,建议在访问高峰期谨慎使用。如需关闭,请点击右上角开关。
* URI 流量统计需要解析每条访问日志的请求路径和响应大小,高流量站点建议按需开启。统计精度受日志格式影响,自定义日志格式可能需要调整解析规则。
状态码筛选
* 4xx 状态码表示客户端请求错误,5xx 表示服务端处理异常。错误统计有助于排查站点问题。仅记录状态码 >= 400 的请求。
请先选择站点
* 日志来自 Nginx 访问日志文件,默认保留最近 30 天。日志文件过大时读取可能较慢,建议定期清理过期日志。