站点的应用程序响应时间异常

Prev Next

本剧本描述了调查和解决影响站点的应用程序响应时间问题的步骤。

概览

应用程序响应时间测量站点与应用程序之间的首字节时间(TTFB)。 应用程序端性能下降、WAN连接问题、ISP问题、拥堵和站点本地网络问题都会导致响应时间增加。

在联系 Cato 支持之前,此剧本可帮助通过 Cato 管理应用程序 (CMA) 确定性能下降的源头。

验证应用程序响应时间

CMA 管理员可以使用以下方法验证某站点发生了应用程序响应时间异常。

使用事件深入分析

  1. 从导航菜单中,单击主页 > 事件仪表板。
  2. 在过滤栏中,添加一个过滤器设置到体验异常中的生产者名称。
  3. 添加过滤器指示是站点的应用程序响应时间异常。

01_App_Response_anomaly.png

  1. 验证是否生成了事件。

02_App_Response_anomaly.png

  1. 单击事件行以打开深入分析页面,查看包括时间线、受影响实体和应用程序在内的详细信息。

03_App_Response_anomaly.png

  1. 查看事件时间线以确定问题是持续的还是间歇性的。

过滤相关事件

在主页 > 事件页面上,应用以下过滤器:

  • 子类型是异常
  • 事件信息包含应用程序响应时间

04_App_Response_anomaly.png

验证在报告的时间范围内是否生成了异常事件。

故障排除步骤

审查应用程序性能

  1. 打开主页 > 体验监控页面。
  2. 为受影响的站点和应用程序过滤数据。
  3. 在事件时间范围内查看 首字节时间 (TTFB) 和 HTTP/S 错误率指标。
  4. 将 TTFB 趋势与事件时间线进行比较,以判断降级是否持续或间歇。

如果 HTTP/S 错误率随 TTFB 一同增加,确认应用程序提供商是否报告了服务降级或后端应用程序是否出现问题。

如果只提升了 TTFB,而 HTTP/S 错误率保持稳定,说明应用程序响应速度比平时慢,但仍在处理请求。 对于自托管应用程序,请验证应用程序服务器和后端基础设施的健康状态。

如果多个站点在同一应用程序上的 TTFB 都增加,请确认应用程序提供商是否报告了广泛的服务降级。

查看站点指标

在体验监控页面上,查看事故时间范围内的以下站点指标:

  • 到 PoP 的丢包率
  • 到 PoP 的距离

将这些指标与 TTFB 时间线进行比较。

如果 到 PoP 的丢包率或 到 PoP 的距离随 TTFB 增加,调查站点的互联网连接或在问题持续时联系 ISP。

如果网络指标保持稳定,而 TTFB 增加,则降级可能与应用程序有关而非网络。

查看连接详细信息

查看连接详细信息小部件,检查以下项目的追踪路由结果:

  • 数据包丢失
  • 增加的延迟
  • 路由变更
  • 其他网络异常

如果丢包或延迟增加在流量到达 Cato PoP 之前被观察到,则调查站点本地网络或 ISP 连接。

如果到 PoP 的路径正常,而 TTFB 保持升高,则调查托管应用程序或确认 SaaS 提供商是否报告了服务降级。

如果到目前为止没有发现问题,请继续前往 Socket 站点性能问题排查 进行进一步的故障排除。

上传案例到 Cato 支持

如果跟随此剧本后仍未解决问题,请提交支持工单。 为了帮助 Cato 支持有效调查问题,包含您执行的故障排除步骤的结果。