使用Adobe Commerce上的New Relic排除性能故障

在Adobe Commerce on cloud infrastructure中,使用New Relic解决性能问题。 本文还提供了有关进一步信息的资源,并涵盖了Apdex得分低、CPU使用率高、I/O操作高以及中断等问题。 要修复此问题,请按照疑难解答步骤以及针对相关问题的推荐资源执行操作。

描述 description

环境

云基础架构上的Adobe Commerce。

问题/症状

  • Apdex得分很低。 您的New Relic Apdex得分用于衡量用户对Web应用程序和服务的响应时间的满意度。 Apdex得分低于0.5分即属调查。
  • CPU使用率较高。 CPU使用率高表示服务特别忙,如MySQL或Redis。
  • 高I/O操作。 I/O操作因客户而异,与平均值的差别很大。 与以前的平均I/O操作相比,需要寻找不寻常的峰值。
  • 中断。 New Relic按Apdex确定服务中断。 当Apdex小于0.4时(被视为中断),Apdex得分图上会出现一条红线。

解决方法 resolution

请按照以下步骤使用New Relic排查性能问题:

问题
故障排除
资源
Apdex得分低:

您的New Relic Apdex得分衡量用户对Web应用程序和服务的响应时间的满意度。

登录到New Relic > APM >概述。 在“概述”页面的右侧,您会看到Apdex得分图。 Apdex分数为0.5或更低是问题所在,需要调查。

Web事务时间(服务器请求):

  1. 登录到New Relic > APM >选择应用程序>概述。 在主图表下拉过滤器中,将过滤器设置为Web事务时间。 在“事务”表格中,查找应用服务器时间。 检查长期运行或可疑的交易。

  2. 通过转到监控>事务逐个调查事务。 将过滤器设置为Web和最耗时。

  3. 搜索占用资源的第三方模块,如支付提供商和ERP系统。

  4. 在APM的“监视”部分中:

    1. 单击“事务”。
    2. 向下滚动,然后单击显示所有事务表。
    3. 各种参数对事务进行排序,并检查看起来可疑的事务。
    4. 查看Apdex得分低、Count或Avg时间异常高或Dissat %的事务。
    5. 单击每个事务处理。 如果无法解决此问题,请提交支持票证
    6. 如果需要进一步调查,请检查非Web事务。

非Web事务时间(操作和后台任务):

  1. 登录到New Relic > APM >选择应用程序>概述。 在主图形下拉过滤器中选择非Web事务时间。 单击“事务处理”表中的单个事务处理。 查找长期运行或可疑的交易。 这包括后端作业、cron作业、导入和导出作业以及第三方作业。
要了解有关New Relic Apdex得分的更多信息,请参阅New Relic文档> APM Apdex >衡量用户满意度。 另请参阅Adobe Commerce支持知识库中的Managed alerts for Adobe Commerce: Apdex warning alert
CPU使用率较高:

CPU使用率较高表示服务特别繁忙,如MySQL或Redis。
  1. 登录到New Relic >基础架构>进程。
  2. 查看CPU图形以识别占用超过100% CPU时间的停滞或高耗时的进程,并将其与实例上的处理器计数进行比较。 请注意资源利用率的高峰。 除非进程卡住,否则不要将其终止。
要了解有关性能量度(尤其是CPU百分比、I/O字节数和单个进程或进程组的内存使用率)的更多信息,请参阅New Relic文档>基础架构UI页面>基础架构主机页面>进程选项卡
高I/O操作:对于每个客户,此数字是单独的,与平均值有很大不同。

与以前的平均I/O操作相比,查找不寻常的尖峰:

  1. 登录到New Relic >基础架构>进程。
  2. 查看每秒I/O读取字节数图表。
  3. 记录尖峰的时间。
  4. 单击“APM”。
  5. 在主图形下拉过滤器中选择Web事务时间。
  6. 将时间设置为记录的尖峰的时间。
  7. 搜索导致高I/O操作的事务。
  8. 深入到每个交易跟踪>跟踪详细信息以确定导致问题的原因。
服务中断:New Relic按Apdex确定服务中断。 当Apdex为< 0.4(被视为中断)时,Apdex得分图上会出现一条红线。

调查中断需要执行几个步骤,包括检查Web和非Web事务、数据库和第三方事务。

Web事务:

  1. 登录到New Relic > APM >概述。 在下拉图形过滤器中将过滤器设置为Web事务时间。
  2. 手动缩小时间范围。
  3. 单击“事务”。 将过滤器设置为Web和最耗时。 调查运行时间最长的事务处理。
  4. 如果需要进一步调查,请检查非Web事务。

非Web事务:

  1. 返回概述页面,然后在下拉筛选器中切换到非Web事务。
  2. 逐一查看页面底部的事务跟踪。
  3. 根据问题,使用第三方工具(如PHP探查器)查找瓶颈。
  4. 如果需要进一步调查,请检查数据库进程。

数据库进程:

  1. 在“APM”页上,转到“监视>数据库”。

  2. 按最耗时的内容排序。

  3. 查看热门查询。

    注意: 更新插入 查询是使用CPU最多的查询。

  4. 从排序依据选择器切换到吞吐量,并查找导致数据库吞吐量下降的进程。

  5. 如果您需要进一步调查,请检查第三方服务。

第三方服务:

  1. 在APM页面上,转到监视>外部服务。
  2. 从排序方式下拉列表中选择最慢的平均响应时间。
  3. 查找就在停机之前发生的流程。
要了解有关调查特定性能问题的更多信息,请参阅New Relic文档> APM UI页面>事务页面>使用向下钻取函数
recommendation-more-help
experience-cloud-kcs-help-kbarticles