Los flujos de trabajo permanecen atascados en el estado de ejecución debido a un bloqueo del pod de creación

En este artículo se explica cómo identificar y mitigar un interbloqueo del pod de autor en Adobe Experience Manager (AEM) as a Cloud Service cuando las instancias de flujo de trabajo permanecen atascadas en el estado En ejecución después del paso Iniciar.

Descripción description

Entorno

Adobe Experience Manager (AEM) as a Cloud Service

Problema/Síntomas

  • Las instancias de flujo de trabajo completan el paso Start, pero permanecen en el estado Running indefinidamente.
  • Los trabajos del flujo de trabajo no progresan porque el procesamiento relacionado con Sling Event Dispatcher y Oak observed en un pod de autores afectado está bloqueado.
  • En los casos observados, no se ve ningún error de aplicación correspondiente en los registros mientras se produce el problema.
  • Al reiniciar o reemplazar el pod de autor afectado, se restaura el flujo de trabajo y el procesamiento de trabajos.
  • Las rutas de instancia de flujo de trabajo de ejemplo pueden parecerse a /var/workflow/instances/<server>/<date>/<workflow-instance>.

Causa

Un interbloqueo que afecte a Sling Event Dispatcher y a Oak observed en un pod de autor puede impedir que se entreguen eventos de trabajo y flujo de trabajo, lo que deja las instancias de flujo de trabajo atascadas en el estado Ejecutando hasta que se reinicie o reemplace el pod afectado.

Resolución resolution

Para corregir los flujos de trabajo que permanecen atascados en el estado Running debido a un interbloqueo del pod de creación, pruebe esta solución:

  1. Compruebe que las instancias de flujo de trabajo afectadas permanecen en el estado En ejecución después del paso Iniciar y confirme que los trabajos relacionados no progresan.
  2. Determine si el comportamiento está aislado en un pod de autores específico comparando la actividad del flujo de trabajo entre instancias de autor y revisando los indicadores disponibles de evento bloqueado o procesamiento de observación.
  3. Recopile volcados de hilos del pod de creación afectado durante el incidente cuando sea posible, para poder validar la condición de interbloqueo.
  4. Reinicie o reemplace el pod de autor afectado para restaurar el flujo de trabajo y el procesamiento de trabajos.
  5. Después del reinicio, monitorice la ejecución del flujo de trabajo y la progresión del trabajo para confirmar que los elementos recién iniciados y anteriormente estancados comiencen a procesarse de nuevo.
recommendation-more-help
experience-cloud-kcs-help-kbarticles