Los flujos de trabajo permanecen atascados en el estado de ejecución debido a un bloqueo del pod de creación
En este artículo se explica cómo identificar y mitigar un interbloqueo del pod de autor en Adobe Experience Manager (AEM) as a Cloud Service cuando las instancias de flujo de trabajo permanecen atascadas en el estado En ejecución después del paso Iniciar.
Descripción description
Entorno
Adobe Experience Manager (AEM) as a Cloud Service
Problema/Síntomas
- Las instancias de flujo de trabajo completan el paso Start, pero permanecen en el estado Running indefinidamente.
- Los trabajos del flujo de trabajo no progresan porque el procesamiento relacionado con Sling Event Dispatcher y Oak observed en un pod de autores afectado está bloqueado.
- En los casos observados, no se ve ningún error de aplicación correspondiente en los registros mientras se produce el problema.
- Al reiniciar o reemplazar el pod de autor afectado, se restaura el flujo de trabajo y el procesamiento de trabajos.
- Las rutas de instancia de flujo de trabajo de ejemplo pueden parecerse a
/var/workflow/instances/<server>/<date>/<workflow-instance>.
Causa
Un interbloqueo que afecte a Sling Event Dispatcher y a Oak observed en un pod de autor puede impedir que se entreguen eventos de trabajo y flujo de trabajo, lo que deja las instancias de flujo de trabajo atascadas en el estado Ejecutando hasta que se reinicie o reemplace el pod afectado.
Resolución resolution
Para corregir los flujos de trabajo que permanecen atascados en el estado Running debido a un interbloqueo del pod de creación, pruebe esta solución:
- Compruebe que las instancias de flujo de trabajo afectadas permanecen en el estado En ejecución después del paso Iniciar y confirme que los trabajos relacionados no progresan.
- Determine si el comportamiento está aislado en un pod de autores específico comparando la actividad del flujo de trabajo entre instancias de autor y revisando los indicadores disponibles de evento bloqueado o procesamiento de observación.
- Recopile volcados de hilos del pod de creación afectado durante el incidente cuando sea posible, para poder validar la condición de interbloqueo.
- Reinicie o reemplace el pod de autor afectado para restaurar el flujo de trabajo y el procesamiento de trabajos.
- Después del reinicio, monitorice la ejecución del flujo de trabajo y la progresión del trabajo para confirmar que los elementos recién iniciados y anteriormente estancados comiencen a procesarse de nuevo.
recommendation-more-help
experience-cloud-kcs-help-kbarticles