Identificación de antipatrones de programación de trabajo

IMPORTANT
Los horarios de trabajo están disponibles actualmente solamente para los siguientes trabajos de Real-Time CDP:
  • Ingesta de lago de datos por lotes
  • Ingesta de perfil por lotes
  • Segmentación por lotes
  • Activación de destino del lote

La vista de la cronología de Programaciones de trabajos le ayuda a identificar problemas comunes de configuración que pueden afectar negativamente el rendimiento y la confiabilidad de su canalización de datos. Estos antipatrones suelen provocar errores en los trabajos, incoherencias en los datos o un rendimiento del sistema degradado. Tres de los antipatrones más comunes se detectan automáticamente y aparecen a través de indicadores de advertencia en la interfaz. Si detecta estos patrones antes de tiempo, puede reconfigurar sus trabajos para evitar problemas antes de que afecten a sus operaciones comerciales.

Detectados automáticamente antipatrones auto-detection

Programaciones de trabajos detecta automáticamente tres indicadores de advertencia comunes antipatrones y superficies en las tarjetas de resumen relevantes. Seleccione un indicador de advertencia para abrir un panel de detalles con una descripción del problema, acciones recomendadas y una lista de conjuntos de datos o destinos afectados.

Antipatrón detectado automáticamente
Ubicación del indicador de advertencia
Más información
Límite diario de ingesta de perfil
Tarjeta ingesta de perfil
Límite diario de ingesta de perfiles
Ingesta de perfiles demasiado cerca de la segmentación
Tarjeta de segmentación
Densidad de trabajo programada
Segmentación demasiado cerca de la activación de destino programada
Tarjeta de activación de destino
Superposición de programación

Requisitos previos prerequisites

Antes de identificar los antipatrones, debe:

Referencia rápida anti-pattern-quick-reference

Antipatrón
Lo que va a ver
Impacto principal
Gravedad
Superposición de programación
Varios trabajos ejecutándose simultáneamente
Contención de recursos y errores de trabajos
Alto
Densidad de trabajo programada
Muchos conjuntos de datos con lotes agrupados en la misma hora
Cuellos de botella de canalización y segmentación incompleta
Alto
Límite diario de ingesta de perfiles
Indicador de advertencia en la tarjeta Resumen de ingesta de perfiles
Protección del sistema excedida
Alto
Lotes excesivos por conjunto de datos
Conjunto de datos único con decenas de lotes diarios
Complejidad operativa y de procesamiento ineficiente
Medio

Superposición de programación schedule-overlap-pattern

Gravedad de impacto: Alto | Problema principal: contención de recursos

Qué buscar: hay varios trabajos programados para ejecutarse al mismo tiempo o en sucesión, especialmente cuando se superponen trabajos que requieren muchos recursos.

Un ejemplo común son los trabajos de ingesta por lotes que se ejecutan al mismo tiempo que un trabajo de segmentación programado. Esto crea contención de recursos porque ambas operaciones requieren una potencia de procesamiento y una memoria significativas.

Por qué esto es problemático:

  • Contención de recursos: cuando se ejecutan simultáneamente varios trabajos que requieren muchos recursos, compiten por los recursos del sistema (CPU, memoria, E/S), lo que hace que todos los trabajos se ejecuten más lentamente.
  • Rendimiento impredecible: La duración del trabajo se vuelve incoherente, lo que dificulta la planificación de programaciones confiables.
  • Retrasos en cascada: Si los trabajos tardan más de lo esperado, pueden retrasar los trabajos dependientes posteriores, lo que crea un efecto de propagación en toda la canalización.
  • Mayor riesgo de error: el agotamiento de los recursos puede provocar que los trabajos agoten el tiempo de espera o fallen por completo.

Cómo solucionarlo:

  • Escalonar programaciones de trabajos: Asegúrese de que las operaciones de uso intensivo de recursos se ejecuten secuencialmente en lugar de simultáneamente.
  • Agregar tiempo de búfer: deje un espacio adecuado entre los trabajos para tener en cuenta las variaciones de procesamiento.
  • Revisar dependencias: identifique qué trabajos deben completarse para que otros puedan iniciarse de forma segura.

Cuando Programaciones de trabajos detecta que la segmentación se está ejecutando demasiado cerca de una activación de destino programada, aparece un indicador de advertencia en la tarjeta de resumen de Activación de destino. Seleccione el indicador de advertencia para abrir un panel que muestre el número de ocurrencias detectadas, una descripción del conflicto de tiempo, recomendaciones y una tabla de destinos afectados.

Segmentación demasiado cercana al panel de activación de destino programado en Programaciones de trabajos, que muestra una descripción del conflicto de temporización, recomendaciones y una tabla de destinos afectados. {modal="regular"}

Densidad de trabajo programada scheduled-density

Gravedad de impacto: Alto | Problema principal: Cuellos de botella en la canalización

Qué buscar: Demasiados conjuntos de datos con varios lotes programados dentro de la misma hora, especialmente cuando estos lotes se apilan y se programan cerca de ventanas de procesamiento críticas, como las horas de inicio de la segmentación.

Este patrón suele incluir:

  • Varios conjuntos de datos, cada uno con varios lotes al día
  • Trabajos de ETL (ingesta de lago de datos e ingesta de perfiles) agrupados dentro de la misma hora
  • Ingesta por lotes programada inmediatamente antes o durante las ventanas de segmentación programadas

Por qué esto es problemático:

  • Cuello de botella de canalización: cuando se apilan numerosos lotes de diferentes conjuntos de datos en un corto período de tiempo, se crea un cuello de botella de procesamiento que puede saturar la canalización de ingesta.
  • Disponibilidad de perfiles retrasada: Es posible que los trabajos de ingesta de perfiles que se ejecutan demasiado cerca de los tiempos de inicio de la segmentación no se completen a tiempo, lo que da como resultado evaluaciones de audiencia incompletas o antiguas.
  • Segmentación impredecible: Si los trabajos de ingesta ascendente siguen ejecutándose cuando comienza la segmentación, se arriesga a evaluar las audiencias con datos incompletos, lo que provoca la pertenencia a audiencias incorrectas.
  • Errores en cascada: Un solo lote retrasado en una programación apilada densamente puede causar un efecto dominó, retrasando todos los lotes subsiguientes y los procesos descendentes.
  • Deformación de recursos: Es posible que el sistema tenga problemas para asignar recursos suficientes al procesar demasiados trabajos de ingesta simultánea, lo que ralentiza los tiempos de procesamiento o produce errores.

Cómo solucionarlo:

  • Consolidar lotes: Reduzca la frecuencia de los lotes combinando varios lotes pequeños en menos lotes más grandes por conjunto de datos.
  • Distribuir de forma uniforme: Difunda los trabajos de ingesta durante todo el día en lugar de agruparlos en horarios específicos.
  • Agregar tiempo de búfer: Asegure un búfer mínimo de 1 a 2 horas entre la finalización de la ingesta de perfiles y el inicio de la segmentación.
  • Requisitos de revisión: Compruebe si todos los conjuntos de datos realmente necesitan varios lotes diarios. Muchos casos de uso funcionan con menos actualizaciones frecuentes.

Cuando Programaciones de trabajos detecta trabajos de ingesta de perfiles que se ejecutan demasiado cerca de una ejecución de segmentación programada, aparece un indicador de advertencia en la tarjeta de resumen Segmentación. Seleccione el indicador de advertencia para abrir un panel que muestre el número de ocurrencias detectadas, una descripción del conflicto de tiempo, recomendaciones y una tabla de conjuntos de datos afectados.

La ingesta de perfiles demasiado cerca del panel de segmentación en Programaciones de trabajos, muestra una línea vertical azul que marca el tiempo de ejecución de la segmentación, una descripción del conflicto de sincronización, recomendaciones y una tabla de conjuntos de datos afectados. {modal="regular"}

Límite diario de ingesta de perfil profile-ingestion-daily-limit

Gravedad de impacto: Alto | Problema principal: Protección del sistema

Qué buscar: Un indicador de advertencia en la tarjeta de resumen de Ingesta de perfiles cuando la ingesta diaria de perfiles se ejecuta una vez que se aproxima o supera la protección del sistema de 90 ejecuciones. Seleccione el indicador de advertencia para ver un gráfico de barras que muestre el recuento de ejecuciones diarias para cada día en el período de tiempo seleccionado.

El gráfico utiliza barras con códigos de color para indicar dónde se encuentran los recuentos en relación con el límite:

  • Barras rojas (90 o más ejecuciones): Se ha superado el límite diario. Las ineficiencias de procesamiento pueden afectar a todos los conjuntos de datos con perfil habilitado.
  • Barras naranjas (de 72 a 89 ejecuciones): Se acerca al límite diario.
  • Barras verdes (por debajo de 72 ejecuciones): Dentro del intervalo aceptable.

El gráfico Número diario de ejecuciones de ingesta de perfiles en Programaciones de trabajos muestra recuentos diarios de ejecuciones codificados por colores como barras rojas que superaron el límite diario de 90 ejecuciones, barras anaranjadas en la zona de advertencia entre 72 y 89 ejecuciones y una barra verde dentro del intervalo aceptable. {modal="regular"}

Por qué esto es problemático:

  • Ineficiencia de procesamiento: Si se superan las 90 ejecuciones de ingesta de perfiles por día, se crea una sobrecarga de procesamiento que puede afectar a todos los conjuntos de datos habilitados para perfiles.
  • Contención de recursos: un recuento total de ejecución alto puede retrasar los trabajos de activación y segmentación descendente.
  • Incapacidad de los datos: Cuando el procesamiento de perfiles se ejecuta continuamente, los lotes individuales pueden tardar más en completarse, lo que retrasa la disponibilidad de los datos para la segmentación.

Cómo solucionarlo:

  • Reduzca la frecuencia de lotes por conjunto de datos: consolide los lotes para que se activen menos ejecuciones de ingesta de perfiles cada día. Consulte Lotes excesivos por conjunto de datos para obtener instrucciones detalladas.
  • Auditar todas las programaciones de ingesta: revise todos los conjuntos de datos programados para la ingesta de perfiles e identifique los que tengan una frecuencia de lotes innecesariamente alta.

Lotes excesivos por conjunto de datos excessive-batches-per-dataset

Gravedad de impacto: Medium | Problema principal: Procesamiento ineficiente

Qué buscar: Un solo conjunto de datos con un número excesivo de trabajos por lotes individuales programados a lo largo del día, que crea una larga pila vertical de trabajos en la cronología.

Este patrón implica un único conjunto de datos con muchos trabajos de ingesta por lotes individuales programados a intervalos frecuentes, a veces decenas de lotes por día.

Por qué esto es problemático:

  • Procesamiento ineficiente: Cada trabajo por lotes tiene costos generales (inicialización, validación, actualizaciones de metadatos). Procesar muchos lotes pequeños es significativamente menos eficiente que procesar menos lotes más grandes.
  • Mayor superficie de error: más trabajos significan más oportunidades de error. Cada lote que falla requiere investigación y posible reprocesamiento.
  • Carga innecesaria del sistema: los lotes pequeños y frecuentes mantienen al sistema constantemente ocupado con tareas de sobrecarga en lugar del procesamiento de datos real, lo que reduce el rendimiento general.
  • Disponibilidad de datos retrasada: Paradójicamente, la ejecución de muchos lotes pequeños puede retrasarse cuando los datos están disponibles para procesos descendentes en comparación con los lotes consolidados.
  • Inspección difícil: el seguimiento del éxito y el rendimiento de docenas de trabajos por lotes individuales por conjunto de datos se vuelve complejo desde el punto de vista operativo y lleva mucho tiempo.
  • Intervalo de procesamiento de perfil: Cada lote de ingesta de perfil déclencheur el procesamiento de perfiles. Los pequeños lotes frecuentes pueden hacer que el procesamiento de perfiles se ejecute casi continuamente, lo que impide una optimización eficiente de los lotes.

Cómo solucionarlo:

  • Reducir la frecuencia de lotes: consolide a menos lotes por día por conjunto de datos para la mayoría de los casos de uso.
  • Aumentar tamaño del lote: acumule más datos antes de activar la ingesta en lugar de ingerirlos inmediatamente.
  • Alinear con las necesidades de la empresa: compruebe si las actualizaciones por hora son realmente necesarias o si son suficientes las actualizaciones diarias o bidiarias.
  • Usar streaming para tiempo real: cambia a la ingesta de streaming para los requisitos en tiempo real originales en lugar de simularla con lotes frecuentes.
  • Supervisar el total de ejecuciones diarias: Si varios conjuntos de datos tienen una frecuencia de lotes alta, el total combinado puede superar la protección del sistema. Consulte Límite diario de ingesta de perfiles.

Próximos pasos next-steps

Después de identificar los antipatrones en sus horarios de trabajo:

recommendation-more-help
experience-platform-help-run-and-operate