Scegliere la giusta funzionalità di gestione del ciclo di vita dei dati
Scopri come gestire la durata della conservazione dei dati in Adobe Experience Platform in base ai requisiti operativi, di conservazione e di storage. Questa guida descrive le opzioni di conservazione ed eliminazione disponibili e consente di determinare quale di queste opzioni si adatta al tuo obiettivo e quando utilizzarle, in base alle tue esigenze. Per istruzioni dettagliate, segui i collegamenti di implementazione in ciascuna sezione.
Questa guida è destinata agli amministratori e agli sviluppatori che gestiscono volumi di dati, conservazione e autorizzazioni in Experience Platform. Si presuppone che tu abbia familiarità con i concetti di base di Experience Platform, inclusi set di dati, identità, profili e sandbox. Nelle pagine dell’interfaccia utente e dell’API collegate sono descritte la disponibilità e le autorizzazioni necessarie per ogni azione.
Perché gestire il ciclo di vita dei dati why-manage
Adobe Experience Platform acquisisce i dati in modo continuo e la quantità di dati memorizzati aumenta nel tempo. La gestione del ciclo di vita dei dati mantiene tali dati allineati con i casi d’uso attivi, in modo da mantenere ciò che continua a fornire valore e rimuovere ciò che non fa più. Una strategia di conservazione dei dati ben definita consente inoltre di soddisfare i requisiti di conservazione dei dati dell’organizzazione e di mantenere i volumi di dati all’interno dei diritti di licenza.
Quando i dati si accumulano oltre quanto richiesto dai casi di utilizzo, si corrono diversi rischi:
- Rilevanza ridotta: la conservazione dei segnali oltre il periodo in cui rimangono utili può ridurre la rilevanza e l’attuabilità della segmentazione, dell’attivazione e della personalizzazione.
- Pressione sui costi: l’aumento dei volumi di dati può spingerti verso o oltre i diritti di licenza, con conseguenti interruzioni.
- Prestazioni danneggiate: l’eccesso di dati aumenta il carico del sistema e può rallentare l’elaborazione.
- Esposizione alla privacy: La conservazione dei dati più a lungo di quanto sia utile aumenta i rischi per la privacy e l’esposizione alle normative.
Per evitare questi risultati, Adobe consiglia di conservare i dati solo se supporta un caso d’uso attivo. Applica lo stesso principio all’acquisizione utilizzando filtri di acquisizione per inserire solo i dati richiesti dai tuoi casi d’uso. I dati comportamentali, come i dati evento, consumano in genere molto più storage rispetto ai dati di record, pertanto i dati comportamentali non gestiti di solito hanno il maggiore impatto sulla crescita dello storage. I profili pseudonimi possono anche accumularsi nel tempo e aumentare il numero di profili; pertanto, è consigliabile utilizzare la scadenza dei dati del profilo pseudonimo per rimuovere i profili pseudonimi inattivi quando non sono più necessari.
Tutti i dati acquisiti vengono conservati in Experience Platform e una parte chiave della gestione del ciclo di vita dei dati è la corrispondenza dei dati al flusso di lavoro che servono. Experience Platform memorizza i dati in due archivi destinati a scopi diversi:
Un set di dati può supportare flussi di lavoro analitici, flussi di lavoro di coinvolgimento o entrambi. Quando i dati di Experience Event sono disponibili sia nell’archivio Profili che nel data lake, ogni archivio ha i propri criteri di conservazione. La scadenza dei dati da un archivio non rimuove automaticamente gli stessi dati dall’altro. Conserva i dati solo per il tempo necessario ai flussi di lavoro che li utilizzano e assicurati che siano configurati i criteri di conservazione appropriati per entrambi gli archivi.
Per informazioni sul tracciamento e sulla gestione dei diritti di licenza, consulta Best practice per i diritti di licenza di gestione dati.
Scegli la funzionalità giusta choose-a-capability
L’obiettivo di gestione dei dati determina l’opzione di conservazione o eliminazione da utilizzare. La tabella seguente mappa gli obiettivi comuni, incluse le richieste di privacy o di eliminazione previste dalle normative, in base all’opzione appropriata. Le sezioni seguenti descrivono ogni opzione di conservazione ed eliminazione.
Tra le opzioni di Advanced Data Lifecycle Management, l’eliminazione dei record e la scadenza dei set di dati sono mirate e rappresentano azioni una tantum che vengono inviate quando necessario. La scadenza degli eventi esperienza rimuove automaticamente i vecchi eventi esperienza dall’archivio profili, mentre la scadenza dei dati del profilo pseudonimo rimuove continuamente i profili sconosciuti inattivi. Un criterio di conservazione del data lake applica la scadenza a livello di riga ai set di dati ExperienceEvent nel data lake. Se l’obiettivo richiede più di un’opzione, ad esempio la rimozione di record specifici e la riduzione della crescita degli eventi in corso, combinarli come descritto in Pianificare la strategia di conservazione.
Eliminazione record record-delete
Se devi rimuovere i record associati a un’identità primaria per scopi operativi, ad esempio la pulizia o la minimizzazione dei dati, utilizza l’eliminazione dei record. Rimuove singoli record da Experience Platform in base alla loro identità principale. Per impostazione predefinita, l’eliminazione dei record influisce sul data lake, sul servizio Identity e sul profilo cliente in tempo reale. L’eliminazione del record non è uno strumento di conformità. Per le richieste di diritti dell’interessato o dei consumatori, utilizza invece Adobe Experience Platform Privacy Service.
L’eliminazione dei record agisce sull’identità primaria utilizzata dal servizio di destinazione. Prima di utilizzarla, tieni presente le seguenti limitazioni:
- Viene trovata una corrispondenza solo per l’identità primaria e vengono eliminati tutti i record corrispondenti all’identità primaria. I record non possono essere oggetto di targeting da identità secondarie.
- I record senza un’identità primaria compilata vengono ignorati.
- I dati acquisiti prima che l’identità primaria fosse configurata nello schema del set di dati non possono essere eliminati in questo modo.
- Un set di dati con una scadenza pianificata o in corso non può ricevere una richiesta di eliminazione del record. Annullare la scadenza pianificata o attendere il completamento della scadenza prima di inviare la richiesta di eliminazione del record.
- Per i set di dati con schema relazionale sincronizzati con un sistema di origine esterno tramite Data Mirror, i record eliminati possono essere riacquisiti se esistono ancora nel sistema di origine. Aggiorna l’origine come parte del flusso di lavoro di eliminazione. Consulta le considerazioni su Data Mirror e schema relazionale.
A seconda della configurazione dell’organizzazione, è possibile eliminare record da un singolo set di dati o da tutti i set di dati.
Dopo aver inviato una richiesta, Experience Platform la inserisce in batch prima dell’elaborazione. L’elaborazione viene completata all’interno di service level agreement (SLA) per la licenza. Per informazioni sulle fasi di elaborazione e sulla durata di ciascuna, vedere Timeline di elaborazione del ciclo di vita dei dati. Le richieste di cancellazione dei record sono inoltre soggette ai limiti di invio giornalieri e mensili degli identificatori. Per i limiti correnti, vedere quote di invio identificatore.
Puoi creare richieste di eliminazione dei record nell’area di lavoro Ciclo di vita dei dati o con l’API. Consulta Creare una richiesta di eliminazione record per il flusso di lavoro dell’interfaccia utente e la guida dell’endpoint dell’ordine di lavoro per l’API.
Scadenza set di dati dataset-expiration
Quando devi smobilizzare un intero set di dati che non è più necessario per i casi d’uso, scade il set di dati. Il set di dati viene pianificato per l’eliminazione in una data selezionata ed è possibile modificare o annullare la scadenza programmata in qualsiasi momento prima dell’inizio del processo di scadenza. Quando il set di dati raggiunge la data di scadenza, il data lake, Identity Service e Real-Time Customer Profile iniziano a rimuovere i contenuti del set di dati e la scadenza viene completata al termine di tutti e tre i servizi.
Puoi avere solo un numero limitato di scadenze dei set di dati pianificate in sospeso alla volta. Il limite dipende dal tuo prodotto e da qualsiasi diritto Shield. Per il limite corrente, vedere limiti di scadenza in sospeso. Advanced Data Lifecycle Management non supporta l’eliminazione di set di dati in batch.
Puoi pianificare le scadenze dei set di dati nell’area di lavoro Ciclo di vita dati o con l’API. Consulta Pianificare una scadenza del set di dati per il flusso di lavoro dell’interfaccia utente e la guida dell’endpoint di scadenza del set di dati per l’API.
Conservazione e scadenza automatiche automatic-expiration
Se desideri tagliare automaticamente i dati non aggiornati dall’archivio profili o dal data lake nel tempo, utilizza Scadenza evento esperienza, Scadenza dati profilo pseudonimo o un criterio di conservazione del data lake per la scadenza a livello di riga. Una volta configurate, queste impostazioni rimuovono automaticamente i dati idonei in base al periodo di conservazione o inattività impostato, senza richiedere l’invio di singole richieste. Le impostazioni rimangono valide fino a quando non vengono modificate o rimosse.
La scadenza degli eventi di esperienza e la scadenza dei dati del profilo pseudonimo sono funzioni complementari, ma sono configurate in modo diverso. La scadenza degli eventi di esperienza è configurata per set di dati nell’area di lavoro Set di dati, mentre la scadenza dei dati di profilo pseudonimo viene configurata separatamente a livello di sandbox nelle impostazioni del profilo.
Scadenza evento esperienza experience-event-ttl
La scadenza degli eventi esperienza rimuove gli eventi esperienza dall’archivio profili dopo il periodo di conservazione configurato. Per un set di dati ExperienceEvent, configurane il periodo di conservazione nell’area di lavoro Set di dati. Questa impostazione si applica a livello di set di dati e rimuove solo gli eventi, non gli attributi di profilo. Se un profilo non ha attributi propri, il profilo si arresta dopo che tutti i suoi eventi sono stati rimossi. Il periodo minimo di conservazione è di un giorno. Per istruzioni sulla configurazione, consulta il documento Imposta criteri di conservazione dei dati.
Scadenza dati profilo pseudonimo pseudonymous-profile-ttl
La scadenza dei dati di profilo pseudonimo si applica a livello di sandbox e rimuove i profili pseudonimi (sconosciuti) dopo che sono stati inattivi per il periodo impostato. Rimuove sia gli eventi che i record di profilo. Puoi configurare l’impostazione autonomamente. Il periodo di scadenza predefinito è di 14 giorni per le sandbox di produzione e di 3 giorni per le sandbox di sviluppo. Poiché il processo di rimozione viene eseguito in un ciclo ricorrente, i profili idonei non vengono rimossi immediatamente. Per istruzioni sulla configurazione, consulta Scadenza dati profilo pseudonimo.
I due meccanismi di scadenza differiscono per ambito e per ciò che rimuovono:
Le due impostazioni si completano a vicenda. Imposta un periodo di scadenza degli eventi esperienza sui set di dati per controllare per quanto tempo i dati dell’evento rimangono nell’archivio Profili, e utilizza Scadenza dati profilo pseudonimo per rimuovere i profili sconosciuti inattivi in base a quanto tempo rimangono utili. Per informazioni sulla scelta delle durate, vedere Pianificare la strategia di conservazione.
Criteri di conservazione del data lake data-lake-retention
Per un set di dati ExperienceEvent, il periodo di conservazione configurato determina la scadenza degli eventi esperienza dall’archivio Profili. Un set di dati ExperienceEvent può anche avere un criterio di conservazione del data lake separato. Entrambi sono configurati dallo stesso flusso di lavoro Imposta criteri di conservazione dei dati nell’area di lavoro Set di dati.
Per distinguere le opzioni di conservazione disponibili, attenersi alle istruzioni riportate di seguito.
Poiché questi periodi di conservazione sono indipendenti, puoi conservare gli eventi nel data lake per l’analisi a lungo termine dopo la scadenza dall’archivio Profili. Per le linee guida sulla conservazione del data lake, inclusa la configurazione API, consulta Gestire la conservazione dei set di dati Experience Event (TTL).
Pianificare la strategia di conservazione plan-retention
La gestione del ciclo di vita dei dati è una procedura continua, non un’attività una tantum. Conserva i dati solo se supporta un caso d’uso attivo e configura periodi di conservazione e date di scadenza in base a quanto tempo i dati rimangono utili.
Considerazioni chiave per la strategia dei dati
Rispondere alle seguenti domande per ogni set di dati prima di configurare le impostazioni di conservazione o scadenza:
- Questi dati sono ancora necessari per un caso d’uso attivo? La conservazione dei dati oltre i casi di utilizzo richiesti aumenta i costi di archiviazione ed elaborazione senza aggiungere valore.
- Questi dati supportano flussi di lavoro analitici, flussi di lavoro di coinvolgimento o entrambi? Allinea ogni set di dati al flusso di lavoro che serve e gestisci di conseguenza la conservazione.
- Per quanto tempo è necessario conservare i dati per mantenerli utili? Imposta i periodi di conservazione e le date di scadenza in base a quanto tempo i dati supportano il tuo caso d’uso, anziché affidarti a un periodo predefinito o indefinito.
- Con quale frequenza vengono esaminati i dati di utilizzo? Rivedi l’utilizzo regolarmente per individuare eventuali inefficienze e regolare le impostazioni di conservazione prima che influiscano sui costi o sulle prestazioni.
Quando si impostano le durate di conservazione, attenersi alle istruzioni riportate di seguito.
- Scadenza evento esperienza: imposta il periodo di conservazione in modo da coprire il lookback più lungo di cui il pubblico ha bisogno e mantieni gli intervalli di lookback del pubblico entro tale periodo in modo che la segmentazione rimanga accurata.
- Scadenza dati profilo pseudonimo: Se i profili sconosciuti inattivi perdono valore prima degli eventi esperienza conservati, imposta un periodo di scadenza più breve per rimuovere tali profili prima.
- Criteri di conservazione del data lake: Imposta un periodo più lungo per i dati evento ancora necessari per l’analisi, indipendentemente dalla scadenza degli stessi dati dall’archivio profili. Abbina la durata all’utilizzo dei dati: più breve per i dati a cui si accede di frequente, più lunga per le esigenze di archiviazione. Consulta Gestire la conservazione dei set di dati di Experience Event (TTL) per informazioni sulle durate e i valori minimi consigliati.
Applica queste funzionalità in base ai requisiti di conservazione dei dati. Ad esempio, per i dati di clickstream di volume elevato, imposta un periodo di scadenza dell’evento esperienza e, se i profili sconosciuti inattivi perdono valore prima, un periodo di scadenza più breve dei dati del profilo pseudonimo per controllare l’ingombro dell’archivio profili. Imposta separatamente un periodo di conservazione del data lake più lungo per mantenere gli stessi eventi per l’analisi a lungo termine.
Utilizza la scadenza del set di dati per smobilizzare interi set di dati non più necessari e l’eliminazione dei record per rimuovere record specifici su richiesta.
Per informazioni sul tracciamento e sulla gestione dei diritti di licenza, consulta Best practice per i diritti di licenza di gestione dati.
Passaggi successivi next-steps
Dopo aver scelto l’opzione giusta di conservazione o eliminazione, utilizza le linee guida per l’implementazione collegata per eseguirla. Se utilizzi l’API per l’eliminazione dei record o la scadenza del set di dati, consulta anche best practice per le richieste di eliminazione dei record e di scadenza dei set di dati per informazioni su batch, limitazione e monitoraggio.