Quali dati sono necessari per il Process Mining
Cosa serve per eseguire il Process Mining?
Il Process Mining utilizza i dati degli Event Log: una registrazione di ciò che è accaduto, quando e per chi. Per analizzare un processo, sono necessarie tre informazioni per ogni passaggio: un identificativo del caso, il nome dell’attività e un timestamp.
Le tre colonne obbligatorie
| Colonna | Descrizione | Esempio |
|---|---|---|
| ID del caso | Identificativo univoco di un’istanza del processo, ad esempio un ordine, un ticket o un cliente | 1001, PO-2024-0192 |
| Attività | Nome del passaggio eseguito | Create Purchase Order, Approve Invoice |
| Timestamp | Momento in cui si è verificato il passaggio, con data e ora | 2025-04-17 10:22:12 |
Le colonne facoltative aggiungono contesto: chi ha eseguito il passaggio (utente/risorsa), quanto tempo ha richiesto, il costo o qualsiasi altro attributo che desidera analizzare.
Ecco un esempio di un piccolo Event Log:
| Case ID | Timestamp | Attività |
|---|---|---|
| 1 | 10:00 | Prendi l’ordine |
| 1 | 10:02 | Prepara la limonata |
| 1 | 10:05 | Servi il cliente |
| 2 | 10:03 | Prendi l’ordine |
| 2 | 10:10 | Risolvi il reclamo del cliente |
| 2 | 10:12 | Prepara la limonata |
| 2 | 10:15 | Servi il cliente |
Anche questa piccola quantità di dati è sufficiente per ricostruire il percorso di ogni caso e iniziare a rispondere alle domande sul processo.
Perché queste tre colonne sono importanti
- ID caso consente a ProcessMind di raggruppare gli eventi in casi, così da ricostruire il percorso completo di ogni istanza di processo.
- Attività definisce i passaggi del processo. Nomi delle attività chiari e coerenti, sempre “Approva fattura”, mai “Approvato” o “Fattura approvata”, mantengono leggibile il processo individuato.
- Timestamp determina l’ordine degli eventi. ProcessMind ne ha bisogno per ordinare le attività e calcolare durate, produttività e tempi di attesa.
Fondamenti della qualità dei dati
Il Process Mining produce risultati affidabili quando i dati sono puliti e coerenti:
- Una riga per evento: ogni riga del log rappresenta un singolo evento, non un riepilogo.
- ID caso coerenti: lo stesso caso utilizza sempre lo stesso identificativo.
- Nessun timestamp mancante: un evento senza timestamp non può essere collocato nel processo.
Non servono dati perfetti per iniziare. ProcessMind funziona con i dati che ha già a disposizione e consente di pulirli e prepararli progressivamente: consulti Pulizia e preparazione dei dati e Configurazione del dataset.
Dove reperire i dati
Gli Event Log vengono generalmente esportati dai sistemi che eseguono il processo, come sistemi ERP, CRM, di ticketing o finanziari. Consulti Dove reperire i dati per indicazioni specifiche per ciascun sistema oppure scarichi log di esempio pronti all’uso dalla sezione File di esempio.
Argomenti correlati
- Process Mining: come funziona l’individuazione.
- Configurazione del dataset: prepari i dati per il mining.