La produzione industriale genera una grande quantità di dati tecnici operativi diversi. Questo gruppo comprende anche dati di processo, dati di misura e metadati. I dati di processo di un impianto vengono solitamente acquisiti ciclicamente, mentre i dati di misura possono appartenere sia a un processo sia a un prodotto o a un lotto. Si aggiungono anche i metadati, come i numeri dei prodotti, dei clienti o altre informazioni aggiuntive. I dati tecnici operativi possono essere registrati, archiviati, analizzati e visualizzati con il sistema iba. In generale, la registrazione dettagliata dei dati è necessaria per la documentazione di qualità. È anche utile per identificare il potenziale di miglioramento dei processi e della qualità.
La quantità di dati generati in un'azienda aumenta rapidamente con le sue dimensioni e il suo livello di digitalizzazione. Anche l'impegno e la complessità della gestione dei dati aumentano. Pertanto, questo libro bianco esplora la questione di come gli utenti del software iba possano gestire tali requisiti e quali siano le soluzioni disponibili per gestire grandi quantità di dati. A tal fine, sono state condotte indagini presso iba nell'ambito del progetto di ricerca NewTech4Steel. Questo libro bianco contiene informazioni di base su Apache Hadoop, i risultati del progetto e raccomandazioni per gli utenti iba che dispongono di un'enorme quantità di dati o che intendono utilizzare Apache Hadoop per archiviare e analizzare i dati di misura. Il documento fa seguito al precedente white paper sul benchmark ibaHD-Server. I risultati del benchmark ibaHD-Server hanno dimostrato che ibaHD-Server è molto adatto alla registrazione di dati ad alta frequenza grazie al suo efficiente algoritmo di memorizzazione. Il presente documento si concentra ora sulla scalabilità e sulle soluzioni per i big data.
