Difficoltà
Il tuo miglior punteggio
N/D
Hai a disposizione un set di dati che contiene registrazioni simulate da sensori industriali. Ogni riga corrisponde a un campione, e i dati includono quattro caratteristiche numeriche:
Feature1: Misurazione delle vibrazioni sull'asse X.Feature2: Misurazione delle vibrazioni sull'asse Y.Feature3: Misurazione delle variazioni di temperatura.Feature4: Misurazione delle variazioni di pressione.Esistono quattro stati diversi dell'apparecchiatura (denominati 0, 1, 2, 3). L'obiettivo è assegnare a ogni campione un'etichetta (0, 1, 2 o 3) in modo che i campioni provenienti dallo stesso stato siano raggruppati insieme. L'ordine dei numeri non conta, solo il fatto che i campioni della stessa categoria ricevano la stessa etichetta.
train.csv: Contiene i campioni per l'addestramento con SampleID e le 4 caratteristiche.test.csv: Contiene i campioni per il test con SampleID e le 4 caratteristiche. Devi assegnare etichette a questi campioni.Usa i dati di addestramento per comprendere i modelli e le relazioni tra le caratteristiche, poi assegna a ogni campione del test un'etichetta tra 0 e 3.
Le previsioni saranno valutate usando l'Adjusted Rand Index (ARI), che misura quanto bene si adattano i tuoi raggruppamenti agli stati reali (nascosti) delle apparecchiature.
Il file che devi generare dopo aver assegnato le etichette al test deve avere il formato csv e deve contenere solo due colonne:
SampleID,Label1,02,13,0...