Moeilijkheid
Jouw beste score
N.v.t.
Je hebt een dataset tot je beschikking die gesimuleerde opnames van industriële sensoren bevat. Elke rij komt overeen met een monster, en de gegevens bevatten vier numerieke kenmerken:
Feature1: Meting van trillingen op de X-as.Feature2: Meting van trillingen op de Y-as.Feature3: Meting van temperatuurvariaties.Feature4: Meting van drukvariaties.Er zijn vier verschillende toestanden van de apparatuur (genaamd 0, 1, 2, 3). Het doel is om aan elk monster een label (0, 1, 2 of 3) toe te wijzen zodat monsters afkomstig uit dezelfde toestand samen gegroepeerd worden. De volgorde van de nummers doet er niet toe, alleen het feit dat monsters uit dezelfde categorie hetzelfde label krijgen.
train.csv: Bevat de monsters voor training met SampleID en de 4 kenmerken.test.csv: Bevat de monsters voor test met SampleID en de 4 kenmerken. Je moet labels toewijzen aan deze monsters.Gebruik de trainingsgegevens om de patronen en relaties tussen kenmerken te begrijpen, en wijs vervolgens aan elk monster in de test een label tussen 0 en 3 toe.
De voorspellingen worden geëvalueerd met behulp van Adjusted Rand Index (ARI), die meet hoe goed jouw groeperingen overeenkomen met de werkelijke (verborgen) toestanden van de apparatuur.
Het bestand dat je moet genereren nadat je labels hebt toegewezen aan de test moet het csv formaat hebben en moet slechts twee kolommen bevatten:
SampleID,Label1,02,13,0...