Obtížnost
Vaše nejlepší skóre
N/A
Máte k dispozici datovou sadu, která obsahuje simulované záznamy z průmyslových senzorů. Každý řádek odpovídá jednomu vzorku a data zahrnují čtyři numerické charakteristiky:
Feature1: Měření vibrací na ose X.Feature2: Měření vibrací na ose Y.Feature3: Měření teplotních variací.Feature4: Měření tlakových variací.Existují čtyři různé stavy zařízení (označené 0, 1, 2, 3). Cílem je přiřadit každému vzorku label (0, 1, 2 nebo 3) tak, aby vzorky pocházející ze stejného stavu byly seskupeny dohromady. Pořadí čísel nezáleží, pouze na tom, že vzorky ze stejné kategorie dostanou stejný label.
train.csv: Obsahuje vzorky pro trénování s SampleID a 4 charakteristikami.test.csv: Obsahuje vzorky pro test s SampleID a 4 charakteristikami. Těmto vzorkům musíte přiřadit labely.Použijte trénovací data k pochopení vzorců a vztahů mezi charakteristikami, poté přiřaďte každému vzorku z testu label mezi 0 a 3.
Predikce budou hodnoceny pomocí Adjusted Rand Index (ARI), který měří, jak dobře se vaše seskupení shoduje se skutečnými (skrytými) stavy zařízení.
Soubor, který musíte vygenerovat poté, co přiřadíte labely testu, musí mít formát csv a musí obsahovat pouze dva sloupce:
SampleID,Label1,02,13,0...