Dificultad
Tu mejor puntuación
N/D
Tienes a tu disposición un conjunto de datos que contiene registros simulados de sensores industriales. Cada fila corresponde a una muestra, y los datos incluyen cuatro características numéricas:
Feature1: Medición de vibraciones en el eje X.Feature2: Medición de vibraciones en el eje Y.Feature3: Medición de variaciones de temperatura.Feature4: Medición de variaciones de presión.Existen cuatro estados diferentes del equipo (denominados 0, 1, 2, 3). El objetivo es asignar a cada muestra una etiqueta (0, 1, 2 o 3) de manera que las muestras provenientes del mismo estado se agrupen juntas. El orden de los números no importa, solo el hecho de que las muestras de la misma categoría reciban la misma etiqueta.
train.csv: Contiene las muestras para entrenamiento con SampleID y las 4 características.test.csv: Contiene las muestras para prueba con SampleID y las 4 características. Debes asignar etiquetas a estas muestras.Usa los datos de entrenamiento para entender los patrones y relaciones entre características, luego asigna a cada muestra del test una etiqueta entre 0 y 3.
Las predicciones serán evaluadas usando Adjusted Rand Index (ARI), que mide qué tan bien coinciden tus agrupaciones con los estados reales (ocultos) de los equipos.
El archivo que debes generar después de asignar etiquetas al test debe tener formato csv y debe contener solo dos columnas:
SampleID,Label1,02,13,0...