Dificultad
Tu mejor puntuación
N/D
Se proporciona un conjunto de datos con poesías en lengua rumana, cada una escrita por uno de los 7 autores. Las poesías han sido divididas posteriormente en grupos de 4 versos.
Los 7 autores son:
Un grupo de 4 versos puede representar:
El objetivo del problema es construir un modelo que pueda predecir el autor de un grupo de 4 versos.
El conjunto de datos para entrenamiento, que contiene las siguientes columnas:
Id – identificador único para el grupo de versosVersuri – el contenido de 4 versosAutor – el autor de los versosEjemplo:
| Id | Versuri | Autor |
|---|---|---|
| 0001 | Sus, pe dealuri, Toamna pune... | Mihai Eminescu |
| 0002 | Te sărut și eu și Luna... | George Toparceanu |
El conjunto de datos para pruebas, que no contiene la columna Autor:
Id – identificador únicoVersuri – el contenido de 4 versosEjemplo:
| Id | Versuri |
|---|---|
| 120001 | Freamătul pădurii se așterne ușor... |
| 120002 | În zori de zi, zorii răsar peste sat... |
El archivo de envío debe ser un CSV con las siguientes columnas:
Id – el identificador del grupo de versosAutor – el autor predichoEjemplo:
| Id | Autor |
|---|---|
| 120001 | Mihai Eminescu |
| 120002 | George Toparceanu |
Las predicciones serán comparadas con las etiquetas reales y se calculará la precisión:
accuracy = (numero_predicciones_correctas / numero_total_predicciones)La puntuación final se calcula en base a la precisión obtenida usando las siguientes reglas: