Difficulté
Votre meilleur score
N/D
Un ensemble de données contenant des poèmes en langue roumaine est fourni, chacun écrit par l'un des 7 auteurs. Les poèmes ont été ensuite divisés en groupes de 4 vers.
Les 7 auteurs sont :
Un groupe de 4 vers peut représenter :
L'objectif du problème est de construire un modèle qui puisse prédire l'auteur d'un groupe de 4 vers.
L'ensemble de données pour l'entraînement, contenant les colonnes suivantes :
Id – identifiant unique pour le groupe de versVersuri – le contenu de 4 versAutor – l'auteur des versExemple :
| Id | Versuri | Autor |
|---|---|---|
| 0001 | Sus, pe dealuri, Toamna pune... | Mihai Eminescu |
| 0002 | Te sărut și eu și Luna... | George Toparceanu |
L'ensemble de données pour les tests, qui ne contient pas la colonne Autor :
Id – identifiant uniqueVersuri – le contenu de 4 versExemple :
| Id | Versuri |
|---|---|
| 120001 | Freamătul pădurii se așterne ușor... |
| 120002 | În zori de zi, zorii răsar peste sat... |
Le fichier de soumission doit être un CSV avec les colonnes suivantes :
Id – l'identifiant du groupe de versAutor – l'auteur préditExemple :
| Id | Autor |
|---|---|
| 120001 | Mihai Eminescu |
| 120002 | George Toparceanu |
Les prédictions seront comparées aux langues réelles et la précision sera calculée :
accuracy = (nombre_prédictions_correctes / nombre_total_prédictions)Le score final est calculé sur la base de la précision obtenue en utilisant les règles suivantes :