Difficoltà
Il tuo miglior punteggio
N/D
Viene fornito un set di dati con poesie in lingua rumena, ciascuna scritta da uno dei 7 autori. Le poesie sono state successivamente divise in gruppi di 4 versi.
I 7 autori sono:
Un gruppo di 4 versi può rappresentare:
L'obiettivo del problema è costruire un modello che possa predire l'autore di un gruppo di 4 versi.
Il set di dati per l'addestramento, contenente le seguenti colonne:
Id – identificatore unico per il gruppo di versiVersuri – il contenuto di 4 versiAutor – l'autore dei versiEsempio:
| Id | Versuri | Autor |
|---|---|---|
| 0001 | Sus, pe dealuri, Toamna pune... | Mihai Eminescu |
| 0002 | Te sărut și eu și Luna... | George Toparceanu |
Il set di dati per il test, che non contiene la colonna Autor:
Id – identificatore unicoVersuri – il contenuto di 4 versiEsempio:
| Id | Versuri |
|---|---|
| 120001 | Freamătul pădurii se așterne ușor... |
| 120002 | În zori de zi, zorii răsar peste sat... |
Il file di sottomissione deve essere un CSV con le seguenti colonne:
Id – l'identificatore del gruppo di versiAutor – l'autore predettoEsempio:
| Id | Autor |
|---|---|
| 120001 | Mihai Eminescu |
| 120002 | George Toparceanu |
Le predizioni saranno confrontate con le etichette reali e sarà calcolata l'accuratezza:
accuracy = (numero_predizioni_corrette / numero_totale_predizioni)Il punteggio finale è calcolato sulla base dell'accuratezza ottenuta utilizzando le seguenti regole: