Svårighetsgrad
Din bästa poäng
Ej tillgänglig
En dataset med dikter på rumänska tillhandahålls, var och en skriven av en av 7 författare. Dikterna har sedan delats upp i grupper om 4 verser.
De 7 författarna är:
En grupp om 4 verser kan representera:
Målet med problemet är att bygga en modell som kan förutsäga författaren till en grupp om 4 verser.
Datasetet för träning, innehållande följande kolumner:
Id – unik identifierare för versgruppenVersuri – innehållet av 4 verserAutor – författaren till versernaExempel:
| Id | Versuri | Autor |
|---|---|---|
| 0001 | Sus, pe dealuri, Toamna pune... | Mihai Eminescu |
| 0002 | Te sărut și eu și Luna... | George Toparceanu |
Datasetet för testning, som inte innehåller kolumnen Autor:
Id – unik identifierareVersuri – innehållet av 4 verserExempel:
| Id | Versuri |
|---|---|
| 120001 | Freamătul pădurii se așterne ușor... |
| 120002 | În zori de zi, zorii răsar peste sat... |
Inlämningsfilen ska vara en CSV med följande kolumner:
Id – identifieraren för versgruppenAutor – den förutsagda författarenExempel:
| Id | Autor |
|---|---|
| 120001 | Mihai Eminescu |
| 120002 | George Toparceanu |
Förutsägelserna kommer att jämföras med de verkliga språken och noggrannheten kommer att beräknas:
accuracy = (antal_korrekta_förutsägelser / totalt_antal_förutsägelser)Det slutliga poängtalet beräknas baserat på den uppnådda noggrannheten enligt följande regler: