Indlæser...
Sværhedsgrad
Din bedste score
N/A
Der gives et datasæt med digte på rumænsk, hver skrevet af en af de 7 forfattere. Digtene er efterfølgende blevet opdelt i grupper af 4 vers hver.
De 7 forfattere er:
En gruppe af 4 vers kan repræsentere:
Formålet med problemet er at bygge en model, der kan forudsige forfatteren af en gruppe på 4 vers.
Datasættet til træning, indeholdende følgende kolonner:
Id – unik identifikator for versgruppenVersuri – indholdet af 4 versAutor – forfatteren af verseneEksempel:
| Id | Versuri | Autor |
|---|---|---|
| 0001 | Sus, pe dealuri, Toamna pune... | Mihai Eminescu |
| 0002 | Te sărut și eu și Luna... | George Toparceanu |
Datasættet til test, som ikke indeholder kolonnen Autor:
Id – unik identifikatorVersuri – indholdet af 4 versEksempel:
| Id | Versuri |
|---|---|
| 120001 | Freamătul pădurii se așterne ușor... |
| 120002 | În zori de zi, zorii răsar peste sat... |
Indsendelsesfile skal være en CSV med følgende kolonner:
Id – identifikatoren for versgruppenAutor – den forudsagte forfatterEksempel:
| Id | Autor |
|---|---|
| 120001 | Mihai Eminescu |
| 120002 | George Toparceanu |
Forudsigelserne vil blive sammenlignet med de reelle sprog og nøjagtigheden vil blive beregnet:
accuracy = (antal_korrekte_forudsigelser / samlet_antal_forudsigelser)Den endelige score beregnes baseret på den opnåede nøjagtighed ved hjælp af følgende regler: