Laster...
Vanskelighetsgrad
Din beste poengsum
N/A
Det gis et datasett med dikt på rumensk, hver skrevet av en av 7 forfattere. Diktene har senere blitt delt inn i grupper på 4 vers.
De 7 forfatterne er:
En gruppe på 4 vers kan representere:
Målet med problemet er å bygge en modell som kan predikere forfatteren av en gruppe på 4 vers.
Datasettet for trening, som inneholder følgende kolonner:
Id – unik identifikator for versgruppenVersuri – innholdet av 4 versAutor – forfatteren av verseneEksempel:
| Id | Versuri | Autor |
|---|---|---|
| 0001 | Sus, pe dealuri, Toamna pune... | Mihai Eminescu |
| 0002 | Te sărut și eu și Luna... | George Toparceanu |
Datasettet for testing, som ikke inneholder kolonnen Autor:
Id – unik identifikatorVersuri – innholdet av 4 versEksempel:
| Id | Versuri |
|---|---|
| 120001 | Freamătul pădurii se așterne ușor... |
| 120002 | În zori de zi, zorii răsar peste sat... |
Innleveringsfilen må være en CSV med følgende kolonner:
Id – identifikatoren til versgruppenAutor – den predikerte forfatterenEksempel:
| Id | Autor |
|---|---|
| 120001 | Mihai Eminescu |
| 120002 | George Toparceanu |
Prediksjoner vil bli sammenlignet med de faktiske språkene og nøyaktigheten vil bli beregnet:
accuracy = (antall_korrekte_prediksjoner / totalt_antall_prediksjoner)Den endelige poengsummen beregnes basert på oppnådd nøyaktighet ved hjelp av følgende regler: