Ładowanie...
Trudność
Twój najlepszy wynik
Nie dotyczy
Podany jest zbiór danych z wierszami w języku rumuńskim, każdy napisany przez jednego z 7 autorów. Wiersze zostały następnie podzielone na grupy po 4 wersy.
7 autorów to:
Grupa 4 wersów może reprezentować:
Celem problemu jest zbudowanie modelu, który będzie mógł przewidzieć autora grupy 4 wersów.
Zbiór danych do trenowania, zawierający następujące kolumny:
Id – unikalny identyfikator grupy wersówVersuri – zawartość 4 wersówAutor – autor wersówPrzykład:
| Id | Versuri | Autor |
|---|---|---|
| 0001 | Sus, pe dealuri, Toamna pune... | Mihai Eminescu |
| 0002 | Te sărut și eu și Luna... | George Toparceanu |
Zbiór danych do testowania, który nie zawiera kolumny Autor:
Id – unikalny identyfikatorVersuri – zawartość 4 wersówPrzykład:
| Id | Versuri |
|---|---|
| 120001 | Freamătul pădurii se așterne ușor... |
| 120002 | În zori de zi, zorii răsar peste sat... |
Plik zgłoszenia musi być CSV z następującymi kolumnami:
Id – identyfikator grupy wersówAutor – przewidywany autorPrzykład:
| Id | Autor |
|---|---|
| 120001 | Mihai Eminescu |
| 120002 | George Toparceanu |
Przewidywania będą porównane z rzeczywistymi autorami i zostanie obliczona dokładność:
accuracy = (liczba_poprawnych_przewidywań / całkowita_liczba_przewidywań)Końcowy wynik jest obliczany na podstawie uzyskanej dokładności używając następujących zasad: