Dificuldade
A tua melhor pontuação
N/D
É fornecido um conjunto de dados com poesias em língua romena, cada uma escrita por um dos 7 autores. As poesias foram posteriormente divididas em grupos de 4 versos.
Os 7 autores são:
Um grupo de 4 versos pode representar:
O objetivo do problema é construir um modelo que possa prever o autor de um grupo de 4 versos.
Conjunto de dados para treinamento, contendo as seguintes colunas:
Id – identificador único para o grupo de versosVersuri – conteúdo de 4 versosAutor – autor dos versosExemplo:
| Id | Versuri | Autor |
|---|---|---|
| 0001 | Sus, pe dealuri, Toamna pune... | Mihai Eminescu |
| 0002 | Te sărut și eu și Luna... | George Toparceanu |
Conjunto de dados para teste, que não contém a coluna Autor:
Id – identificador únicoVersuri – conteúdo de 4 versosExemplo:
| Id | Versuri |
|---|---|
| 120001 | Freamătul pădurii se așterne ușor... |
| 120002 | În zori de zi, zorii răsar peste sat... |
O arquivo de submissão deve ser um CSV com as seguintes colunas:
Id – identificador do grupo de versosAutor – autor previstoExemplo:
| Id | Autor |
|---|---|
| 120001 | Mihai Eminescu |
| 120002 | George Toparceanu |
As previsões serão comparadas com os rótulos reais e será calculada a acurácia:
accuracy = (numero_previsoes_corretas / numero_total_previsoes)A pontuação final é calculada com base na acurácia obtida usando as seguintes regras: