加载中...
难度
您的最佳成绩
不适用
提供一个包含罗马尼亚语诗歌的数据集,每首诗都由7位作者中的一位创作。这些诗歌随后被分成每组4行诗句的组合。
这7位作者是:
一组4行诗句可以表示:
问题的目标是构建一个能够预测4行诗句组作者的模型。
用于训练的数据集,包含以下列:
Id – 诗句组的唯一标识符Versuri – 4行诗句的内容Autor – 诗句的作者示例:
| Id | Versuri | Autor |
|---|---|---|
| 0001 | Sus, pe dealuri, Toamna pune... | Mihai Eminescu |
| 0002 | Te sărut și eu și Luna... | George Toparceanu |
用于测试的数据集,不包含Autor列:
Id – 唯一标识符Versuri – 4行诗句的内容示例:
| Id | Versuri |
|---|---|
| 120001 | Freamătul pădurii se așterne ușor... |
| 120002 | În zori de zi, zorii răsar peste sat... |
提交文件必须是包含以下列的CSV:
Id – 诗句组的标识符Autor – 预测的作者示例:
| Id | Autor |
|---|---|
| 120001 | Mihai Eminescu |
| 120002 | George Toparceanu |
预测结果将与真实标签进行比较,并计算准确率:
accuracy = (正确预测数量 / 总预测数量)最终分数基于获得的准确率使用以下规则计算: