Problema #49
Autore:Daniel Plăcintă
Difficoltà
Il tuo miglior punteggio
N/D
Un passo estremamente importante nell'evoluzione personale di ogni studente è l'ammissione a un liceo prestigioso, d'élite.
Sviluppate un modello che predice se, sulla base di diversi risultati, il candidato sarà ammesso a un liceo d'élite (status_admitere = 1) o respinto (status_admitere = 0).
Allenerete il modello utilizzando il set di dati di addestramento train_data.csv e poi genererete predizioni utilizzando il set di dati test_data.csv.
Il Set di Dati per l'Addestramento (train.csv) contiene le seguenti colonne:
Il Set di Dati per la Predizione (test.csv):
id, gen, judet, NT, MEV, MATE, MGIM) del set di addestramento, senza la colonna status_admitere.Il file di sottomissione output.csv deve contenere esattamente tre colonne: subtaskID, datapointID, answer.
| subtaskID | datapointID | answer | Descrizione |
|---|---|---|---|
| 1 | 101 | 1.25 | dif_NT-MEV: differenza tra il voto al test di ammissione e il voto alla valutazione nazionale, con 2 decimali |
| 2 | 101 | 5 | loc-MEV: posizione in classifica dopo il voto MEV, valore intero |
| 3 | 101 | 1 | status_admitere: predizione del modello, 1 = ammesso, 0 = respinto |
Importante: Ogni riga nel CSV rappresenta la risposta per un singolo subtask e un singolo datapoint. Per ogni
datapointIDdeve esistere una riga per ogni subtask.
L'invio del file sample_output.csv genera 5 punti.