Problema #43
Autore:Mihai Nan
Difficoltà
Il tuo miglior punteggio
N/D
Ogni anno, migliaia di laureati in medicina si preparano per il momento più difficile della loro carriera: l'Esame di Specializzazione. Per mesi interi, i futuri medici memorizzano, ripetono e risolvono centinaia di domande a scelta multipla.
Ma quest'anno, la Commissione Centrale ha deciso di introdurre un'innovazione importante: una piattaforma automatizzata che verifica e valuta le risposte utilizzando l'apprendimento automatico.
Sfortunatamente, il prototipo del sistema ha iniziato a dare errori, e la commissione ha bisogno del tuo aiuto per ripararlo.
Ti sono stati messi a disposizione due file:
Il tuo obiettivo è ricostruire il meccanismo di correzione automatica.
Ogni riga rappresenta una domanda a scelta multipla dell'esame:
Costruisci un modello di apprendimento automatico capace di predire, per ogni domanda in test.csv, quale delle quattro opzioni (0–3) è la risposta corretta.
Il tuo modello sarà valutato utilizzando l'accuratezza:
Qualsiasi metodo è permesso: algoritmi classici di ML, embeddings, modelli di linguaggio, BERT medico ecc.
Il file submission.csv deve contenere una riga per ogni domanda nel test.
La prima riga del file contiene quanto segue:
DatapointID, PredictedAnswerdove:
SampleID dal test84f328d3-fca4-422d-8fb2-19d55eb31503):84f328d3-fca4-422d-8fb2-19d55eb31503, 2