Vanskelighetsgrad
Din beste poengsum
N/A
I en desember-måned med store og stille snøflak, da landsbyen fortsatt luktet av brent ved og friskt høy hentet fra låvene, åpnet portene til Den Nasjonale Kanin-utstillingen midt i landet. I de oppvarmede hallene, som skinte under de gule lysene, brakte oppdrettere fra alle hjørner av landet med håp sine vakreste og best pleide dyr.

Eksemplarer fra tre store kaninraser (hver med veletablerte utseender og vaner) skulle møtes igjen på samme sted.
Hvert dyr fikk en plate med en ID, og i et tykt register, innbundet i skinn, ble alle tegnene som skilte det fra de andre notert:
kjønn, vekt, ørelengde, om ørene var hengende eller ikke, pelsfargen, alder, pelstype og pelskvalitet, kroppsfasong, om det hadde dobbelhake eller ikke, samt helsetilstand.
Dette var organisatorenes måte å bevare et fullstendig vitnesbyrd om hver pelskledde sjel som kom inn i hallen.
Organisatorene ønsker å vite hvor mange av hunnene som ble brakt til utstillingen hadde hengende ører og bar den noble havana-nyansen. Resultatet må du bestemme basert på testsettet (test_data.csv).
Ingenting komplisert, du trenger bare å gjøre et nøye søk gjennom registrene for å gi dem dette svaret.
![]() | ![]() | ![]() |
En kald morgen, da pusten fortsatt steg som damp i hallen, oppdaget organisatorene at en viktig side hadde forsvunnet fra det offisielle registeret.
Rasen til hver kanin, så nøye notert i andre år, var ikke å finne noe sted.
Det var brakt eksemplarer fra tre forskjellige raser, det visste de sikkert, men tegnene som identifiserte dem direkte hadde forsvunnet.
De som kjente kaniner godt ble bedt om å observere alle eksemplarene tålmodig og identifisere tre naturlige grupper, ved å bruke kun de noterte trekkene: likheter, forskjeller, klare grenser, områder hvor dyrene virket like eller forskjellige i utseende. Resultatet må du bestemme basert på testsettet (test_data.csv).
For å evaluere hvor godt inndelingen i raser passer, brukes Adjusted Rand Index (ARI), som måler likheten mellom de to inndelingene, justert for tilfeldig matching.
ARI-koeffisienten for to inndelinger er definert som:
hvor:
RI representerer Rand-indeksen mellom de to inndelingene;E[RI] er forventet verdi av Rand-indeksen for tilfeldige inndelinger.Hvis tallet som oppnås er nær 1, betyr det at inndelingen i raser ble gjort med dyktighet og grensene mellom rasekarakteristikkene ble identifisert korrekt. Utstillingsorganisatorene er svært krevende og gir maksimal poengsum for denne subtasken bare hvis verdien oppnådd for evalueringsmetrikken er 1.
I den desemberen var antall deltakere så stort at dommerne, uansett hvor mye de anstrengte seg, ikke kunne bedømme alle dyrene.
Bare en del av dem hadde fått en Bedømmelsesscore, mellom 0 og 100.
0 betyr at eksemplaret ble diskvalifisert100 betyr at eksemplaret er et som kan erklæres mesterFor de andre kaninene, som ennå ikke var markert, måtte det finnes en måte å gjette scoren de ville ha fått.
Det ble søkt etter et system som kunne forstå sammenhengene mellom kaniner som allerede var vurdert og de som var igjen uten score, slik at estimatene skulle være så nær som mulig det dommerne ville ha sagt.
Jo mindre forskjellene er, jo mer dyktig og passende anses systemet for å hjelpe mennesker som er overveldet av det store antallet dyr.
Oppgaven deres er å utvikle et automatisk system for prediksjon av scorer for eksemplarene inkludert i test_data.csv.
For evaluering av modellens ytelse bruker vi MSE (Mean Squared Error) — gjennomsnittlig kvadratfeil. Dette måler gjennomsnittlig kvadratisk forskjell mellom faktiske verdier og predikerte verdier.
Formelen er:
hvor:
y_i er den faktiske scoren til eksemplar i,y^_i er scoren predikert av modellen,n er totalt antall eksemplarer i testsettet.Lavere MSE-verdier indikerer bedre ytelse. Jo nærmere de predikerte verdiene er de faktiske, jo mindre vil feilen være.
For å transformere oppnådd score til poengsum, bruker vi en enkel regel, basert på to terskler:
Det endelige resultatet må være en CSV-fil kalt output.csv, som skal inneholde nøyaktig 3 kolonner:
subtaskID - representerer subtask-nummeret (1, 2, 3)datapointID - som refererer til ID-kolonnen i datasettetanswer - svaret som tilsvarer datapunktet for den respektive subtaskenMerk: For subtask 1, hvor det kreves ett enkelt svar for hele testdatasettet, vis en enkelt linje hvor datapointID er 1.
Vi ber dere om å engasjere dere og hjelpe organisatorene av Den Nasjonale Kanin-utstillingen: en historie om lidenskap og prestasjon, forståelse mellom oppdrettere, likheter og forskjeller mellom raser og om forsøket på å se dyreverdenen med den tålmodigheten som bare en god oppdretter kan ha i forkant av høytidene.