Težavnost
Vaš najboljši rezultat
N/A
Z namenom vzdrževanja zdravja si je Petronel zadal, da bo bolj športen. V ta namen je začel redno kolesariti, tako na delo kot tudi rekreativno. Uporablja namenjeno aplikacijo za spremljanje svojih voženj in zanima ga pridobivanje statistik o svojih vožnjah ter opazovanje načina, kako uspeva kombinirati koristno s prijetnim, tako da kategorizira vožnje glede na zasledovani namen.
Potem ko je pridobil nabor podatkov, ki opisuje vse vožnje, ki jih je opravil, odkar je začel kolesariti, si Petronel želi izvedeti, kakšna je povprečna hitrost, s katero vozi, glede na koledarski mesec. Prav tako je Petronel začel označevati vožnje, tako da jih deli na: vožnje, pri katerih se je premaknil med domom in službo, ne da bi naredil kakšen ovinek; vožnje, pri katerih se je premaknil med domom in službo, pri tem pa naredil tudi ovinek v rekreativne namene; in čisto rekreativne vožnje. Ker je označevanje zamudno, potrebuje program, ki bo samodejno označil preostale (in prihodnje) vožnje z razumno natančnostjo.
Datoteka dataset_train.csv predstavlja v glavi naslednje stolpce:
Activity ID: edinstveni ID vožnjeActivity Date: datum in ura začetka vožnje v časovnem pasu GMT, v obliki Aug 23, 2025, 4:55:36 PMDistance: razdalja, na kateri se je opravilo premikanje, izražena v kilometrihElapsed Time: skupno trajanje vožnje, vključno s časom počitkaMoving Time: dejanski čas premikanja s kolesomStarting Latitude, Starting Longitude: geografske koordinate izhodiščaFinish Latitude, Finish Longitude: geografske koordinate končne točkeLabel: oznaka, dodeljena vožnji, z naslednjimi pomeni:
COMMUTE: vožnja na delo brez ovinka;LEISURELY_COMMUTE: vožnja na delo z ovinkom;PURE_LEISURE: čisto rekreativna vožnja.Datoteka dataset_eval.csv predstavlja ista polja kot datoteka s podatki za učenje, z izjemo polja Label, ki ga je treba določiti.
Določite povprečno hitrost premikanja za vsak mesec v letu, izraženo v km/h, v skladu s podatki, ki so na voljo v naboru podatkov za učenje.
Opravite označevanje voženj, prisotnih v datoteki dataset_eval.csv, na podlagi oznak zapisov iz datoteke dataset_train.csv.
Za zahtevo 1: po 2,5 točke za pravilno izračunano povprečno hitrost za vsakega od 12 mesecev koledarskega leta - skupaj 30 točk.
Za zahtevo 2: po 0,82 točke za vsak 1% nabora podatkov, pravilno označenega, do maksimalnega praga 70 točk. Z drugimi besedami, tolerira se ~15% napačnih označb.
Izhodna datoteka je v formatu CSV z naslednjo glavo:
subtaskID,Answer1,Answer2Za zahtevo 1, natanko 12 vrstic, po ena za vsak mesec leta, kot sledi:
1,<mesec>,<povprečna hitrost>Mesec bo izražen s tričrkovno okrajšavo (Jan, Feb itd.), povprečna hitrost pa bo izražena kot realno število z natanko 5 decimalkami za vejico, zaokroženo navzdol.
Za zahtevo 2, po ena vrstica za vsak zapis, prisoten v datoteki za evalvacijo, kot sledi:
2,<id vožnje>,<oznaka>ID vožnje je prevzet neposredno iz datoteke za evalvacijo, oznaka pa ima eno od vrednosti, opisanih zgoraj.
Na tej povezavi najdete zip arhiv, v katerem se nahajajo datoteke za učenje in evalvacijo, pa tudi primer veljavne datoteke za oddajo, ki dobi 1 točko.