სირთულე
თქვენი საუკეთესო შედეგი
არ არის
ჯანმრთელობის შენარჩუნების მიზნით, პეტრონელმა გადაწყვიტა უფრო სპორტული ყოფილიყო. ამ მიზნით, მან დაიწყო რეგულარულად ველოსიპედით სიარული, როგორც სამსახურში, ისე გასართობად. ის იყენებს სპეციალურ აპლიკაციას თავისი მგზავრობების მონიტორინგისთვის და დაინტერესებულია მიიღოს სტატისტიკა თავისი მგზავრობების შესახებ და დააკვირდეს, როგორ ახერხებს სასარგებლოს სასიამოვნოსთან შერწყმას, მგზავრობების კატეგორიზაციით მიზნის მიხედვით.
მას შემდეგ, რაც მიიღო მონაცემთა ნაკრები, რომელიც აღწერს ყველა მგზავრობას, რომელიც განახორციელა ველოსიპედით სიარულის დაწყების შემდეგ, პეტრონელს სურს გაიგოს, რა საშუალო სიჩქარით მოძრაობს კალენდარული თვის მიხედვით. ასევე, პეტრონელმა დაიწყო მგზავრობების ეტიკეტირება, დაყოფა: მგზავრობები, რომლებშიც გადაადგილდა სახლსა და სამსახურს შორის, ყოველგვარი გზის გარეშე; მგზავრობები, რომლებშიც გადაადგილდა სახლსა და სამსახურს შორის, გასართობი მიზნით გზის გაკეთებით; და წმინდა გასართობი მგზავრობები. იმის გამო, რომ ეტიკეტირება რთულია, მას სჭირდება პროგრამა, რომელიც ავტომატურად განახორციელებს დარჩენილი (და მომავალი) მგზავრობების ეტიკეტირებას გონივრული სიზუსტით.
ფაილი dataset_train.csv წარმოადგენს ზედა ნაწილში შემდეგ სვეტებს:
Activity ID: მგზავრობის უნიკალური IDActivity Date: მგზავრობის დაწყების თარიღი და დრო GMT დროის ზონაში, ფორმით Aug 23, 2025, 4:55:36 PMDistance: გადაადგილების მანძილი, გამოხატული კილომეტრებშიElapsed Time: მგზავრობის მთლიანი ხანგრძლივობა, მათ შორის დასვენების დროMoving Time: ველოსიპედით გადაადგილების ფაქტობრივი ხანგრძლივობაStarting Latitude, Starting Longitude: გამგზავრების წერტილის გეოგრაფიული კოორდინატებიFinish Latitude, Finish Longitude: შეჩერების წერტილის გეოგრაფიული კოორდინატებიLabel: მგზავრობისთვის გამოყენებული ეტიკეტი, შემდეგი მნიშვნელობებით:
COMMUTE: სამუშაო მგზავრობა გზის გარეშე;LEISURELY_COMMUTE: სამუშაო მგზავრობა გზით;PURE_LEISURE: წმინდა გასართობი მგზავრობა.ფაილი dataset_eval.csv წარმოადგენს იგივე ველებს, როგორც სწავლების მონაცემების ფაილი, გარდა ველისა Label, რომელიც უნდა განისაზღვროს.
განსაზღვრეთ გადაადგილების საშუალო სიჩქარე წლის თითოეული თვისთვის, გამოხატული km/h-ში, სწავლების მონაცემთა ნაკრებში ხელმისაწვდომი მონაცემების მიხედვით.
განახორციელეთ ფაილში dataset_eval.csv წარმოდგენილი მგზავრობების ეტიკეტირება, ფაილის dataset_train.csv ჩანაწერების ეტიკეტებიდან გამომდინარე.
მოთხოვნა 1-სთვის: თითოეული კალენდარული წლის 12 თვისთვის სწორად გამოთვლილი საშუალო სიჩქარისთვის 2,5 ქულა - სულ 30 ქულა.
მოთხოვნა 2-სთვის: მონაცემთა ნაკრების სწორად ეტიკეტირებული თითოეული 1%-სთვის 0,82 ქულა, 70 ქულის მაქსიმალურ ზღვარამდე. სხვა სიტყვებით, დაშვებულია ~15% არასწორი ეტიკეტირება.
გამოსავალი ფაილი CSV ფორმატშია, შემდეგი ზედა ნაწილით:
subtaskID,Answer1,Answer2მოთხოვნა 1-სთვის, ზუსტად 12 რიგი, თითოეული წლის თვისთვის, შემდეგნაირად:
1,<თვე>,<საშუალო სიჩქარე>თვე გამოიხატება სამასოიანი შემოკლებით (Jan, Feb და ა.შ.) ხოლო საშუალო სიჩქარე გამოიხატება როგორც რეალური რიცხვი ზუსტად 5 ათწილადით მძიმის შემდეგ, დამრგვალებული ნაკლებობით.
მოთხოვნა 2-სთვის, თითოეული ჩანაწერისთვის შეფასების ფაილში, შემდეგნაირად:
2,<მგზავრობის id>,<ეტიკეტი>მგზავრობის ID პირდაპირ აღებულია შეფასების ფაილიდან, ხოლო ეტიკეტს აქვს ზემოთ აღწერილი ერთ-ერთი მნიშვნელობა.
იხილეთ ამ ბმულზე zip არქივი, რომელშიც მოცემულია სწავლებისა და შეფასების ფაილები, ასევე მოქმედი წარდგენის ფაილის მაგალითი, რომელიც იღებს 1 ქულას.