בעיה #45
מחבר:Mihai Nan
רמת קושי
הציון הטוב ביותר שלך
לא זמין
תעשיית המוזיקה הדיגיטלית מתפתחת במהירות, ופלטפורמות הסטרימינג מתחרות כדי להעריך כמה טוב ישיר יתפקד בקרב המאזינים. פופולריות היא לא רק מספר, מכיוון שהיא משפיעה על המלצות, פלייליסטים אוטומטיים ואפילו על חוזי האמנים.
כדי לאמן מודול חיזוי חדש, קיבלת מערך נתונים שחולץ מ-Spotify, המכיל מאפיינים אודיו ומטא-נתונים של שירים.
המטרה שלך היא לבנות מודל שמחזה את הפופולריות של שיר על בסיס המאפיינים המספריים וכמה מידע עזר.
יש לך שני קבצים:
popularitypopularity (אלה צריכים להיחזות)לכל שיר יש מזהה ייחודי וסדרת מאפיינים:
track_id — מזהה ייחודי של השירartistsalbum_nametrack_namepopularity (רק ב-train)duration_msexplicitdanceabilityenergykeyloudnessmodespeechinessacousticnessinstrumentalnesslivenessvalencetempotime_signaturetrack_genreהמטרה העיקרית היא לחזות את עמודת popularity עבור מערך הבדיקה.
בנה מודל למידת מכונה שמחזה את הפופולריות של כל שיר ב-test.csv.
החיזויים שלך צריכים להישמר בקובץ submission.csv עם הפורמט:
track_id,popularity101,42.7102,55.1103,38.0כאשר:
track_id — מזהה השיר מהבדיקהpopularity — ערך ממשי (float), המייצג את הפופולריות החזויהההערכה תתבצע באמצעות MAE (Mean Absolute Error):
הציון הסופי מחושב על בסיס ציון ה-MAE שהושג באמצעות הכללים הבאים: