בעיה #71
מחבר:IOAI 2025
רמת קושי
הציון הטוב ביותר שלך
לא זמין
אתה לומד בינה מלאכותית כבר זמן מה. חבר ותיק של אביך, ארכיאולוג ומבקר אמנות מפורסם, שמע על כך וביקש את עזרתך. עליך לתכנן אלגוריתם שיוכל לסווג ציורים עתיקים כיצירות אותנטיות או כעותקים.
מכיוון שאימות מקצועי הוא יקר, צוות המחקר השיג תוויות אותנטיות רק לחלק קטן מהציורים. עבור רוב הדגימות, האותנטיות נותרת לא ידועה. ידוע שהמאפיינים הדיגיטליים של הציורים מציגים דפוסים מבניים חזקים. המשימה שלך היא להשתמש בכל הדגימות הזמינות - כולל אלה עם תוויות לא ידועות - כדי לאמן מודל לסיווג אותנטיות של ציורים עתיקים.
מערך הנתונים מורכב ממערך אימון, מערך אימות ומערך בדיקה, כל אחד מהם מכיל 500 דגימות עצמאיות.
training_set.csv)SampleID).feature1, feature2, feature3, feature4, feature5, feature6).label) מכילה את התווית: 1 עבור אותנטי, -1 עבור עותק ו-0 עבור לא ידוע.מערך האימון משמש לאימון מודלים וניתן לגשת אליו ולהוריד אותו ישירות במהלך התחרות.
validation_set.csv)⚠️ מערך האימות משמש לחישוב ציון דירוג A (ציבורי) ולא היה נגיש ישירות במהלך התחרות.
test_set.csv)⚠️ מערך הבדיקה משמש לחישוב ציון דירוג B (פרטי) ולא היה נגיש ישירות במהלך התחרות.
המשימה שלך היא לאמן מודל מתאים, המסוגל לחזות את אותנטיות הציורים ממערכי הבדיקה, למרות המספר הגדול של דגימות לא מתוייגות.
עליך ליצור קובץ submission.csv שיהיה בפורמט הבא:
SampleID, ClasamentType, labelVALIDATION_001, A, 1TEST_001, B, 1כאשר:
SampleID מייצג את מזהה הציור (מסופק ב-validation_set.csv או test_set.csv).ClasamentType יהיה בעל הערך A עבור ציורים מ-validation_set.csv ויהיה בעל הערך B עבור ציורים מ-test_set.csv.label הוא התווית שחוזה המודל.מדד ההערכה יהיה דיוק הסיווג, המוגדר כיחס הדגימות שחוזו נכון מהמספר הכולל של הדגימות שהוערכו.
הציון הסופי מחושב על בסיס הדיוק שהושג באמצעות הכללים הבאים: