GPT
F

fashionpedia

קוד פתוח

detection-datasetscc-by-4.02022-09-22

  • object-detection
  • fashion
  • computer-vision

תמונות אופנה מאירועים ומחיי היומיום עם תיוג מפורט של פרטי לבוש ואביזרים. מתאים למי שבונה מודל זיהוי עצמים ומחפש חלוקה לקטגוריות ספציפיות מעבר לתיוגים כלליים.

  • 913הורדות בחודש
  • 85לייקים

מה זה

במאגר יש 46,781 תמונות שמציגות אנשים בלבוש יומיומי או מאירועים של מפורסמים, עם סך הכל 342,182 תיחומים מסומנים. התיוג מבוסס על אונטולוגיה שנבנתה בידי מומחי אופנה, וכולל 46 קטגוריות שונות שנעות מבגדים שלמים כמו שמלות ומעילים ועד חלקים קטנים יותר כמו שרוולים, רוכסנים וצווארונים.

הנתונים מחולקים לשני חלקים בלבד, ללא סט בדיקה נפרד במאגר הזה. חלק האימון כולל 45,623 תמונות עם מעל 333 אלף תיחומים, וחלק הוולידציה כולל 1,158 תמונות עם 8,781 תיחומים. כל רשומה מחזיקה מזהה תמונה, קובץ תמונה, ממדי גובה ורוחב, ומערך אובייקטים שמפרט מזהה תיחום, קטגוריה, שטח וקואורדינטות.

מתאים ל

  • זיהוי פרטי לבוש

    אימון מודלים לאיתור פריטים כמו חולצות, מכנסיים, נעליים וכובעים בתוך תמונות.

  • איתור אלמנטים בעיצוב

    זיהוי חלקים מוגדרים בבגד כמו שרוולים, כיסים, צווארונים או רוכסנים.

  • סיווג תמונות קטלוג

    בניית כלי לתיוג אוטומטי של מוצרי אופנה ואביזרים עבור חנויות מקוונות.

איפה זה נופל

המקור מתמקד בעיקר באירועי שטיח אדום ובצילומי אופנה, כך שיש בו הטיה ברורה לאנשים שנראים ומתלבשים באופן שרחוק מהמציאות של רוב האוכלוסייה. הנתונים מתועדים באנגלית בלבד, ואין ייצוג לסגנונות לבוש מסורתיים או מקומיים שלא נכללו במחקר המקורי. בנוסף, המאגר הזה מספק תיחומים בלבד למרות שהמחקר המקורי דיבר על מסכות סגמנטציה ותכונות מפורטות, והוא אינו מכיל סט מבחן סגור, מה שמחייב אתכם לבנות בדיקה משלכם.

שאלות
נפוצות

האם מותר להשתמש במאגר לפיתוח מוצר מסחרי?

כן, הרישיון הוא cc-by-4.0 שמתיר שימוש מסחרי מלא. התנאי היחיד הוא מתן קרדיט מתאים ליוצרי המאגר וציון קישור לרישיון.

האם המאגר כולל טקסט או תיוגים בעברית?

לא, כל שמות הקטגוריות והתיוגים מוגדרים באנגלית בלבד. אם יש צורך בממשק או סיווג בעברית, תידרשו לתרגם את 46 הקטגוריות בעצמכם.

האם המאגר כולל מסכות סגמנטציה?

לא בגרסה הזו של המאגר. למרות שהמאמר המקורי של Fashionpedia כולל מסכות סגמנטציה, הגרסה הזו מכילה רק תיבות תיחום לזיהוי עצמים.

מאיפה הגיעו התמונות במאגר?

התמונות נאספו מאירועי סלבריטאים ומצילומי אופנה יומיומיים. מומחי אופנה הגדירו את האונטולוגיה שעל פיה סומנו הפריטים השונים בכל תמונה.

איך טוענים

הנתונים מגיעים בקבצי Parquet שמחולקים לכמה חלקים עבור האימון. אין צורך באישור גישה מיוחד כדי להוריד את המאגר. כשעובדים איתו בקוד, עמודת התמונה מחזירה אובייקט PIL שמתפענח אוטומטית בעת הגישה. חשוב לגשת לאינדקס השורה לפני הפנייה לעמודת התמונה כדי למנוע פענוח כבד של כל התמונות בבת אחת בזיכרון. קואורדינטות התיחום ניתנות במבנה של ארבעה ערכים לפי פורמט Pascal VOC.

from datasets import load_dataset

ds = load_dataset("detection-datasets/fashionpedia")

הרישיון

המאגר מופץ תחת רישיון cc-by-4.0. הרישיון מאפשר שימוש מסחרי, שינוי והפצה של הנתונים, כל עוד אתם נותנים קרדיט מתאים ליוצרים המקוריים ומציינים אם נעשו שינויים. אין דרישה לשתף תוצרים או מודלים תחת אותו רישיון.

  • שימוש מסחרי
  • שינוי הקוד
  • חובת ייחוס

הרישיון המלא ב־Hugging Face ↗