GPT
T

tiny-imagenet

קוד פתוח

zh-plus2022-07-01

גרסה מוקטנת של אימג'נט למי שרוצה לבדוק ארכיטקטורות סיווג תמונה בלי להמתין ימים לחישובים כבדים. כל תמונה נדחסה לגודל קטן שרץ מהר על חומרה בסיסית.

  • 16,201הורדות בחודש
  • 106לייקים

מה זה

המאגר מחזיק מאה אלף תמונות אימון שמחולקות למאתיים מחלקות שונות, בדיוק חמש מאות תמונות לכל קטגוריה. כל תמונה מגיעה בפורמט צבעוני ברזולוציה נמוכה של 64 על 64 פיקסלים בלבד. המקור מגיע מתחרות של קורס הראייה הממוחשבת של סטנפורד, כשהשמות של המחלקות מוגדרים באנגלית.

מבחינת חלוקה, יש כאן מאה אלף דוגמאות בסט האימון ועשרת אלפים דוגמאות בסט הוולידציה, חמישים לכל מחלקה. בכרטיס מוזכרות גם חמישים תמונות בדיקה לכל מחלקה, אך בפיצול הנתונים בפועל הן מסומנות בתווית מינוס אחת כי התוויות האמיתיות שלהן חסרות.

מתאים ל

  • בדיקת ארכיטקטורות

    הרצה מהירה של מודלים חדשים לבדיקת התכנסות בלי לשרוף שעות עיבוד על חומרה יקרה.

  • השוואת ביצועים במחקר

    בחינת אלגוריתמים לסיווג תמונה מול תוצאות קיימות בלוחות תוצאות של הקהילה האקדמית.

  • תרגול ראייה ממוחשבת

    אימון מודלים ראשונים במסגרת לימודים, פרויקטים אישיים או סדנאות פיתוח קצרות.

איפה זה נופל

הרזולוציה הנמוכה היא החיסרון המרכזי כאן. תמונות בגודל 64 על 64 מאבדות המון פרטים עדינים, ולכן מודל שיצליח פה לא בהכרח יתפקד טוב על תמונות ברזולוציה אמיתית מהעולם. הטקסט והמחלקות מגיעים כולם באנגלית בלבד, ואין שום תיעוד בכרטיס על הטיות גזעיות, מגדריות או תרבותיות שנאספו במקור מאימג'נט. בנוסף, תוויות הבדיקה חסרות לחלוטין ומקבלות ערך שלילי, מה שמקשה לבצע ולידציה חיצונית עצמאית על הסט הזה.

שאלות
נפוצות

האם מותר להשתמש במאגר לפיתוח מוצר מסחרי?

לא מומלץ בכלל. בעמוד המאגר לא צוין שום רישיון שימוש, ובהיעדר היתר מפורש אין זכות חוקית להכניס את הנתונים למערכות מסחריות או להפיץ מודל שאומן עליהם.

האם יש במאגר תוכן בעברית?

אין עברית כלל. שמות המחלקות והתוויות כולם באנגלית, והתמונות עצמן אינן מותאמות או כוללות טקסט מקומי.

מה ההבדל בין המאגר הזה לאימג'נט המקורי?

כאן יש רק מאתיים מחלקות במקום אלף, וכל תמונה כווצה לגודל זעיר של 64 על 64 פיקסלים במקום רזולוציה מלאה. זה הופך את האימון למהיר וקל בהרבה, אך פחות מייצג תמונות מציאותיות.

איך טוענים

טוענים את הנתונים ישירות דרך ספריית הדאטהסטס מתוך קובצי פארקט, בלי שום צורך לבקש אישור גישה מראש. כל רשומה כוללת שני שדות פשוטים: אובייקט התמונה עצמו ותווית מספרית. המפתח של המספרים מול שמות המחלקות יושב בקובץ נפרד במאגר, וחשוב לגשת קודם לאינדקס של הדוגמה ורק אז לשדה התמונה כדי למנוע פענוח איטי של כל הקבצים בבת אחת.

from datasets import load_dataset

ds = load_dataset("zh-plus/tiny-imagenet")

הרישיון

המאגר פורסם בלי רישיון מוגדר כלל. במצב כזה אין אישור משפטי להשתמש בתמונות למוצרים מסחריים, ואי אפשר לדעת אילו הגבלות חלות על מודלים שמאומנים עליו. מומלץ להגביל את השימוש לצורכי לימוד ומחקר אקדמי בלבד.

הרישיון המלא ב־Hugging Face ↗