GPT
F

ffhq-dataset

קוד פתוח

marcosvcc2025-03-19

  • Face
  • FFHQ
  • GAN
  • Restoration
  • Image

שבעים אלף תמונות פנים ברזולוציה גבוהה של 1024x1024 שנאספו מפליקר. זה המאגר הקלאסי שכולם מגיעים אליו כשצריך לאמן או לבחון מודלים גנרטיביים של פרצופים.

  • 55,802הורדות בחודש
  • 20לייקים

מה זה

המאגר מכיל 70,000 תמונות פנים בפורמט PNG ברזולוציה מלאה. התמונות מציגות גיוון בגילאים, מוצא ורקעים, וכוללות אביזרים כמו כובעים ומשקפיים. במקור המאגר נוצר על ידי חוקרי אנבידיה כחלק מהעבודה על StyleGAN, וההעלאה הזו היא מראה שמחלקת את הקבצים לשבע תיקיות נפרדות, מרמת Part1 ועד Part7, עם עשרת אלפים תמונות בכל תיקייה.

התמונות נאספו אוטומטית מפליקר מתוך פוסטים שפורסמו תחת רישיונות מתירניים. לאחר ההורדה, הנתונים עברו יישור וחיתוך אוטומטי באמצעות ספריית dlib, סינון ראשוני באלגוריתמים שונים, ולבסוף סינון אנושי דרך Amazon Mechanical Turk כדי להעיף פסלים, ציורים ותמונות של תמונות.

מתאים ל

  • אימון מודלים גנרטיביים

    אימון רשתות GAN או מודלי דיפוזיה לייצור פנים ברזולוציה גבוהה של 1024x1024.

  • שחזור ושיפור תמונות

    פיתוח מודלים להסרת רעשים, השלמת פרטים חסרים או הגדלת רזולוציה של תמונות פנים פגומות.

  • זיהוי אביזרים ותווי פנים

    בחינת אלגוריתמים על פנים מיושרות שכוללות משקפיים, כובעים ותנאי תאורה שונים.

איפה זה נופל

התמונות נאספו כולן מפליקר, והיוצרים מציינים במפורש שהמאגר יורש את כל ההטיות המובנות של האתר הזה. זה אומר שיש ייצוג יתר לאוכלוסיות מסוימות, להרגלי צילום מערביים ולמצלמות איכותיות. בנוסף, למרות הסינון האנושי ב־Mechanical Turk, מדובר בתמונות שנחתכו אוטומטית לפי תווי פנים ולא בנתונים קליניים מבוקרים.

שאלות
נפוצות

האם מותר להשתמש במאגר לפרויקטים מסחריים?

הרישיון מסומן כ־cc כללי, אך המקור שייך לפרויקט של אנבידיה. יש לבדוק את הקישור לרישיון המקורי בגיטהאב שלהם כדי לוודא אם קיימות הגבלות על שימוש מסחרי במודלים שמאומנים על התמונות.

איך התמונות חתוכות ומיושרות בפנים?

כל התמונות עברו חיתוך ויישור אוטומטי סביב תווי הפנים בעזרת ספריית dlib. הפנים ממורכזות וכל קובץ מגיע בגודל אחיד של 1024 על 1024 פיקסלים בפורמט PNG.

האם יש במאגר טקסט או שמות של המצולמים?

לא. המאגר מכיל קובצי תמונה בלבד שממוספרים רצה בתוך שבע תיקיות, ללא שמות, תוויות טקסט או תיוג של שפות.

איך טוענים

המאגר שוקל לא מעט וכולל מעל שבעים אלף קבצים, כך שהורדה ישירה שלו דורשת מקום בדיסק ורוחב פס יציב. אין צורך באישור גישה מיוחד, הקבצים פתוחים להורדה ישירה דרך הממשק של Hugging Face. המבנה הוא פשוט קובצי PNG ממוספרים בתוך שבע תיקיות בלי קובצי מטא-דאטה מורכבים.

from datasets import load_dataset

ds = load_dataset("marcosv/ffhq-dataset")

הרישיון

הרישיון בעמוד מוגדר כ־cc, והמקור מפנה לקובץ הרישיון המקורי של אנבידיה בגיטהאב. מכיוון שהתמונות נאספו מפליקר תחת רישיונות שונים ומתירניים, צריך לבדוק את תנאי הרישיון המקורי של אנבידיה לפני שמשלבים מודל שאומן עליהן במוצר מסחרי.

הרישיון המלא ב־Hugging Face ↗