GPT
P

pixelgpt-24x24-20k

קוד פתוח

unstoniocc-by-4.02026-07-25

  • pixel-art
  • sprites
  • 24x24
  • limited-palette
  • text-to-image

עשרים אלף ספרייטים של פיקסל ארט ברזולוציה מקורית של 24 על 24 פיקסלים עם תיאורים טקסטואליים. המאגר נבנה במיוחד לאימון מודלים זעירים של יצירת תמונה מטקסט או מחקר על טוקניזציה ויזואלית.

  • 1,663הורדות בחודש
  • 69לייקים

מה זה

המאגר כולל 20,000 איורים זעירים של פיקסל ארט, כשכל תמונה מוגבלת לחמישה צבעים בלבד ללא שום הגדלה מלאכותית. מדובר בחלק ציבורי שסונן ואוזן מתוך אוסף רחב יותר של מעל 218 אלף ספרייטים שנמכר בנפרד. הדגימות מחולקות ל־19 משפחות-על ו־133 קטגוריות טקסונומיות, כאשר שיוך הקטגוריות בוצע באמצעות מודל המוטמעות sentence-transformers/all-MiniLM-L6-v2 לצד חוקי סיווג ידניים.

החלוקה הפנימית מוגדרת מראש וכוללת 18,000 רשומות לאימון, 1,000 לולידציה ו־1,000 לבדיקה. החלוקה שומרת על יחס הקטגוריות ומבטיחה שדגימות כמעט זהות יישארו באותו פיצול כדי למנוע דליפת מידע בין הסטים. הפריסה מחדש בוצעה לפי אסטרטגיית שורש ריבועי שמונעת מקטגוריות גדולות להשתלט על כלל הנתונים.

מתאים ל

  • אימון מודלי תמונה זעירים

    פיתוח מודלי text-to-image קטנים ומהירים שרצים על חומרה חלשה ומייצרים גרפיקה למשחקי רטרו.

  • מחקר טוקניזציה ויזואלית

    ניסויי VQ-VAE ומידול אוטורגרסיבי על מרחב תמונה מוגבל ודיסקרטי של 5 צבעים.

  • אחזור תמונה לפי תיאור

    אימון מודלי חיפוש שממפים תיאורי טקסט קצרים לקטגוריות ולספרייטים מתאימים.

איפה זה נופל

ברזולוציה של 24 על 24 פיקסלים ועד חמישה צבעים לתמונה, אי אפשר לייצג פרטים מורכבים או מושגים ויזואליים עשירים. כל התיאורים כתובים באנגלית בלבד ואין במאגר מילה אחת בעברית. הסיווג הטקסונומי הסתמך בחלקו על מודל אוטומטי, ולכן ייתכנו שגיאות שיוך בקטגוריות מסוימות. בנוסף, חלוקת הקטגוריות עברה איזון מלאכותי ואינה מייצגת התפלגות טבעית. היוצרים מזהירים שהסינון אינו מבטיח היעדר מוחלט של דמויות מוגנות בזכויות יוצרים, מותגים או סמלים מסחריים.

שאלות
נפוצות

האם מותר להשתמש בדאטהסט לפרויקט מסחרי?

כן. הרישיון הוא CC-BY-4.0 ומאפשר שימוש מסחרי מלא, כולל אימון מודלים למוצרים סגורים. התנאי היחיד הוא מתן קרדיט ברור ליוצר וציון אם בוצעו שינויים בנתונים.

האם יש תמיכה בעברית?

לא. כל התיאורים הטקסטואליים, התגיות ושמות הקטגוריות כתובים באנגלית בלבד. אם רוצים לאמן מודל שיבין הנחיות בעברית, תצטרכו לתרגם את הטקסטים בעצמכם.

מה ההבדל בין הגרסה הזו לאוסף המלא?

הגרסה הזו מכילה 20,000 דוגמאות שעברו איזון קטגוריות וסינון לשימוש חופשי. האוסף המלא כולל מעל 218,000 ספרייטים, מטא-דאטה מורחב ותוכנת צפייה ייעודית, אך הוא נמכר בנפרד באתר itch.io.

האם התמונות מוגנות בזכויות יוצרים של צד שלישי?

היוצר ביצע סינון ידני ואוטומטי כדי להסיר דמויות מוכרות, מותגים ולוגואים. עם זאת, יש הבהרה מפורשת שהסינון אינו מבטיח ניקיון מלא, כך שחובת הבדיקה המשפטית למוצר סופי חלה עליכם.

איך טוענים

טוענים את הנתונים ישירות דרך ספריית datasets באמצעות הנתיב unstonio/pixelgpt-24x24-20k, בלי צורך באישור גישה או מפתח מיוחד כי המאגר פתוח לחלוטין. אפשר גם למשוך את קובצי ה־Parquet המוכנים מתוך תיקיית data, שמחולקת לקובצי train, validation ו־test.

כל רשומה כוללת את התמונה המקורית בפורמט PNG ללא אובדן נתונים, תיאור טקסטואלי באנגלית, שיוך למשפחה ולקטגוריה בטקסונומיה, ושדה תגיות אופציונלי. בגלל הממדים הקטנים של התמונות, נפח ההורדה והעיבוד קל במיוחד ומתאים גם למכונות פיתוח בסיסיות ללא תשתית חישוב כבדה.

from datasets import load_dataset

ds = load_dataset("unstonio/pixelgpt-24x24-20k")

הרישיון

המאגר מופץ תחת רישיון CC-BY-4.0. מותר להשתמש בו לצרכים מסחריים, לשנות אותו ולאמן עליו מודלים, בתנאי שנותנים ייחוס הולם ליוצר המקורי ומציינים אם נעשו שינויים בנתונים. אין חובת שיתוף זהה על מודלים או תוצרים שפותחו באמצעותו.

  • שימוש מסחרי
  • שינוי הקוד
  • חובת ייחוס

הרישיון המלא ב־Hugging Face ↗