GPT
M

MegaStyle-1.4M

קוד פתוח

tencentother2026-04-20

  • style transfer
  • text-to-image generation

מאגר ענק של תמונות מסוגננות וממופות לפי סגנונות מוגדרים. הוא מיועד למי שרוצה לאמן מודלים של יצירת תמונה מטקסט תוך שמירה על עקביות סגנונית גבוהה.

  • 1,007הורדות בחודש
  • 53לייקים

מה זה

הנתונים מחולקים לשתי גרסאות שונות במאגר. הגרסה הראשונה כוללת מיליון וארבע מאות אלף תמונות, שנוצרו משילוב של מאה ושבעים אלף פרומפטים של סגנון יחד עם ארבע מאות אלף פרומפטים של תוכן. התמונות סונתזו באמצעות המודל Qwen-Image כדי להבטיח התאמה ועקביות בתוך כל סגנון, תוך שמירה על גיוון רחב של סגנונות מפורטים.

הגרסה השנייה, שנקראת MegaStyle++-8M, מרחיבה את המאגר לשמונה מיליון תמונות. היא בנויה על הגדרה היררכית של סגנונות, ומכילה מאה וחמישים אלף זהויות סגנון כוללות לצד מיליון פרומפטים מפורטים של סגנונות שונים. מטרת ההרחבה הזו היא להגדיל את הכיסוי ואת השונות של הסגנונות בתמונות שנוצרות.

מתאים ל

  • אימון text-to-image

    לימוד מודלים לייצר תמונות תוך שליטה מדויקת בסגנון האמנותי לפי פרומפט.

  • העברת סגנון עקבית

    בניית מודלים שמסוגלים להחיל סגנון אחיד על תכנים שונים ומגוונים.

  • מחקר על סגנונות סינתטיים

    ניתוח האופן שבו מודלי שפה ותמונה ממפים היררכיות של סגנונות שונים.

איפה זה נופל

כל התמונות במאגר הן תמונות סינתטיות שנוצרו על ידי Qwen-Image, מה שאומר שהן יורשות את כל ההטיות והמגבלות הוויזואליות של אותו מודל בסיס. הטקסטים והפרומפטים קיימים באנגלית בלבד. אם המוצר שלכם צריך להתמודד עם הנחיות בעברית או להכיר סגנונות מקומיים, הנתונים כאן לא יעזרו לכם ותצטרכו לבצע התאמות חיצוניות.

שאלות
נפוצות

האם המאגר כולל תוכן או שמות סגנונות בעברית?

לא. כל הפרומפטים והנתונים במאגר מוגדרים באנגלית בלבד. אם יש לכם צורך בעיבוד סגנונות בשפה העברית, תצטרכו לתרגם או לאסוף מידע בנפרד.

איך נוצרו התמונות במאגר?

התמונות אינן תמונות אמיתיות שנאספו מהרשת. הן נוצרו באופן סינתטי באמצעות Qwen-Image משילוב של מאות אלפי פרומפטים של תוכן ופרומפטים של סגנון.

מותר להשתמש בדאטהסט לפיתוח מודל מסחרי?

הרישיון אינו רישיון קוד פתוח רגיל אלא רישיון פרטי שמפורט בקובץ LICENSE.txt במאגר. חובה לבדוק את התנאים המשפטיים של טנסנט בקובץ הזה לפני כל שימוש שאינו מחקרי טהור.

מה ההבדל בין גרסת 1.4M לגרסת 8M?

גרסת 1.4M מכילה 1.4 מיליון תמונות ומתמקדת במיפוי סגנונות בסיסי. גרסת 8M גדולה בהרבה, מבוססת על מבנה היררכי ומכסה שמונה מיליון תמונות עם גיוון סגנוני עמוק יותר.

איך טוענים

המאגר מחולק לקבצי Parquet ממוספרים, לצד קבצי מטא-דאטה כמו metadata.csv וקובץ style_indices.pkl. אין צורך לבקש אישור גישה מיוחד כדי להוריד אותו, אבל מדובר ביותר ממאה קבצים שמכילים מיליוני רשומות, כך שחובה להכין מראש נפח אחסון גדול ותהליך טעינה שתומך בנתונים בהיקף כזה.

from datasets import load_dataset

ds = load_dataset("tencent/MegaStyle-1.4M")

הרישיון

הרישיון מוגדר כ־other ומפנה לקובץ LICENSE.txt ייעודי בתוך המאגר. הוא אינו משתמש ברישיון קוד פתוח סטנדרטי מוכר. לפני שאתם מאמנים מודל למטרות מסחריות, אתם חייבים לפתוח את הקובץ ולקרוא במדויק מה טנסנט מתירה לעשות עם התמונות והמשקלים הנגזרים מהן.

הרישיון המלא ב־Hugging Face ↗