GPT
F

FLUX-Reason-6M

קוד פתוח

LucasFangapache-2.02025-07-03

שישה מיליון תמונות שנוצרו על ידי מודל עם עשרים מיליון תיאורים בשתי שפות. המאגר מיועד למי שרוצה לאמן מודל תמונה להבין לוגיקה מורכבת של קומפוזיציה וטקסט.

  • 6,661הורדות בחודש
  • 100לייקים

מה זה

כל רשומה במאגר כוללת תמונה סינתטית שיוצרה באמצעות המודל FLUX.1-dev, לצד תיאורים מילוליים שמפרקים את שלבי הבנייה שלה. התיאורים מחולקים לשדות באנגלית ובסינית, כולל שדות ייעודיים שמסבירים את ההיגיון והשלבים ביצירה ולא רק את התוכן הסופי. לא מדובר בתמונות שנאספו מהרשת אלא בחומר שיוצר באופן ממוחשב תוך שימוש במשאבי מחשוב של חמש עשרה אלף ימי מעבד A100.

הנתונים מאורגנים סביב שישה ממדי חשיבה מוגדרים. הממדים האלה מכסים דמיון ומושגים מופשטים, ישויות מהעולם האמיתי, רינדור של טקסט כתוב בתוך התמונה, סגנונות אמנותיים, הבעת רגש, וקומפוזיציה מדויקת שמגדירה יחסים מרחביים בין עצמים. בנוסף יש חלוקה לקבצים לפי קטגוריות, כמו תיקיות של אסתטיקה שמפוצלות למאות קובצי משנה.

מתאים ל

  • אימון מודלי יצירת תמונה

    שיפור היכולת של מודלים פתוחים לעקוב אחרי פרומפטים מורכבים ולמקם עצמים במרחב.

  • שיפור רינדור טקסט

    כוונון מודלים על דוגמאות ממוקדות שמלמדות כתיבת אותיות ומילים נכונות בתוך תמונה.

  • מחקר על שרשראות חשיבה

    בדיקת ההשפעה של תיאורי תהליך מפורטים על איכות הפלט הוויזואלי בהשוואה לכיתוב רגיל.

איפה זה נופל

כל התמונות במאגר הן סינתטיות לחלוטין ונוצרו על ידי מודל יחיד, מה שאומר שההטיות, הפגמים הסגנוניים והמגבלות של FLUX.1-dev מובנים עמוק בתוך הדאטה. הטקסטים קיימים רק באנגלית ובסינית, ללא עברית כלל, מה שיקשה על מי שמפתח מודל עם הבנה לשונית מקומית. לפני שמשלבים את המידע באימון כדאי לזכור שהכרטיס אינו מפרט סינון של תוכן פוגעני או זכויות יוצרים על ישויות ספציפיות שמופיעות בתיאורים.

שאלות
נפוצות

האם מותר להשתמש במאגר לפיתוח מוצר מסחרי?

כן, הרישיון המדווח הוא apache-2.0 שמאפשר שימוש מסחרי מלא. צריך רק לכלול את תנאי הרישיון ולתת קרדיט מתאים ליוצרים המקוריים.

האם יש במאגר תמיכה בעברית?

לא. כל התיאורים והפרומפטים נכתבו באנגלית ובסינית בלבד. אם המטרה היא להבין פקודות בעברית, תצטרכו לתרגם את השדות או להוסיף שכבת נתונים מקומית.

מאיפה הגיעו התמונות במאגר?

התמונות לא נאספו מאתרים ברשת אלא סונתזו ישירות על ידי מודל FLUX.1-dev. מדובר בדאטהסט מלאכותי שנוצר כולו במחשוב ייעודי.

איך המאגר בנוי מבחינת קבצים?

הדאטהסט מורכב מ־1,182 קובצי Parquet שמחולקים לפי קבוצות נושאיות, כמו קובצי אסתטיקה. המבנה הזה מאפשר להוריד חלקים נבחרים ולא את כל ששת המיליונים בבת אחת.

איך טוענים

המאגר מכיל 1,182 קבצים ומאורגן בפורמט Parquet, כך שניתן לטעון אותו ישירות דרך ספריית datasets. הגישה חופשית ואין צורך באישור מיוחד. השדות המרכזיים שצריך להתמקד בהם הם שדות התיאור המפורט באנגלית ובסינית שמחזיקים את שרשרת ההסבר של התמונה. בגלל ההיקף הגדול, מומלץ להזרים את הנתונים או להוריד רק חלקים ספציפיים לפי הממדים הרצויים.

from datasets import load_dataset

ds = load_dataset("LucasFang/FLUX-Reason-6M")

הרישיון

המאגר מופץ תחת רישיון apache-2.0. הרישיון מתיר שימוש מסחרי, שינוי והפצה, ומאפשר לאמן מודלים לכל מטרה. התנאי המרכזי הוא מתן קרדיט וייחוס ליוצרים ושמירה על הודעת הרישיון המקורית. אין חובה לשתף תוצרים או מודלים מאומנים תחת אותו הרישיון.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא ב־Hugging Face ↗