GPT
L

lunara-aesthetic

קוד פתוח

moonworksapache-2.02026-01-12

  • art
  • image-generation
  • diffusion
  • aesthetic

מאגר מסודר של אלפיים זוגות תמונה ופרומפט מלוטש עבור מודלי יצירת תמונה. הוא מיועד למי שחוקר היענות לפרומפטים והתאמה אסתטית ומחפש דאטה נקי ומתוייג בלי בעיות זכויות יוצרים.

  • 548הורדות בחודש
  • 88לייקים

מה זה

המאגר מכיל בדיוק 2,000 רשומות שמחברות בין תמונות שנוצרו במודל Lunara לבין פרומפטים שעברו ליטוש ידני בידי בני אדם. התמונות נוצרו במודל דיפוזיה של פחות מעשרה מיליארד פרמטרים שפותח בשיטת CAT של Moonworks, כך שלא מדובר בצילומים אותנטיים שנאספו מהרשת אלא בתוכן סינתטי לחלוטין.

כל רשומה כוללת תמונה ברזולוציה של 1024 על 1024 פיקסלים לצד הפרומפט המילולי שלה ושלושה שדות סיווג מובנים: region לתיוג אסתטי אזורי, category לסגנון אמנותי או מדיום, ו־topic לנושא הכללי של התמונה. היוצרים בחרו בכוונה להתמקד בעקביות, שקיפות ובהירות במקום לנסות לייצר נפח דאטה ענקי.

מתאים ל

  • בדיקת היענות לפרומפטים

    מדידה מבוקרת של יכולת המודל לייצר תמונה שתואמת במדויק את התיאור המילולי המלוטש.

  • אימון התאמה אסתטית

    כוונון עדין של מודלי יצירת תמונה להשגת איכות ויזואלית גבוהה לפי קטגוריות סגנון מוגדרות.

  • התניה לפי סגנון ואזור

    מחקר על שליטה בפלט של מודלי דיפוזיה באמצעות התגיות המובנות של מדיום ואסתטיקה אזורית.

איפה זה נופל

החיסרון המרכזי הוא שמדובר בדאטהסט קטן מאוד, 2,000 דוגמאות בלבד, שכולן תמונות סינתטיות שנוצרו על ידי מודל בודד. אם אתם בונים מודל בסיס רחב הוא פשוט לא יספיק לכם, והוא נושא עמו את ההטיות הוויזואליות והמגבלות של מודל המקור. בנוסף, כל הפרומפטים באנגלית ואין כאן נגיעה לעברית, לא בטקסט ולא בסגנונות מקומיים.

שאלות
נפוצות

האם מותר להשתמש במאגר לפיתוח מוצר מסחרי?

כן, הרישיון הוא apache-2.0 והוא מתיר שימוש מסחרי מלא, כולל אימון מודלים למוצרים פנימיים או חיצוניים. התנאי היחיד הוא שמירה על תנאי הרישיון ומתן קרדיט ליוצרים.

האם יש במאגר פרומפטים בעברית?

לא, כל הפרומפטים נכתבו ונערכו באנגלית בלבד. אם אתם מאמנים מודל שמיועד להבין עברית ישירות, תצטרכו לתרגם את הטקסטים בעצמכם או להסתמך על מאגר אחר.

מה היתרון של המאגר מול סטים ענקיים של תמונות מהרשת?

המאגר הזה מציע תיוג נקי, עקביות בסגנון ופרומפטים ששוכללו ידנית בידי אדם, לצד מקור חוקי ברור. הוא לא מיועד להחליף סטים של מיליוני תמונות, אלא לתת קרקע מבוקרת למחקר ולכוונון ממוקד.

מאיפה התמונות הגיעו במקור?

כל התמונות נוצרו באופן סינתטי על ידי מודל Lunara של Moonworks ולא נלקחו ממאגרי תמונות אמיתיות ברשת. כלומר, אתם מקבלים תוצר של ארכיטקטורת דיפוזיה ספציפית ולא צילומים מהעולם האמיתי.

איך טוענים

טוענים את המאגר ישירות עם ספריית datasets באמצעות הקריאה הרגילה לשם המאגר moonworks/lunara-aesthetic. אין צורך בבקשת גישה מיוחדת, והמאגר פתוח להורדה ושמירה מקומית עם הפקודה save_to_disk. שימו לב שהקבצים כוללים תמונות ברזולוציה מלאה בפורמט PNG, כך שההורדה צורכת נפח אחסון בהתאם. חמשת השדות הזמינים בכל דגימה הם image, prompt, region, category ו־topic.

from datasets import load_dataset

ds = load_dataset("moonworks/lunara-aesthetic")

הרישיון

המאגר מופץ תחת רישיון apache-2.0, שהוא רישיון קוד פתוח מתירני מאוד. מותר להשתמש בדאטהסט לפרויקטים מסחריים ומחקריים כאחד, לשנות אותו, ולאמן עליו מודלים חופשיים או מסחריים בלי חובה לפתוח את הקוד שלכם, כל עוד שומרים על הודעת זכויות היוצרים והייחוס למפרסמים המקוריים.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא ב־Hugging Face ↗