GPT
I

improved-flux-prompts

קוד פתוח

k-mktrmit2024-09-26

  • art

המאגר מרכז פרומפטים באנגלית שעברו הרחבה בסינתזה עבור מודל התמונות פלאקס. מי שמפתח כלי יצירה או מאמן מודל שפה לכתיבת תיאורי תמונה ימצא כאן דוגמאות מפורטות במקום ניסוחים קצרים.

  • 374הורדות בחודש
  • 61לייקים

מה זה

הנתונים מבוססים על פרומפטים פופולריים שנאספו מקהילת CivitAI. הצוות לקח את הניסוחים הבסיסיים האלה והעביר אותם שכתוב והרחבה באמצעות מודל השפה Hermes3, תוך שימוש בהנחיית מערכת ייעודית שקיימת במאגר בשם flux_system_message.txt. המטרה היתה להתרחק מהסגנון המקוטע של סטייבל דיפיוז'ן ולהתאים את הטקסט למבנה התיאורי שפלאקס דורש, כולל פרטי תאורה, קומפוזיציה ואווירה.

הקובץ המרכזי מוגש בתצורת JSONL בשם 20240927_flux_improved_prompts_final_cleaned.jsonl, לצד תמונות דוגמה בפורמט webp עם סימני מים של המזהים התואמים. המפרסם ביצע ניקוי שנועד לסלק חזרות מוגזמות על מונחים ולהסיר שמות של מודלי LoRA שהיו במקור, אך הוא מבהיר כי המאגר מוגדר ניסיוני ועדיין עובר עדכונים ואיסוף.

מתאים ל

  • אימון מודל עזר לפרומפטים

    פיין טיונינג למודל שפה קטן שמרחיב בקשות משתמש קצרות לתיאורי תמונה עשירים.

  • הערכת ביצועי מודלי תמונה

    הרצת סדרת בדיקות איכות על פלאקס עם תיאורים מורכבים שכוללים זוויות ותאורה.

  • מאגר דוגמאות לממשק משתמש

    שילוב הצעות השלמה אוטומטית והשראה ליוצרים באפליקציות גרפיקה.

איפה זה נופל

הטקסט כולו באנגלית בלבד, ואין כאן שום ייצוג לפרומפטים בעברית. מעבר לכך, המקור הוא CivitAI שעבר עיבוד סינתטי על ידי Hermes3, כך שההטיות של מודל השפה והתכנים הפופולריים מהקהילה נוכחים בטקסט. המפרסם מציין במפורש שעלול להישאר רעש בדאטה ושהניקוי לא מוחלט, כך שאפשר להיתקל בשאריות ניסוח ישנות של סטייבל דיפיוז'ן. לפני שמשלבים את המאגר באימון למוצר אמיתי, חייבים לבצע סינון נוסף כדי לוודא שאין בו ביטויים לא מתאימים.

שאלות
נפוצות

האם מותר להשתמש בדאטהסט הזה במוצר מסחרי?

כן, הרישיון המוגדר הוא MIT, שמתיר שימוש מסחרי מלא כולל אימון מודלים. צריך רק לשמור על תנאי הייחוס של הרישיון בעת ההפצה.

האם יש במאגר פרומפטים בעברית?

לא, השפה היחידה שמופיעה בנתונים היא אנגלית. מי שצריך עבודה בעברית יצטרך לתרגם את הנתונים או לפנות למקורות אחרים.

איך נאספו ונוצרו הנתונים?

נקודת המוצא היתה פרומפטים מובילים שנאספו מ־CivitAI. לאחר מכן הם הורחבו ועובדו מחדש בעזרת מודל Hermes3 לפי הנחיות שמותאמות לפלאקס, ועברו שלב של ניקוי חזרות.

מה מבנה הנתונים בקובץ?

הקובץ הוא מסוג JSONL, ובו כל שורה מחזיקה רק מזהה בשם id וטקסט בשדה prompt. אין שדות נוספים של דירוגים או קטגוריות.

איך טוענים

טוענים את קובץ ה־JSONL ישירות מהמאגר בספריית datasets או בקריאת שורות פשוטה בפייתון. אין צורך לבקש אישור גישה מוקדם או להמתין למפתח. המבנה מינימליסטי וכולל בסך הכל שני שדות: id שמכיל מזהה ייחודי, ו־prompt עם התיאור המלא באנגלית. גודל האוסף נמצא בטווח שבין עשרת אלפים למאה אלף שורות, כך שלא מדובר בקובץ כבד שדורש משאבי זיכרון חריגים כדי לקרוא אותו.

from datasets import load_dataset

ds = load_dataset("k-mktr/improved-flux-prompts")

הרישיון

המאגר מופץ תחת רישיון MIT. מותר להשתמש בו לצרכים מסחריים, לשנות אותו, לכלול אותו במוצרים סגורים ולאמן עליו מודלים חופשיים או קנייניים, בלי חובה לפתוח את הקוד שלכם. הדרישה היחידה היא לצרף את הודעת זכויות היוצרים ואת נוסח הרישיון המקורי.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש

הרישיון המלא ב־Hugging Face ↗