GPT
B

bad_prompt

קוד פתוח

Nerfgun3creativeml-openrail-m2022-11-17

  • stable-diffusion
  • text-to-image
  • image-to-image

המאגר מרכז קובצי הטמעה שלילית לשימוש בתוך Stable Diffusion במקום רשימות מילים ארוכות. הוא פותר עיוותים נפוצים ביצירת תמונות ועוזר במיוחד לקבל ידיים תקינות.

  • 1,975הורדות בחודש
  • 963לייקים

מה זה

למרות שהדף מוגדר תחת קטגוריית דאטהסטים, אין כאן טבלאות נתונים, שורות טקסט רגילות או תמונות לאימון. המאגר מכיל רק חמישה קבצים, וביניהם שני קובצי משקולות מוכנים מסוג פאיטורץ', תמונת הדגמה ומסמך הסבר. הקבצים האלה הם למעשה הטמעות טקסטואליות שליליות שנבנו כדי לאחד שלד שלם של פרומפט שלילי לתוך מילה בודדת שמפעילים בזמן יצירה.

הכרטיס לא מפרט מה בדיוק כלל מערך הנתונים ששימש לאימון ההטמעות, אילו תמונות הוכנסו אליו או איך הן נאספו וסוננו. כל מה שיש כאן הוא שני קבצים נפרדים של התוצר הסופי: הגרסה הראשונה bad_prompt.pt, וגרסה שנייה בשם bad_prompt_version2.pt שנועדה לצמצם את כמות הווקטורים ולמנוע עיוותים כבדים מדי בסגנון האמנותי של התמונה שנוצרת.

מתאים ל

  • שיפור מבנה ידיים

    שילוב ההטמעה בפרומפט השלילי מונע עיוותים ידועים באצבעות ובידיים בזמן יצירת אנשים.

  • קיצור פרומפטים

    החלפת רשימות ארוכות של מילות שלילה במילה אחת שמרכזת את כל הפגמים הנפוצים.

  • הפחתת שינויי סגנון

    עבודה עם גרסה שתיים כדי לקבל תמונות חדות בלי לאבד את הסגנון האמנותי המקורי.

איפה זה נופל

הכרטיס מודה בגלוי שהגרסה הראשונה משנה יותר מדי את הסגנון הכללי של היצירה, והגרסה השנייה עדיין מוגדרת כעבודה בתהליך. מעבר לזה, ההטמעה מטפלת רק בשלד הבסיסי של פגמים כלליים ועיוותי ידיים. אם אתם צריכים לסנן אלמנטים נקודתיים, תצטרכו להמשיך להוסיף מילים שליליות ידנית. המאגר פורסם בנובמבר 2022, לא מציג נתוני אימון שקופים, וכל התיעוד שלו מתנהל באנגלית בלבד.

שאלות
נפוצות

האם מותר להשתמש בזה במוצר מסחרי?

כן, רישיון OpenRAIL-M מאפשר שימוש מסחרי והפצה של המשקולות. עם זאת, אתם מחויבים לגלגל הלאה את מגבלות הרישיון ולהעביר עותק שלו לכל מי שמשתמש במוצר שלכם.

האם יש במאגר טקסטים או תמיכה בעברית?

לא. המאגר כולל חמישה קבצים בלבד, ביניהם קובצי משקולות ותיעוד טכני שנכתב כולו באנגלית. אין פה נתונים טקסטואליים או התייחסות לשפות אחרות.

מאיפה נאספו הנתונים שלפיהם נוצרה ההטמעה?

היוצר לא שיתף פרטים על התמונות או המילים ששימשו לאימון. ידוע רק שהמטרה הייתה ללכוד שלד בסיסי של מאפיינים שליליים כדי לקבל תוצאות ברזולוציה טובה ולתקן ידיים.

למה הדף הזה מופיע בתור דאטהסט?

מדובר בקובצי מודל והטמעה שהועלו לקטגוריה הלא נכונה בהאגינג פייס. מי שמחפש קובצי נתונים לאימון מאפס לא ימצא כאן רשומות, אלא משקולות מוכנות לשימוש במחולל תמונות.

איך טוענים

אין כאן טעינה דרך ספריית הדאטהסטים הרגילה של פייתון. פשוט מורידים את אחד מקובצי ה־pt ישירות מהמאגר, ושמים אותו בתיקיית ההטמעות של ממשק סטייבל דיפיוז'ן. אין צורך באישור גישה או בהרשמה מיוחדת. בזמן היצירה רושמים את שם הקובץ בתוך הפרומפט השלילי בלבד, כאשר היוצר ממליץ לתת לו משקל של 0.8 כדי למנוע השפעה אגרסיבית מדי על התמונה.

from datasets import load_dataset

ds = load_dataset("Nerfgun3/bad_prompt")

הרישיון

הרישיון הוא CreativeML OpenRAIL-M. מותר להשתמש בהטמעה באופן מסחרי, לשלב אותה בשירות ולשתף את המשקולות, אך חובה לצרף עותק של הרישיון ואת אותן הגבלות שימוש לכל משתמשי הקצה שלכם. הרישיון אוסר יצירת תכנים בלתי חוקיים או מזיקים, והיוצר אינו דורש זכויות על התוצרים שנוצרים באמצעותו.

  • שימוש מסחרי
  • שינוי הקוד
  • מגבלות שימוש ברישיון

הרישיון המלא ב־Hugging Face ↗