GPT
D

distilgpt2-stable-diffusion-v2

קוד פתוח

FredZhang7creativeml-openrail-m2022-12-10

  • transformers
  • pytorch
  • safetensors
  • gpt2
  • text-generation

המודל הזה לוקח רעיון קצר ומנפח אותו לפרומפט מפורט לתמונות. הוא שוקל גרושים ורץ מהר מאוד גם על מעבדים פשוטים.

  • 88Mפרמטרים
  • 1,024טוקנים בהקשר
  • 638 MBמשקל הקבצים
  • 2,054הורדות בחודש

מה זה

מדובר במודל טקסט זעיר של 88 מיליון פרמטרים שמבוסס על distilgpt2 ואומן על קרוב לשניים וחצי מיליון פרומפטים של סטייבל דיפיוז'ן. הוא לא נועד לנהל שיחות, לכתוב קוד או לענות על שאלות. התפקיד היחיד שלו הוא לקבל התחלה של תיאור תמונה ולהמשיך אותה בסגנון של תגיות ומילות תיאור מקובלות במודלי תמונה.

היוצר המשיך לאמן פה צ'קפוינט קודם שלו בעוד 4.27 מיליון צעדים, וניקה מהדאטה פרומפטים קצרים מ־15 תווים, כפילויות, סימני פיסוק אקראיים ותוכן למבוגרים עם ציון מעל חצי. בהשוואה למודלים דומים שמבוססים על GPT2 מלא, הוא דורש 40 אחוז פחות זיכרון ומקום בדיסק, ומבצע חישוב קדימה ב־50 אחוז פחות זמן.

מתאים ל

  • השלמת פרומפטים אוטומטית

    הרחבת מילות מפתח קצרות של משתמשים לתיאור עשיר ומפורט למחוללי תמונות.

  • מחולל רעיונות פנימי

    הרצה מקומית ומהירה ברקע שמציעה וריאציות לסגנונות תמונה בלי לצרוך משאבי GPU.

  • העשרת קלטים מקומית

    שילוב בתוך יישום קצה קל משקל שצריך להכין טקסט למודל תמונה בלי תלות ברשת.

איפה זה נופל

הוא יודע לייצר רק פרומפטים, ובאנגלית בלבד. אם תתנו לו קלט מחוץ לתחום תיאורי התמונות, תקבלו ג'יבריש או המשכים חסרי היגיון לחלוטין. הוא אומן ב־2022 על סגנון כתיבה שהתאים לגרסאות המוקדמות של סטייבל דיפיוז'ן, מה שאומר ערימות של תגיות מופרדות בפסיקים. מודלי תמונה מודרניים יותר מעדיפים היום שפה טבעית, ושם הסגנון הזה פחות שימושי. בנוסף, למרות סינון הנתונים, תמיד ייתכנו הטיות או מונחים לא רצויים שחמקו מהבדיקה.

שאלות
נפוצות

האם אני חייב כרטיס מסך כדי להריץ את המודל הזה?

לא. עם 88 מיליון פרמטרים ומשקל של כמה מאות מגה בייטים, המודל הזה עובד בקלות על מעבד רגיל של מחשב נייד או שרת בסיסי בלי שום האצה גרפית.

איך מחזירים את הפסיקים בין התגיות בפלט?

כרטיס המודל מסביר שחיפוש ניגודי מבטל את הפסיקים. כדי לקבל אותם בחזרה, מגדירים דגימה רגילה עם פרמטרים של טמפרטורה, ענישה על חזרתיות ומסירים את penalty_alpha מהקריאה למודל.

איך מריצים

במשקל של 638 מגה בייט, אתם מריצים אותו ישירות דרך ספריית transformers בלי לחשוב פעמיים על חומרה. הוא ירוץ חלק על כל מעבד מודרני בלי כרטיס מסך ייעודי, ותופס מעט מאוד זיכרון עבודה. אין שום הצדקה כלכלית לשלם על API חיצוני בשביל משימה קטנה כזו, פשוט טוענים אותו לזיכרון מקומית ומייצרים.

בזמן ההרצה צריך לשים לב לפרמטרים של הגנרציה. הכרטיס מציג שימוש בחיפוש ניגודי, שמייצר רצף מילים ללא פסיקים, וכדי לקבל בחזרה מבנה פרומפטים מופרד בפסיקים צריך לעבור לדגימה עם טמפרטורה, חזרתיות ו־top_k בלי penalty_alpha.

from transformers import pipeline

pipe = pipeline("text-generation", model="FredZhang7/distilgpt2-stable-diffusion-v2")
print(pipe("שלום"))

הרישיון

הרישיון הוא creativeml-openrail-m, אותו רישיון שמלווה את סטייבל דיפיוז'ן המקורית. הוא מתיר שימוש מסחרי והפצה, אבל מחייב אתכם לעמוד בהגבלות שימוש ספציפיות כמו איסור על יצירת תוכן פוגעני, פעילות לא חוקית, או שימושים רפואיים ומשפטיים מסוכנים. אם אתם משלבים אותו במוצר, אתם חייבים לצרף את תנאי הרישיון ולהחיל את ההגבלות האלה גם על המשתמשים שלכם.

  • שימוש מסחרי
  • שינוי הקוד
  • מגבלות שימוש ברישיון

הרישיון המלא בעמוד המודל ↗