GPT
A

Analog-Diffusion

קוד פתוח

wavymuldercreativeml-openrail-m2022-12-10

  • diffusers
  • stable-diffusion
  • stable-diffusion-diffusers
  • text-to-image
  • safetensors

המודל מפיק תמונות במראה של צילום אנלוגי אמיתי על בסיס טקסט באנגלית. אם נמאס לכם מהמראה הדיגיטלי המלוטש של מודלים רגילים, הוא נותן גרעיניות ואופי של פילם בלי עריכה ידנית.

  • 9.1 GBמשקל הקבצים
  • 569הורדות בחודש
  • 879לייקים

מה זה

מדובר באימון Dreambooth שיושב על בסיס סטייבל דיפיוז'ן 1.5, יחד עם VAE מובנה. המפתח אימן אותו על סט תמונות של צילום אנלוגי מגוון כדי לחקות במדויק את המאפיינים של סרטי צילום ישנים, כמו עומק שדה רך, צבעוניות מסוימת וטקסטורה גרעינית.

כדי לקבל את הסגנון הזה צריך להוסיף לפרומפט את מילת ההפעלה analog style. בניגוד למודלים גנריים מאותה תקופה שדרשו פרומפטים ארוכים ומסורבלים כדי לברוח מרינדור פלסטיקי, כאן הסגנון צרוב ישירות במשקולות, כך שמקבלים תוצאה של צילום אמיתי במאמץ קטן בהרבה.

מתאים ל

  • תמונות קונספט לסרטים

    יצירת סצנות עם אווירה של סרט ישן וצבעים של פילם בלי צורך בפילטרים כבדים.

  • פורטרטים אומנותיים

    הפקת דמויות שנראות כאילו צולמו במצלמת 35 מ"מ, עם מרקם עור טבעי ולא מרונדר.

  • עיצוב עטיפות תקליטים

    הפקת דימויים וינטג'יים מהירים לפרויקטים מוזיקליים או גרפיקה שמחפשת נוסטלגיה.

איפה זה נופל

המודל סובל מנטייה חזקה לייצר תכנים מיניים ועירום, למרות שהיוצר מציין שמאגר האימון המקורי לא כלל חומרים כאלה. תצטרכו להוסיף את המילה naked לפרומפט השלילי באופן קבוע כדי לא להיתקל בהפתעות לא נעימות.

בנוסף, ברירת המחדל נוטה לפעמים לטשטוש יתר ולערפול. המפתח ממליץ להכניס blur ו־haze לפרומפט השלילי כדי לחדד את התמונה, אבל זה פוגע ישירות באפקט האנלוגי ומחזיר את המראה הדיגיטלי. עברית הוא לא מבין בכלל, תצטרכו לכתוב רק באנגלית.

שאלות
נפוצות

איך גורמים למודל לייצר את הסגנון האנלוגי?

חובה לכלול בתוך הפרומפט את הביטוי analog style. בלי צמד המילים הזה תקבלו פלט רגיל למדי שנראה כמו הבסיס של גרסה 1.5.

איך מונעים מהתמונות לצאת מטושטשות מדי?

מכניסים לשלילי מילים כמו blur ו־haze. קחו בחשבון שזה הופך את התמונה לחדה יותר, אבל מוריד קצת מהאופי של סרט הצילום.

איך מריצים

המשקלים שוקלים 9.1 גיגה בייט ומגיעים כקובץ ckpt או דרך ספריית diffusers, כך שאפשר לטעון אותם ישר לסקריפט פייתון או לממשקים מוכרים. בשביל להריץ אותו מקומית בנוחות תצטרכו כרטיס מסך עם לפחות שמונה גיגה זיכרון וידאו, בדומה למודלי 1.5 סטנדרטיים.

אם אין לכם חומרה ייעודית או שסתם בא לכם לבדוק אותו לפני שמורידים קבצים כבדים, יש לו הדגמה חיה במרחב של Gradio ברשת. לשימוש קבוע או לפיתוח מוצר עדיף כמובן להוריד את המשקולות ולהריץ על שרת משלכם.

from diffusers import DiffusionPipeline

pipe = DiffusionPipeline.from_pretrained("wavymulder/Analog-Diffusion")
img = pipe("a photo").images[0]

הרישיון

הרישיון הוא creativeml-openrail-m, שזה הרישיון המקורי של סטייבל דיפיוז'ן. הוא מתיר שימוש מסחרי חופשי והפצה, אבל מחייב אתכם לא להשתמש בו למטרות מזיקות, לא לפגוע באנשים ולא להפיק חומרים לא חוקיים. אם אתם משלבים אותו באפליקציה, חובה לצרף את תנאי הרישיון המקוריים למשתמשי הקצה.

  • שימוש מסחרי
  • שינוי הקוד
  • מגבלות שימוש ברישיון

הרישיון המלא בעמוד המודל ↗