GPT
E

epic-diffusion

קוד פתוח

johnslegerscreativeml-openrail-m2023-01-03

  • diffusers
  • safetensors
  • stable-diffusion
  • stable-diffusion-diffusers
  • text-to-image

שילוב משקלים שמכוון להחליף את הבסיס המקורי של סטייבל דיפיוז'ן 1.5. מתאים למי שמחפש מגוון סגנונות אמנותיים ותמיכה בתוכן למבוגרים בלי להתעסק באימונים נוספים.

  • 9.4 GBמשקל הקבצים
  • 123הורדות בחודש
  • 131לייקים

מה זה

מדובר במודל תמונה שנוצר ממיזוג של כעשרה מודלים שונים על גבי גרסאות 1.4 ו־1.5. היוצר לקח שמות מוכרים מקהילת הקוד הפתוח כמו Analog Diffusion, Wavy, Openjourney, Samdoesarts, Inkpunk ו־Arcane, וערבב אותם שוב ושוב כדי לקבל תוצאות עקביות במגוון סגנונות בלי לאבד את היכולת הכללית של הרשת.

במקום לאמן שכבות חדשות מאפס או לאסוף דאטה־סט עצמאי, המודל מסתמך כולו על שילובים מכוילים של משקלים קיימים. התוצאה מכוונת לתת מענה כולל לאיור דיגיטלי, פורטרטים, מדע בדיוני ואמנות קונספט, כשהוא כולל מראש תמיכה ביצירת תוכן למבוגרים שלא סונן החוצה.

הגישה הזו נותנת גמישות גדולה בסגנון הוויזואלי, אבל היא לא מביאה איתה מבחני ביצועים כמותיים או שיפור במדדים רשמיים. איכות הפלט תלויה לחלוטין בהנדסת פרומפטים מסורבלת מהדור הישן, עם רשימות אמנים ומונחי תאורה כבדים.

מתאים ל

  • איורי קונספט לדמויות

    משלב סגנונות ציור מגוונים ומתאים לבניית פורטרטים בדיוניים מהירים.

  • הפקת תמונות בסגנון סרטים

    מכיל מיזוגים מובנים כמו Arcane שמתאימים לעיצוב סצנות מאוירות.

  • יצירת תוכן חופשי מצנזורה

    כולל תמיכה מובנית בתכנים למבוגרים ללא חסימות מערכתיות מראש.

איפה זה נופל

הרזולוציה הטבעית שלו נשארה תקועה על 512 על 512 פיקסלים, בדיוק כמו הבסיס שממנו הוא נוצר. ניסיון להוציא תמונות גדולות יותר בלי שלב הגדלה נפרד ייצר עיוותים ופרצופים כפולים. מעבר לזה, המודל דורש דחיפת מילות מפתח עמוסות בשמות של אמנים ומנועי רינדור כדי להגיע לתוצאה טובה, ולא תמצאו פה שום הבנה של שפה טבעית פשוטה.

אותה משפחה

epic-diffusion יצא ב־2 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם המודל מבין הוראות בשפה חופשית ופשוטה?

לא. הוא מבוסס על הדור הישן ודורש רשימות ארוכות של מילות מפתח, שמות של אמנים ומנועים כמו אוקטן כדי להפיק מראה מקצועי. טקסט קצר מדי ייתן בדרך כלל תוצאה גנרית או מטושטשת.

אפשר להריץ אותו ישירות דרך פייתון?

כן, המבנה שלו מותאם לעבודה ישירה עם ספריית diffusers המוכרת. פשוט טוענים את הצינור הרגיל של טקסט לתמונה ומגדירים את הפרמטרים שמופיעים בדוגמאות, כמו עשרים צעדים וסולם שבע.

איך מריצים

הקבצים שוקלים 9.4 גיגה־בייט ומחולקים ל־21 קבצים בספריית diffusers. להרצה מקומית תצטרכו כרטיס מסך עם לפחות שמונה גיגה זיכרון כדי לייצר תמונות בסיסיות של 512 על 512 פיקסלים. ההגדרות המומלצות בכרטיס פשוטות: עשרים צעדים, דוגם Euler a או DPM++ SDE, וערך סולם של שבע.

אם אתם מחזיקים שרת GPU משלכם, ההרצה זולה ומהירה מאוד יחסית למודלים מודרניים. מנגד, אם אין לכם תשתית קיימת ואתם צריכים רק כמה מאות תמונות בודדות, עדיף לפנות לשירותי ענן שמריצים משקלי קהילה לפי קריאה, במקום לתחזק מכונה בשביל מודל ישן מ־2023.

from diffusers import DiffusionPipeline

pipe = DiffusionPipeline.from_pretrained("johnslegers/epic-diffusion")
img = pipe("a photo").images[0]

הרישיון

הרישיון הוא CreativeML OpenRAIL-M. מותר להשתמש בו לצרכים מסחריים ולהפיץ את המשקלים או לתת שירות, כל עוד לא מייצרים תוכן לא חוקי או מזיק לפי ההגבלות המפורטות. אם אתם מעבירים את המודל הלאה למשתמשים שלכם, חובה לצרף עותק של הרישיון המקורי.

  • שימוש מסחרי
  • שינוי הקוד
  • מגבלות שימוש ברישיון

הרישיון המלא בעמוד המודל ↗