GPT
D

dreamshaper-8

קוד פתוח

Lykoncreativeml-openrail-m2023-08-26

  • diffusers
  • safetensors
  • stable-diffusion
  • stable-diffusion-diffusers
  • text-to-image

כוונון עדין פופולרי של SD 1.5 שמנסה לאזן בין איור לאנימציה וריאליזם. הוא נותן פשרה סבירה כשצריך מודל תמונות קל שלא נעול על סגנון בודד.

  • 860Mפרמטרים
  • 7.7 GBמשקל הקבצים
  • 126,789הורדות בחודש
  • 135לייקים

מה זה

מדובר בגרסה השמינית של פרויקט שרץ על בסיס Stable Diffusion 1.5, עם כ־860 מיליון פרמטרים ומשקל קבצים כולל של 7.7 גיגה-בייט. המפתח, Lykon, כיוון את המשקולות כך שלא יינעלו על סגנון אחד בלבד, אלא יתמרנו בין מראה מאויר, אנימה וריאליזם בלי שתצטרכו להחליף מודל כל רגע.

בגודל הזה יש המון מודלים מותאמים, אבל רובם מושכים חזק מדי לצילום מציאותי או לאיורי אנימה מובהקים. המודל הזה מתמקם בדיוק באמצע, כשהמפתח עצמו מעיד שהגרסה הנוכחית משפרת את מה שהתחילו בגרסאות הקודמות, שכללו תמיכה טובה יותר ב־LoRA ושליטה בעיצוב כללי.

מתאים ל

  • איורים דיגיטליים ודמויות

    מתאים כשצריך סגנון אמנותי עשיר שלא נראה כמו צילום רגיל, בזכות האיזון המובנה בגרסה הזו.

  • פיתוח מהיר בזיכרון נמוך

    רץ מצוין על כרטיסי מסך צנועים עם 860 מיליון פרמטרים, בלי להזדקק לחומרת שרתים יקרה.

  • בסיס לעבודה עם LoRA

    המודל כולל שיפורים מכוונים מהגרסאות הקודמות לטעינה ושילוב קל של מתאמי סגנון חיצוניים.

איפה זה נופל

היוצר מציין במפורש שגרסה 8 לא מובילה בריאליזם טהור מול מודלים ייעודיים לתחום, וקשה להוציא ממנה אנימה מדויק בהשוואה למודלים שנבנו רק לזה. כדי לקבל תוצאה ספציפית באיכות גבוהה צריך לדעת לנסח פרומפטים היטב, והוא מוגבל לאנגלית בלבד, כך שעברית לא תעבוד כאן ישירות. בנוסף, בהיותו מבוסס על SD 1.5, יצירת תמונות ברזולוציה גבוהה מהבסיס עלולה לייצר עיוותים.

שאלות
נפוצות

האם המודל מבין פרומפטים בעברית?

לא, המודל אומן על אנגלית בלבד. אם תשלחו לו טקסט בעברית תקבלו תוצאות מרוחות ולא רלוונטיות, ולכן חובה לתרגם את הפרומפט לאנגלית לפני השליחה.

למה להשתמש בזה ולא במודל ריאליסטי ייעודי?

היוצר עצמו ממליץ על מודלים כמו AbsoluteReality אם אתם מחפשים מראה של צילום אמיתי בלבד. המודל הזה מתאים בעיקר למי שרוצה גמישות סגנונית ואיורים עם נופך אמנותי.

איך מריצים

טוענים אותו ישירות דרך ספריית diffusers בפייתון עם torch.float16 ומשתמשים במתזמן מסוג DEISMultistepScheduler, בדיוק לפי הדוגמה שהיוצר מספק. קובץ המשקולות דורש כרטיס מסך עם לפחות 6 עד 8 גיגה-בייט של זיכרון גרפי (VRAM) כדי לייצר תמונה בכ־25 צעדים בלי להיחנק.

אם יש לכם שרת מקומי פשוט או עמדת פיתוח עם כרטיס סביר, קל להריץ אותו עצמאית בלי תלות חיצונית. לעומת זאת, אם אתם בונים שירות שצריך לשרת עשרות משתמשים במקביל ואין לכם תשתית ענן מנוהלת לכך, עדיף להשתמש ב־API קיים במקום לשלם על שרתי GPU פעילים.

from diffusers import DiffusionPipeline

pipe = DiffusionPipeline.from_pretrained("Lykon/dreamshaper-8")
img = pipe("a photo").images[0]

הרישיון

הרישיון הוא CreativeML OpenRAIL-M. מותר להשתמש בו לצרכים מסחריים, לייצר תמונות ולשלב אותן במוצרים, אך חל איסור מפורש להשתמש בו לפגיעה, הטעיה, תכנים פוגעניים או פעולות בלתי חוקיות. אם אתם מפיצים את המשקולות הלאה או מספקים אותו כשירות, עליכם לכלול את תנאי הרישיון המקוריים.

  • שימוש מסחרי
  • שינוי הקוד
  • מגבלות שימוש ברישיון

הרישיון המלא בעמוד המודל ↗