GPT
D

dreamshaper-7

קוד פתוח

Lykoncreativeml-openrail-m2023-08-26

  • diffusers
  • safetensors
  • stable-diffusion
  • stable-diffusion-diffusers
  • text-to-image

גרסת כוונון עדין פופולרית על בסיס סטייבל דיפיוז'ן 1.5 שמתמקדת בסגנון אמנותי, ריאליזם וגמישות. היא מיועדת למי שמחפש פילוח ויזואלי מאוזן עם תמיכה טובה בהרחבות.

  • 860Mפרמטרים
  • 7.7 GBמשקל הקבצים
  • 892,057הורדות בחודש
  • 64לייקים

מה זה

מדובר במודל יצירת תמונה מטקסט שנבנה ככוונון על גבי RunwayML Stable Diffusion v1.5 ומכיל כ־860 מיליון פרמטרים. המטרה של גרסה 7 ספציפית היא לשפר את התמיכה במודולי LoRA, לייצר תוצאות ריאליסטיות יותר מקודמותיה, וגם לטפל טוב יותר בתכני NSFW בלי לשבור את המבנה של התמונה. הוא תופס עמדת ביניים בין סגנון אמנותי מאויר לבין תמונות שנראות אמיתיות, כשהוא נשען על ספריית diffusers הסטנדרטית בפייתון.

בניגוד לגרסה 5 שהתמקדה לחלוטין בפוטו-ריאליזם או גרסה 4 שנטתה חזק לכיוון אנימה ותגיות booru, כאן הדגש הוא על גמישות בעיצוב סצנות מורכבות. המודל מחזיק קרוב לתשע מאות אלף הורדות, מה שמעיד על היציבות שלו מול קהילת המפתחים שמשתמשת במשקלי 1.5. הוא לא מתיימר להביא תוצאות ברמת צילום טהור, אבל הוא נותן מענה חזק למי שרוצה ציור דיגיטלי מלוטש או פורטרטים בעלי מראה ריאליסטי בלי להסתבך בהגדרות מורכבות.

מתאים ל

  • איור דמויות לקונספט ארט

    אידיאלי לעיצוב פורטרטים ודמויות פנטזיה או מד"ב עם שליטה טובה בתאורה ובמרקמים.

  • שילוב LoRA ספציפי

    גרסה 7 הותאמה במיוחד לקליטת מתאמי משקל נוספים בלי לפגוע באיכות התמונה הכוללת.

  • גרפיקה למשחקים

    מתאים ליצירת נכסים ויזואליים מהירים שנשענים על סגנון חצי-ריאליסטי עשיר בפרטים.

איפה זה נופל

היוצר מציין בפירוש שאם המטרה העיקרית היא ריאליזם מוחלט שנראה כמו מצלמה אמיתית, עדיף להשתמש במודלים ייעודיים כמו AbsoluteReality ולא בגרסה הזו. הוא גם לא ממוקד כולו באנימה כמו גרסאות קודמות, כך שסגנונות קיצוניים דורשים דיוק בפרומפטים או הוספת LoRA מתאים.

המודל מבין רק אנגלית, כך שאי אפשר להזין לו פרומפטים בעברית ישירות. בנוסף, הוא נשען על הארכיטקטורה הישנה של 1.5, מה שאומר שרזולוציות גבוהות מאוד ללא שלב הגדלה נוסף עלולות לייצר עיוותים באנטומיה ופרטים כפולים.

שאלות
נפוצות

האם המודל יודע לקרוא עברית?

לא. המודל אומן על טקסט באנגלית בלבד. אם תזינו מילים בעברית תקבלו תוצאות אקראיות, ולכן יש לתרגם כל הנחיה לאנגלית לפני השליחה אליו.

כמה זיכרון וידאו צריך כדי לעבוד איתו בצורה סבירה?

טעינה של המודל בדיוק של 16 ביט דורשת לפחות 6 עד 8 גיגה-בייט של זיכרון גרפי ייעודי. זה מאפשר להפיק תמונות ברזולוציות הבסיס בלי לקבל שגיאות חוסר זיכרון.

איך מריצים

כדי להריץ אותו מקומית צריך כרטיס מסך של אנבידיה עם תמיכה ב־CUDA. בקוד הרשמי טוענים את המודל בפורמט fp16 דרך ספריית diffusers עם דוגם DEISMultistepScheduler, שמייצר תמונה טובה ב־25 צעדים בלבד. זה אומר שכרטיס עם 8GB זיכרון גרפי יספיק לעבודה שוטפת.

אם אין לכם חומרה ייעודית מקומית או שאתם בונים שירות שדורש מענה לעשרות משתמשים במקביל, שווה לשקול הרצה דרך שרתי ענן או API חיצוני. המודל מגיע עם קבצים בנפח כולל של 7.7 גיגה-בייט, כך שהורדה ראשונית וטעינה לוקחות קצת זמן.

from diffusers import DiffusionPipeline

pipe = DiffusionPipeline.from_pretrained("Lykon/dreamshaper-7")
img = pipe("a photo").images[0]

הרישיון

הרישיון הוא creativeml-openrail-m. הוא מתיר שימוש מסחרי, אבל מטיל הגבלות ברורות נגד יצירת תוכן מזיק, פוגעני, או שימוש בתחומים כמו מעקב בלתי חוקי ואבחון רפואי אוטומטי. אם אתם משלבים אותו במוצר מסחרי, חובה לכלול את תנאי הרישיון ולהגביל את המשתמשים מאותם שימושים אסורים.

  • שימוש מסחרי
  • שינוי הקוד
  • מגבלות שימוש ברישיון

הרישיון המלא בעמוד המודל ↗