GPT
B

BracingEvoMix

קוד פתוח

sazyou-roukakucreativeml-openrail-m2023-05-31

  • diffusers
  • stable-diffusion
  • text-to-image
  • ja

מיזוג מבוסס Stable Diffusion 1.5 שמתמקד בריאליזם פוטוגרפי של פנים ממזרח אסיה. היוצר בנה אותו מרכיבים מנוקים יחסית כדי להקטין סיכוני זכויות יוצרים בשימוש מסחרי.

  • 7.9 GBמשקל הקבצים
  • 1,860הורדות בחודש
  • 153לייקים

מה זה

מדובר במודל יצירת תמונה מטקסט שנבנה כמיזוג בין מספר מודלים קיימים, ביניהם OpenBra, DreamShaper וגרסאות של EpicRealism. המטרה המרכזית שלו היא לספק פנים מזרח אסייתיות ברמת אמינות גבוהה בלי ליפול לפלסטיק המוגזם של מודלים פופולריים אחרים. היוצר העניק למודל ציון 95 בריאליזם ובגיוון פנים אסיאתיות, לעומת 40 בלבד במראה של יופי לא מציאותי, מה שמראה כוונה ברורה לייצר תוצאות טבעיות.

בגרסה שניה, v2, שופרו היציבות של התאורה, הדיוק באצבעות והיכולת לרנדר רקעים ורזולוציות רחבות. המודל מתמודד יפה עם הנחיות בשפה טבעית באנגלית ומגיב טוב לתיאורים מילוליים של סצנות, אך פיתוח הסדרה נעצר בגרסה זו בעקבות מעבר הקהילה לתשתיות חדשות יותר ומגבלות על חומרי הגלם הזמינים למיזוג.

מתאים ל

  • צילומי תדמית אסייתיים

    מייצר פורטרטים ריאליסטיים של פנים מזרח אסייתיות בלי תחושה של בובת חרסינה.

  • הפקת תמונות מסחרית

    מתאים למוצרים שדורשים שימוש מסחרי מותר עם מינימום תלויות משפטיות בעייתיות.

  • הנחיות בשפה טבעית

    עובד טוב עם משפטים מלאים באנגלית ולא דורש רק רשימות תגיות קצרות.

איפה זה נופל

היוצר מציין במפורש נטייה לחשיפת יתר בלתי רצויה בבגדים, תוצאה ישירה של שילוב מודל עירום מסוים כדי לפצות על פערי למידה של פלג גוף תחתון. בנוסף, ציון האצבעות עומד על 80 בלבד ודיוק תנוחות מורכבות קיבל 75, כך שעדיין תראו עיוותים שמצריכים שימוש בכלים נוספים כמו ControlNet. קיימת גם בעיית זמינות מוגבלת של סוגי לבוש בגלל מחסור בחומרי אימון נקיים.

שאלות
נפוצות

האם המודל בטוח לחלוטין מבעיות זכויות יוצרים בשימוש מסחרי?

היוצר בחר את מרכיבי המיזוג כדי לצמצם דליפות של סטים בעייתיים כמו NovelAI, אך מודה בעצמו שאי אפשר להבטיח ניקיון מוחלט. מבחינת תנאי ההפצה הרשמיים, הוא מסווג תחת Open RAIL-M ומאפשר שימוש מסחרי, אך הסיכון על המשתמש.

אילו מילות שלילה חובה להוסיף בפרומפט כדי לא לקבל תוצאות שבורות?

הכרטיס ממליץ על תוספי שליליות כמו EasyNegative ומילים לדיכוי חשיפת יתר, עיוותי גוף ואיכות ירודה. אם רוצים לקבל רקע חד ולא מטושטש, היוצר ממליץ להוסיף לשלילה במפורש מונחים של עומק שדה וטשטוש.

איך מריצים

המשקל הכולל של הקבצים עומד על 7.9 ג'יגה בייט והוא נשען על ספריית diffusers בתשתית של גרסה 1.5. כדי להריץ אותו מקומית באופן סביר צריך כרטיס מסך עם לפחות שמונה ג'יגה בייט של זיכרון ייעודי, כאשר הגדרת העבודה מחייבת clip skip של שתיים.

עדיף להשתמש בגרסת הבסיס v2 לרוב השימושים, שכן גרסאות כמו Another או Fast מכוונות יותר לתווי פנים גנריים או לסגנון מלוטש ומלאכותי. אם אין לכם חומרה ייעודית מקומית או שאתם בונים שירות שצריך סקייל רחב, כדאי לשקול פריסה על שרת ענן עם שירות מנוהל במקום להחזיק תשתית פרטית.

from diffusers import DiffusionPipeline

pipe = DiffusionPipeline.from_pretrained("sazyou-roukaku/BracingEvoMix")
img = pipe("a photo").images[0]

הרישיון

הרישיון הוא CreativeML Open RAIL-M. מותר להשתמש במודל לצרכים מסחריים, למכור תמונות שנוצרו איתו, לשלב אותו בשירותים בתשלום ולהפיץ מיזוגים שלו ללא חובת מתן קרדיט. עם זאת, חלות עליו ההגבלות הרגילות של הרישיון שאוסרות שימושים פליליים, תחומים רפואיים ויישומים מזיקים מוגדרים.

  • שימוש מסחרי
  • שינוי הקוד
  • מגבלות שימוש ברישיון

הרישיון המלא בעמוד המודל ↗