GPT
M

moeFussion

קוד פתוח

LoliRimurucreativeml-openrail-m2023-02-28

  • diffusers
  • art
  • anime
  • text-to-image

המודל הזה מכוון ליצירת איורי אנימה בסגנון מואה, תחום שבו רוב מודלי התמונה הכלליים מתקשים. הוא מיועד למי שמחפש סגנון יפני מובהק ושליטה באמצעות תגיות ייעודיות.

  • 401 GBמשקל הקבצים
  • 36,850הורדות בחודש
  • 295לייקים

מה זה

מדובר במודל ליצירת תמונות מטקסט שהתפתח דרך עשרות גרסאות ומיזוגים שונים, החל מגרסאות SD 2.1 ועד SDXL, וכעת בגרסה 3 המבוססת על Anima v1. המטרה המרכזית שלו היא שיפור של אנטומיה, קומפוזיציה ותווי פנים באיורי אנימה, תוך הפחתה מכוונת של היכולת לייצר תמונות ריאליסטיות כדי לשמור על קו אמנותי דו ממדי מובהק.

הוא עובד היטב ברזולוציות גבוהות ולא שגרתיות, כמו 832 על 1144 או 1536 על 1536 בגרסאות ה־XL, ומבין שילוב של תגיות booru לצד שפה חופשית. הכרטיס מציין שהאיכות עולה ככל שהפרומפט ארוך ומפורט יותר, עם דגש על שמות אמנים בפורמט ספציפי ורגישות לאותיות גדולות וקטנות.

מתאים ל

  • איורי דמויות אנימה

    הוא עבר אימון ומיזוג ממוקד כדי לייצר תווי פנים ואנטומיה מדויקים בסגנון מואה יפני קלאסי.

  • עבודה ברזולוציות אנכיות

    הגרסאות המתקדמות מותאמות מראש לפלטים אנכיים גבוהים כמו 832 על 1144 בלי לעוות את הקומפוזיציה.

  • אימון LoRA ממוקד

    גרסת v1.3 מספקת בסיס גולמי יותר שתוכנן מראש לקלוט היטב התאמות אישיות של דמויות וסגנונות.

איפה זה נופל

הוא לא מתאים בכלל למי שמחפש ריאליזם, היכולת הזו הוסרה ממנו במכוון כדי לחזק את הסגנון הציורי. החיסרון העיקרי הוא התלות שלו בהנדסת פרומפטים מסורבלת. פרומפטים קצרים של פחות מעשר תגיות יניבו תוצאות באיכות נמוכה, וצריך להזין רשימות ארוכות של שלילות כדי להימנע מבעיות אנטומיה או רקעים פשוטים. בנוסף, כל גרסה במאגר דורשת הגדרות דגימה, רזולוציה ומקדמים שונים לחלוטין, מה שמקשה על שילוב יציב בצנרת הפקה.

שאלות
נפוצות

אני באמת צריך להוריד 400 גיגה בייט למחשב?

לא. המאגר כולל היסטוריה של עשרות גרסאות ניסיוניות ישנות, החל מגרסה 0.4 ועד לגרסאות ה־XL. תבחרו רק את קובץ המשקלים הספציפי שאתם רוצים להריץ, כמו גרסה 3.0 העדכנית, ותורידו רק אותו.

איך כותבים לו פרומפט כדי לקבל תוצאה טובה?

פרומפטים קצרים לא עובדים טוב כאן. צריך לשלב שפה חופשית יחד עם תגיות מפורטות של תיאור בגדים, תנוחה ותאורה, לצד פרומפט שלילי מוקפד להסרת פגמים באנטומיה.

למה התמונות ברירת המחדל נראות מרוחות או מפוקסלות?

סביר להניח שלא הגדרתם את הרזולוציה והדוגם הנכונים לגרסה שלקחתם. גרסאות ה־SDXL למשל דורשות הגדרות מפורשות של v-pred, ערכי CFG נמוכים באזור 4 ורזולוציה של 832 על 1144 ומעלה.

איך מריצים

המאגר מכיל 401 גיגה בייט ב־488 קבצים, שכוללים אינספור גרסאות היסטוריות, כך שאין שום סיבה להוריד הכל. אתם צריכים לבחור רק את קובץ המשקלים של הגרסה המבוקשת, כמו v3.0 או אחת מגרסאות ה־XL, ולהריץ אותו מקומית דרך ComfyUI או SwarmUI עם ספריית diffusers.

עבור הגרסאות המתקדמות צריך להגדיר ידנית תצורה של zsnr ו־vpred, דוגם כמו er_sde או Euler, וערכי CFG נמוכים סביב 3 עד 5. אם אין לכם כרטיס מסך מתאים להרצה כבדה כזו או שאתם רק רוצים לבדוק את התוצאות, חלק מהגרסאות זמינות ישירות ברשת דרך פלטפורמת Aipictors.

from diffusers import DiffusionPipeline

pipe = DiffusionPipeline.from_pretrained("LoliRimuru/moeFussion")
img = pipe("a photo").images[0]

הקבצים

488 קבצים במאגר, 401 GB סך הכול. הקישורים מובילים ישירות ל־Hugging Face.

הרישיון

הרישיון הוא creativeml-openrail-m. הוא מתיר שימוש מסחרי ומאפשר להפיץ תוצרים או שינויים של המודל, אבל כולל רשימת הגבלות אתיות על שימושים פוגעניים או לא חוקיים. אם אתם משלבים אותו במוצר, אתם מחויבים לצרף את תנאי הרישיון המקוריים למשתמשי הקצה שלכם.

  • שימוש מסחרי
  • שינוי הקוד
  • מגבלות שימוש ברישיון

הרישיון המלא בעמוד המודל ↗