GPT
E

EimisAnimeDiffusion_1.0v

קוד פתוח

eimisscreativeml-openrail-m2022-11-15

  • diffusers
  • safetensors
  • stable-diffusion
  • text-to-image
  • image-to-image

מודל תמונה שמיועד כולו ליצירת איורי אנימה ונופים מפורטים. הוא מתאים למי שמחפש סגנון ציור יפני מובהק ולא מקבל תוצאה מספיק חדה ממודלים כלליים.

  • 860Mפרמטרים
  • 12.2 GBמשקל הקבצים
  • 118הורדות בחודש
  • 399לייקים

מה זה

מדובר במודל דיפוזיה של כ־860 מיליון פרמטרים שאומן ישירות על תמונות אנימה באיכות גבוהה. הוא מתמקד ביצירת דמויות בסגנון יפני טיפוסי ונופים צבעוניים ברזולוציות מגוונות, ועובד ישירות דרך ספריית diffusers המוכרת בפייתון.

במקום לנסות לייצר הכל כמו מודלי בסיס רגילים, הוא מכוון לסגנון אומנותי בודד. אין פה מבחני ביצועים מספריים או ציונים רשמיים, אבל הדוגמאות מראות שהוא יודע להוציא קווים חדים, טקסטורות מורכבות ותאורה חזקה כבר בעשרים או שלושים וחמישה צעדים, בתנאי שמזינים לו פרומפטים ארוכים ומפורטים שנבנו במיוחד לסגנון הזה.

מתאים ל

  • איורי דמויות אנימה

    הוא מיועד בדיוק לסגנון הזה ומייצר שיער, עיניים ובגדים מפורטים.

  • רקעים ונופים מצוירים

    מתאים לבניית נופי פנטזיה, טירות וטבע בסגנון סדרות אנימציה.

  • שיפור תמונות ב־img2img

    לפי הכרטיס הוא עובד היטב בהוספת שכבות של פרטים על סקיצות קיימות.

איפה זה נופל

היוצר עצמו מודה שהמודל מתקשה לעיתים בדיוק של צבעים, וממליץ לחזק מילים בעזרת סוגריים כדי שההנחיה תתפוס. בנוסף, הדוגמאות דורשות רשימה ארוכה של מילות שלילה כדי להימנע מאנטומיה שבורה, עיוותים באצבעות ואיברים מיותרים. הוא תומך באנגלית בלבד ולא יבין עברית.

שאלות
נפוצות

האם המודל מבין הנחיות בעברית?

לא. המודל אומן על אנגלית בלבד, ולכן צריך לכתוב את כל התיאורים ומילות השלילה באנגלית כדי לקבל תוצאות הגיוניות.

איך אפשר לנסות אותו בלי להוריד 12 גיגה למחשב?

בעמוד של המודל יש קישור ישיר לממשק Gradio שרץ ב־Spaces של Hugging Face. אפשר להיכנס לשם, להזין פרומפטים ולראות את התוצאות בדפדפן בלי שום התקנה מקומית.

למה כדאי לשים לב לפני שמורידים דווקא את הגרסה הזו?

היוצר פרסם גרסה שנייה של המודל בקישור ייעודי בראש העמוד. אם אתם מתכוונים להשקיע זמן בהורדה והרצה, הגיוני לבדוק אם הגרסה החדשה יותר מתאימה לצרכים שלכם.

איך מריצים

בפועל מריצים אותו דרך diffusers או ממשק Gradio קיים. המודל שוקל 12.2 גיגה־בייט שמחולקים בין עשרים ושניים קבצים, כך שצריך כרטיס מסך מקומי עם זיכרון סביר כדי לטעון אותו ולייצר תמונות ברזולוציה של סביב 768 פיקסלים בלי לקרוס.

המפתח כבר שחרר גרסה שנייה בעמוד, כך שאם אתם מתכננים להקים שרת עצמאי כדאי לבדוק אותה קודם. לניסויים ראשונים או לבדיקת התאמה לפרויקט, עדיף להשתמש בספייס הקיים ב־Gradio במקום להוריד את כל הנפח הזה למחשב שלכם.

from diffusers import DiffusionPipeline

pipe = DiffusionPipeline.from_pretrained("eimiss/EimisAnimeDiffusion_1.0v")
img = pipe("a photo").images[0]

הרישיון

הרישיון הוא CreativeML OpenRAIL-M שמתיר שימוש מסחרי והפצה של המשקלים, כולל שילוב במוצר או שירות. עם זאת, חובה לצרף את תנאי הרישיון המקוריים למשתמשי הקצה, ואסור להשתמש בו ליצירת תכנים בלתי חוקיים או מזיקים לפי ההגדרות של הרישיון.

  • שימוש מסחרי
  • שינוי הקוד
  • מגבלות שימוש ברישיון

הרישיון המלא בעמוד המודל ↗