GPT
A

anime-kawai-diffusion

קוד פתוח

Ojimicreativeml-openrail-m2023-02-09

  • diffusers
  • safetensors
  • text-to-image
  • anime
  • pytorch

מודל תמונה שמיועד כולו ליצירת איורי אנימה מבוססי תגיות בסגנון קו נוקשה. הוא יתאים למי שמחפש אסתטיקה של דמויות מצוירות בלי להסתבך עם פרומפטים מורכבים.

  • 860Mפרמטרים
  • 27.9 GBמשקל הקבצים
  • 849הורדות בחודש
  • 160לייקים

מה זה

מדובר בכיוונון של סטייבל דיפיוז'ן שמכוון ספציפית לסגנון אנימה יפני, עם כמעט 860 מיליון פרמטרים בחלק המרכזי שלו. היוצר השתמש בתמונות ממודלים כמו Novel AI ו־Abyss Orange, ואימן אותו לעבוד מול תגיות מובנות ממאגרי Danbooru. במקום לכתוב תיאורים ציוריים ארוכים, הוא מגיב ישירות לרשימות של מאפיינים פיזיים, בגדים ותנוחות.

התוצאה נותנת מראה מצויר מאוד עם קווים חדים ולא סגנון רך או ריאליסטי. ההגדרות המומלצות להרצה שלו הן סקייל של 7.5 עם 28 צעדים, ודילוג קליפ של 2, מה שמראה שהוא מכויל להגיב חזק לתגיות בודדות ולא לפסקאות טקסט חופשי.

מתאים ל

  • איור דמויות לקונספט ארט

    יצירה מהירה של סקיצות לדמויות אנימה לפי מאפיינים מוגדרים מראש כמו צבע שיער, ביגוד ותנוחה.

  • ייצור נכסים למשחקי רשת

    הפקה של פורטרטים ואיורים גרפיים למשחקים עצמאיים בסגנון ויז'ואל נובל או משחקי תפקידים.

  • בדיקת מיזוג מודלים מקומי

    בסיס נוח למיזוג עם מודלי ציור אחרים כדי להקשיח קווי מתאר של דמויות מצוירות.

איפה זה נופל

המודל סובל מבעיות אנטומיה מוכרות כמו עיוותים באצבעות וידיים עם שש אצבעות, וטשטוש בפרטים עדינים. הוא מבין רק אנגלית ורק תגיות קצרות, כך שפרומפטים ארוכים בעברית או טקסט תיאורי פשוט ישברו את התוצאה. בנוסף, מאגר האימון כולל תוכן למבוגרים, ולכן בלי חסימה ידנית של מילים שליליות בפרומפט הוא עלול לפלוט תמונות לא הולמות.

שאלות
נפוצות

אפשר לכתוב למודל פרומפטים בעברית?

לא. המודל אומן על אנגלית בלבד וספציפית על תגיות מעולם האנימה. אם תכתבו בעברית הוא יחזיר תוצאות מקולקלות, ולכן חובה לתרגם את הבקשה לתגיות באנגלית לפני השליחה.

למה המאגר שוקל כמעט 28 גיגהבייט?

היוצר העלה למאגר 29 קבצים שונים, שכוללים כנראה שמירות של שלבי אימון שונים ופורמטים כפולים. בשביל להריץ תמונות בפועל לא מורידים את כל התיקייה, אלא טוענים רק את המשקולות שנחוצות לפייפליין שלכם.

איך מריצים

המודל רץ ישירות דרך ספריית diffusers בפייתון עם מאיץ גרפי של אנבידיה. למרות שמשקל הקבצים הכולל במאגר מגיע לכמעט 28 גיגהבייט בגלל שלל גרסאות ומשקלים שנשמרו בו, בזמן ריצה רגיל מחזיקים בזיכרון רק את המשקולות הרלוונטיות, כך שכרטיס מסך עם שמונה גיגהבייט זיכרון יספיק פה בלי בעיה.

אם אתם רוצים רק לבדוק כמה תמונות ולא להחזיק שרת דולק, עדיף לפנות לנקודת קצה שמארחת אותו לפי דרישה. להוריד עשרות גיגהבייט של קבצים מקומיים שווה רק אם אתם בונים שרשרת ייצור מקומית או ממשק עבודה קבוע.

from diffusers import DiffusionPipeline

pipe = DiffusionPipeline.from_pretrained("Ojimi/anime-kawai-diffusion")
img = pipe("a photo").images[0]

הרישיון

הרישיון הוא CreativeML OpenRAIL-M שמתיר שימוש מסחרי, שינוי של המשקולות ומיזוג עם מודלים אחרים, בתנאי שאתם נותנים קרדיט ליוצר. התמונות שנוצרות שייכות לכם, אבל הרישיון אוסר שימוש למטרות פוגעניות או לא חוקיות, ומחייב אתכם לעמוד ברגולציה המקומית לגבי תוכן בוגר.

  • שימוש מסחרי
  • שינוי הקוד
  • מגבלות שימוש ברישיון

הרישיון המלא בעמוד המודל ↗