GPT
A

ACertainModel

קוד פתוח

JosephusCheungcreativeml-openrail-m2022-12-12

  • diffusers
  • stable-diffusion
  • stable-diffusion-diffusers
  • text-to-image
  • en

מודל מבוסס סטייבל דיפיוז'ן שמיועד כולו לאיורי אנימה ומבין תגיות דנבורו. הוא מייצר סגנון יפני מובהק גם מפרומפטים קצרים של מילים בודדות.

  • 11.1 GBמשקל הקבצים
  • 150הורדות בחודש
  • 159לייקים

מה זה

היוצר לקח משקלים של סטייבל דיפיוז'ן ואימן אותם מחדש כדי להיפטר מההשפעה של מאגר האסתטיקה שהוכנס בגרסה 1.4, שלטענתו פגע באיורי אנימה. תהליך האימון דרש אלפי שעות מעבד גרפי וכלל שילוב של תמונות שנוצרו במודלים קהילתיים כמו Anything-3.0 יחד עם תמונות מתויגות מדנבורו, כדי לשמור על יציבות ולהימנע מהרס השפה.

בניגוד למודלים כלליים שמנסים לרנדר הכל מפוטו-ריאליזם ועד שמן על בד, פה המיקוד צר מאוד. הוא מכוון לפרטים כמו עיניים, כפות ידיים ותנוחות גוף בסגנון ציור יפני, בלי להזדקק לפרומפטים ארוכים של חמישים מילים כדי לקבל תוצאה סבירה.

מתאים ל

  • איורי דמויות אנימה למשחקים

    יצירת קונספט ארט דו מימדי מהיר לפי תגיות מוגדרות של ביגוד, תווי פנים ותסרוקות.

  • הפקת רקעים בסגנון מאנגה

    רינדור סצנות חוץ צבעוניות כמו שמיים, גנים ועננים בהתאם לאסתטיקה יפנית מוכרת.

  • עבודה עם פרומפטים קצרים

    קבלת תוצאה גרפית מפורטת גם מרשימת תגיות פשוטה בלי הנדסת פרומפטים מורכבת.

איפה זה נופל

המודל אומן ברזולוציה בסיסית של 512 פיקסלים, כך שכל ניסיון לייצר תמונות גדולות ישירות יגרור כפילויות של גוף וראשים מעוותים. הוא מוגבל לאנגלית ולתגיות ייעודיות, כך שפרומפט בעברית או תיאור טבעי בשפה חופשית יניבו תוצאות מקריות. בנוסף, הוא ספציפי לחלוטין לאנימה, אל תצפו ממנו לתמונות ריאליסטיות או לעיצוב מוצר.

שאלות
נפוצות

האם המודל מבין פרומפטים בעברית?

לא. המודל אומן על אנגלית בלבד וספציפית על תגיות דנבורו באנגלית. כתיבה בעברית תגרום לו להפיק פלט אקראי ולא קשור.

למה התמונות שנוצרות באתר נראות פחות טוב מהדוגמאות?

ממשק הבדיקה של האתר רץ עם Clip skip 1, בעוד שהמודל הזה כוון ספציפית לעבודה עם ערך 2. כדי לקבל את האיכות המלאה צריך להריץ אותו בקוד שלכם או בסביבה שמאפשרת לשנות את הפרמטר הזה.

איך מריצים

המודל שוקל מעל 11 ג'יגה בגלל שמסופקים קבצים שונים במאגר, אבל בזמן ריצה בפועל מדובר על משקולות סטייבל דיפיוז'ן רגילות שרצות על כרטיס בסיסי כמו T4 חינמי בקולאב. אפשר לטעון אותו ישירות דרך ספריית diffusers בפייתון עם חצי דיוק כדי לחסוך זיכרון.

אם אתם מריצים מקומית, שימו לב להגדרות: היוצר מדגיש שחובה להשתמש בערך Clip skip של 2 כדי לקבל את האיכות המובטחת, לצד דוגם Euler a סביב 28 צעדים. ממשק הניסוי המובנה ברשת מוגבל לדילוג של 1, ולכן התוצאות בו נראות פחות טוב ממה שהמשקלים באמת מסוגלים להפיק.

from diffusers import DiffusionPipeline

pipe = DiffusionPipeline.from_pretrained("JosephusCheung/ACertainModel")
img = pipe("a photo").images[0]

הרישיון

רישיון CreativeML OpenRAIL-M מאפשר שימוש מסחרי והפצה של המשקולות או תוצרים כשירות, אך מחייב לצרף את תנאי הרישיון המקוריים ואת מגבלות השימוש שלו לכל מוצר קצה. אין ליוצר זכויות על התמונות שתייצרו, אך האחריות המשפטית עליהן נשארת כולה שלכם.

  • שימוש מסחרי
  • שינוי הקוד
  • מגבלות שימוש ברישיון

הרישיון המלא בעמוד המודל ↗