GPT
C

Counterfeit-V2.5

קוד פתוח

gsdfcreativeml-openrail-m2023-02-02

  • diffusers
  • safetensors
  • stable-diffusion
  • stable-diffusion-diffusers
  • text-to-image

מודל מחולל תמונות שמכוון ישירות לאיורי אנימה ומציע תוצאות סגנוניות מובהקות. הוא מתאים למי שצריך גרפיקה יפנית ומחפש בסיס יציב של 860 מיליון פרמטרים.

  • 860Mפרמטרים
  • 29.8 GBמשקל הקבצים
  • 9,310הורדות בחודש
  • 1,586לייקים

מה זה

מדובר במודל שנועד לייצר תמונות מטקסט עם התמקדות מוחלטת באסתטיקה של אנימה. המפתח עדכן אותו בגרסה הזו במטרה להפוך את תהליך היצירה לקל ונגיש יותר, בין היתר באמצעות שילוב אמבדינג ייעודי לשלילה. הוא יושב על ארכיטקטורה של כ־860 מיליון פרמטרים, גודל סטנדרטי למחוללי תמונות בקטגוריה שלו, שמאפשר להריץ אותו בלי לשבור את הראש על חומרה חריגה.

במקום לנסות לייצר תמונות פוטו־ריאליסטיות, כל המשקולות כאן מכוילות לציור דמויות, תלבושות, תאורה עדינה וסגנון ציור יפני מסורתי או מודרני. הדוגמאות הרשמיות מראות שימוש קבוע בסאמפלר DPM++ 2M Karras עם 20 צעדים ו־CFG סביב 10, מה שמעיד על עבודה מהירה יחסית ברזולוציות התחלתיות לפני שלב ההגדלה.

מתאים ל

  • איור דמויות אנימה

    מייצר דמויות בסגנון יפני מדויק כולל ביגוד מורכב, תסרוקות ותאורה רכה ישר מתוך הנחיית טקסט.

  • קונספט ארט לסדרות

    מתאים לבניית לוחות השראה ורקעים עירוניים או טבעיים למשחקים ופרויקטים בעולם האנימה.

  • ייצור נכסים חזותיים

    עובד טוב עם סקריפטים של הגדלה ברזולוציה גבוהה כדי להפיק איורים איכותיים למוצרים גרפיים.

איפה זה נופל

היוצר עצמו מדגים שבכל הנחיה שלילית חובה לציין בעיות אנטומיה כמו אצבעות מיותרות או חסרות, לצד האמבדינג EasyNegative. המודל מתקשה בכפות ידיים בלי עזרה מפורשת. בנוסף, הוא מכויל לחלוטין לאנימה, כך שאם המוצר שלכם צריך משהו ריאליסטי או חצי־אמיתי, המודל הזה ייכשל לחלוטין. אין בכרטיס שום נתוני מדידה רשמיים או בדיקות ביצועים כמותיות.

אותה משפחה

Counterfeit יצא ב־3 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם חייבים להשתמש באמבדינג EasyNegative?

לא חייבים, אבל היוצר ממליץ עליו מפורשות ומשתמש בו בכל הדוגמאות הרשמיות. בלעדיו תצטרכו לכתוב הנחיות שלילה ארוכות מאוד כדי למנוע עיוותים באצבעות ובגוף.

איזה כרטיס מסך נחוץ כדי לעבוד איתו בצורה סבירה?

המודל שוקל סביב 860 מיליון פרמטרים, לכן כרטיס מסך עם 8 עד 12 גיגה זיכרון יספיק בהחלט. רק קחו בחשבון ששלב ההגדלה המומלץ ידרוש עוד קצת זיכרון וזמן עיבוד.

מה ההבדל בין גרסה 2.5 לגרסאות האחרות המוזכרות שם?

לפי הכרטיס, גרסה 2.5 עודכנה כדי להקל על היצירה בסגנון אנימה. גרסה 2.1 דומה לגרסה 2.0 המקורית, ואילו גרסה 2.2 הוגדרה על ידי המפתח כמיועדת לתוכן למבוגרים בלבד.

איך מריצים

אתם טוענים אותו דרך ספריית diffusers, אבל שימו לב לנפח של הריפו. המאגר כולל 29 קבצים במשקל כולל של כמעט 30 גיגה־בייט, כך שלא מורידים את כל התיקייה אלא רק את המשקולות הספציפיות שצריכים לריצה. כרטיס מסך ביתי מודרני עם שמונה גיגה זיכרון יעשה את העבודה ברזולוציות הבסיס כמו 512 על 832.

היוצר עצמו מסתמך על תהליך של שני שלבים. קודם מייצרים ברזולוציה נמוכה ואז עושים הרחבה בעזרת Latent upscaler ביחס של 1.8 עם כוח ניקוי רעשים של סביב 0.6. אם אתם רוצים את התוצאות שהובטחו בדוגמאות, תצטרכו להטמיע את ה־pipeline הזה ולא להסתפק ביצירה ישירה ברזולוציה מלאה.

from diffusers import DiffusionPipeline

pipe = DiffusionPipeline.from_pretrained("gsdf/Counterfeit-V2.5")
img = pipe("a photo").images[0]

הרישיון

הרישיון הוא creativeml-openrail-m. הוא מתיר שימוש מסחרי, אבל מטיל מגבלות ברורות על שימושים פוגעניים, הפצת חומרים בלתי חוקיים, פגיעה באנשים או אפליה. אם אתם משלבים אותו במוצר, אתם מחויבים לכלול את תנאי הרישיון ולהעביר את המגבלות האלה הלאה למשתמשי הקצה שלכם.

  • שימוש מסחרי
  • שינוי הקוד
  • מגבלות שימוש ברישיון

הרישיון המלא בעמוד המודל ↗