GPT
A

Arcane-Diffusion

קוד פתוח

nitrosockecreativeml-openrail-m2022-10-02

  • diffusers
  • stable-diffusion
  • text-to-image
  • endpoints_compatible

התאמה אישית של סטייבל דיפיוז'ן שמיועדת להפיק תמונות בסגנון האנימציה של הסדרה ארקיין. אם אתם צריכים בדיוק את המראה המצויר והמחוספס הזה, המודל הזה הוכשר ספציפית עבורו.

  • 11.1 GBמשקל הקבצים
  • 923הורדות בחודש
  • 755לייקים

מה זה

מדובר במודל ג'נרוט תמונה מטקסט שנבנה ככוונון עדין על גבי סטייבל דיפיוז'ן. הוא אומן על צילומי מסך מהסדרה כדי לקלוט את השפה החזותית הייחודית שלה, שמשלבת ציור ידני דיגיטלי עם תלת ממד. כדי להפעיל את האפקט צריך להוסיף את צמד המילים arcane style לטקסט שאתם מזינים לו.

הפרויקט עבר כמה סבבי פיתוח. גרסה 3, שהיא העדכנית במאגר, אומנה על 95 תמונות בלבד לאורך 8,000 צעדים, תוך אימון ישיר של מקודד הטקסט. היוצר מציין שהשינוי הזה שיפר מאוד את האיכות ואת היכולת לערוך את התוצאות ביחס לגרסאות הקודמות, שבהן הסגנון השתלט על התמונה גם בלי שהמשתמש ביקש אותו במפורש.

מתאים ל

  • עיצוב דמויות למשחקים

    יצירת קונספט ארט לדמויות פנטזיה שמחפשות מראה מחוספס וצבעוני בלי להתחיל לצייר מאפס.

  • הפקת אווטארים לפרופילים

    המרת תיאורי פנים לאיורים בסגנון אנימציה מערבית דרך שימוש במילת המפתח הייעודית.

  • איור רקעים וסביבות

    הפקת תמונות רקע עם תאורה דרמטית ומשיכות מכחול דיגיטליות שמתאימות למשחקי תפקידים.

איפה זה נופל

האימון נשען על 95 תמונות בלבד, שזה מאגר קטן מאוד שמוגבל רק לדמויות ולסביבות שנראו בסדרה. המודל מתמחה בסגנון ספציפי וצר, כך שאם תנסו להוציא ממנו סגנונות אחרים או תמונות פוטוריאליסטיות, תקבלו עיוותים או זליגה של מראה האנימציה. בנוסף, בגרסאות מוקדמות דווח שהסגנון מופיע גם כשלא מבקשים אותו, מה שמעיד על פוטנציאל לשיבוש יצירות שלא אמורות להיראות כמו ארקיין.

שאלות
נפוצות

איך גורמים למודל לייצר תמונות בסגנון המבוקש?

חייבים לכלול את הביטוי arcane style בתוך הפרומפט שאתם שולחים למודל. בלי הביטוי הזה תקבלו תוצאות דומות יותר לסטייבל דיפיוז'ן רגיל, אם כי בחלק מהגרסאות עדיין תיתכן השפעה קלה של הסגנון.

באיזו גרסה מתוך המאגר כדאי להשתמש?

היוצר ממליץ על גרסה 3, שכוללת שיפורים במקודד הטקסט ואומנה לאורך 8,000 צעדים. היא מספקת את השליטה הטובה ביותר בפרטים לעומת גרסאות 1 ו־2 שנשענו על שיטות אימון מוקדמות יותר.

איך מריצים

טוענים אותו ישירות דרך ספריית diffusers בפייתון באמצעות צינור העבודה הרגיל של סטייבל דיפיוז'ן בפורמט float16. אפשר לייצא אותו גם לפורמטים כמו ONNX או FLAX, ויש לו תמיכה בממשקי רשת וסביבות עבודה כמו קולאב.

המאגר כולל 25 קבצים במשקל כולל של 11.1 גיגה בייט בגלל הגרסאות השונות, כך שתצטרכו כרטיס מסך עם זיכרון סביר של 6 עד 8 גיגה בייט לפחות להרצה מקומית. אם אתם רק בודקים רעיון ולא רוצים להחזיק שרת ייעודי, עדיף להריץ אותו דרך סביבת בדיקה מוכנה במקום להתעסק עם התקנות מקומיות.

from diffusers import DiffusionPipeline

pipe = DiffusionPipeline.from_pretrained("nitrosocke/Arcane-Diffusion")
img = pipe("a photo").images[0]

הרישיון

הרישיון הוא creativeml-openrail-m, שמאפשר שימוש מסחרי אבל כולל הגבלות שימוש ספציפיות כמו איסור על יצירת תוכן פוגעני או מטעה. עם זאת, המודל אומן ישירות על צילומי מסך מתוך סדרה מסחרית מוגנת בזכויות יוצרים, ולכן שימוש בו בתוך מוצר מסחרי עלול לחשוף אתכם לסיכון משפטי מול בעלי הזכויות של היצירה המקורית.

  • שימוש מסחרי
  • שינוי הקוד
  • מגבלות שימוש ברישיון

הרישיון המלא בעמוד המודל ↗