GPT
C

classic-anim-diffusion

קוד פתוח

nitrosockecreativeml-openrail-m2022-10-30

  • diffusers
  • stable-diffusion
  • text-to-image
  • endpoints_compatible

התאמה אישית של סטייבל דיפיוז'ן שמפיקה איורים בסגנון סרטי האנימציה הקלאסיים. מיועד למי שמחפש מראה נוסטלגי מצויר בלי להסתבך עם פרומפטים מורכבים.

  • 7.1 GBמשקל הקבצים
  • 300הורדות בחודש
  • 416לייקים

מה זה

מדובר במודל שנוצר באמצעות כוונון עדין של סטייבל דיפיוז'ן בשיטת דרימבות', על בסיס צילומי מסך מתוך סרטי אנימציה ישנים של אולפן מוכר. היוצר אימן אותו במשך תשעת אלפים צעדים תוך שימוש בשימור ידע מוקדם ואימון מקודד הטקסט, במטרה לשמור על גמישות בלי להרוס את היכולת הכללית של המודל לייצר מושגים שונים.

כדי להפעיל את האפקט צריך להוסיף את מילות המפתח המדויקות classic disney style לתיאור התמונה. המודל מתמקד ביצירת דמויות, חיות, נופים וכלי רכב, ומעניק להם קווים רכים, צביעה ידנית ומראה שמזכיר סרטים מצוירים מסורתיים במקום מראה תלת ממדי מודרני או ריאליסטי.

מתאים ל

  • איור דמויות באווירה נוסטלגית

    יצירת דמויות בסגנון ציור קלאסי בעזרת שילוב מילות המפתח בתיאור.

  • קונספט ארט לעולמות מצוירים

    בניית רקעים, נופים וכלי רכב שמתאימים למשחקים או אנימציות בסגנון ישן.

  • עיבוד חיות לסגנון אנימציה

    ייצור איורי חיות מואנשות בגימור ידני שנאמן למסורת הציור הישנה.

איפה זה נופל

אם תשכחו להכניס את מילות המפתח המדויקות, תקבלו פלט רגיל למדי בלי הסגנון המבוקש. המודל אומן על סטייבל דיפיוז'ן מוקדם מסוף 2022, כך שהוא סוחב איתו את כל הבעיות המקוריות של הדור ההוא: קושי עם אנטומיה מורכבת וידיים, ורזולוציות בסיס נמוכות יחסית שמחייבות הגדלה נוספת אם רוצים תמונה חדה לפרויקט אמיתי.

שאלות
נפוצות

איך גורמים למודל לעבוד בסגנון המבוקש בפועל?

חובה לכלול את הביטוי המדויק classic disney style בכל פרומפט ששולחים אליו. בלעדיו התוצאה תיראה כמו תמונה רגילה של מודל הבסיס.

האם המודל מסוגל לייצר תמונות ברזולוציה גבוהה?

האימון נעשה ברזולוציות של סביב חמש מאות ושנים עשר פיקסלים, בדיוק כמו הגדרות הדוגמה של 512x704. אם אתם צריכים תמונות גדולות יותר למוצר סופי, תצטרכו להעביר את הפלט תהליך של אפסקיילינג חיצוני.

איך מריצים

המשקל הכולל של הקבצים עומד על כמעט שבעה גיגה בייט וחצי, והרצה מקומית סטנדרטית דורשת כרטיס מסך ייעודי של אנבידיה עם זיכרון סביר של שמונה עד שנים עשר גיגה, תלוי אם טוענים אותו בדיוק חצי או מלא. הקוד נשען על ספריית הדיפיוזרס הרגילה של פייתון בפקודות בסיסיות, וניתן לייצא אותו גם לפורמטים כמו אונקס או לעבודה על מעבדי אפל.

אם אין לכם כרטיס מתאים מקומית, עדיף לפנות לפתרונות ענן שמריצים סביבות פייתון מוכנות עם מעבדים גרפיים, במיוחד בהתחשב בכך שייצור תמונה סביב רזולוציות של חמש מאות ושנים עשר פיקסלים לוקח בין עשרים לשלושים צעדים ברינדור.

from diffusers import DiffusionPipeline

pipe = DiffusionPipeline.from_pretrained("nitrosocke/classic-anim-diffusion")
img = pipe("a photo").images[0]

הרישיון

הרישיון כאן הוא creativeml-openrail-m, המאפשר שימוש מסחרי והפצה של המשקלים או שירות שמבוסס עליהם. עם זאת, חובה לצרף את תנאי הרישיון וההגבלות שלו למשתמשי הקצה שלכם, ואסור לחלוטין לייצר באמצעותו תכנים מזיקים או לא חוקיים המפורטים במסמך המקורי.

  • שימוש מסחרי
  • שינוי הקוד
  • מגבלות שימוש ברישיון

הרישיון המלא בעמוד המודל ↗