GPT
A

anime-painter

קוד פתוח

xinsirapache-2.02024-05-12

  • diffusers
  • safetensors
  • controlnet
  • text_to_image
  • controlnet-scribble-sdxl-1.0

מתאם ControlNet שממיר שרבוטים גולמיים לאיורי אנימה מלוטשים על בסיס SDXL. שווה לבחון אותו אם אתם רוצים שליטה קומפוזיציונית מדויקת בלי לוותר על הסגנון והאיכות של מודלי בסיס ייעודיים.

  • 1.3Bפרמטרים
  • 2.3 GBמשקל הקבצים
  • 604הורדות בחודש
  • 104לייקים

מה זה

מדובר במודל מסוג ControlNet שנבנה סביב SDXL 1.0 ומתמקד בסגנון אנימה מבוסס שרבוטים. בניגוד לגרסאות ותיקות כמו ControlNet Scribble ל־SD 1.5, הוא מאומן להפיק איורים ברזולוציה מקורית של 1024 על 1024, ומצליח להבין גם סקיצות מרושלות עם עובי קו משתנה.

הוא לא עובד עצמאית אלא מתלבש על מודלי בסיס אנימטיביים של SDXL, כמו CounterfeitXL או BluePencil. המפתחים אימנו אותו על מאגר נרחב של תמונות אנימה מסוננות, מה שמפחית משמעותית עיוותים אנטומיים שנפוצים במודלים כלליים ומעניק לו מראה שמזכיר פלטפורמות כמו NijiJourney.

במבחני ביצועים מול דגם ה־Scribble הקלאסי של SD 1.5, הוא השיג ציון אסתטיקה של 5.95 לעומת 5.86, וציון דמיון תפיסתי של 0.5171 מול 0.577. בפועל, המספרים האלה מראים שהוא נצמד חזק יותר לצורת השרבוט המקורית ובמקביל מוציא תמונה שנראית נקייה ומקצועית יותר.

מתאים ל

  • הפיכת סקיצות לאיורי קונספט

    מאפשר לאנשי צוות שאינם מאיירים להפוך שרבוט רעיוני מהיר לאיור אנימה גמור תוך שמירה על הקומפוזיציה.

  • יצירת דמויות אנימה בהתאמה

    מגדיר תנוחות וזוויות מדויקות לדמויות באמצעות שרבוט קווי פשוט ושילוב תגיות תיאור מפורטות.

  • פייפליין גרפי למשחקים

    משתלב במנועי יצירה להפקת נכסים דו־ממדיים בסגנון יפני מתוך קווי מתאר בסיסיים שנבנו מראש.

איפה זה נופל

החיסרון המרכזי הוא התלות הכבדה בתגיות Danbooru. שפה טבעית חופשית פשוט לא מספיקה כאן, ואם תכתבו הנחיה רגילה בלי מילות מפתח מוגדרות היטב, המודל יתקשה לדייק והתוצאה תהיה הימור סטטיסטי.

בנוסף, הכרטיס לא כולל פרטים טכניים על ארכיטקטורת האימון, ולא מספק קוד מוכן להרצה. הוא גם תלוי לחלוטין באיכות מודל הבסיס שתחברו אליו, כך ששרבוט בלבד לא יפצה על מודל בסיס שלא הוגדר נכון.

שאלות
נפוצות

האם אפשר להריץ את המודל הזה לבד בלי מודל נוסף?

לא. מדובר במתאם ControlNet שדורש מודל בסיס מסוג SDXL כדי לייצר תמונה בפועל. מומלץ לחבר אותו למודלי בסיס של אנימה כמו CounterfeitXL לקבלת התוצאות הטובות ביותר.

למה התמונות יוצאות אקראיות ולא תואמות את הפרומפט שלי?

המודל אומן בעיקר על תגיות Danbooru ופחות מבין שפה טבעית חופשית. כדי לקבל שליטה, צריך להזין רשימת תגיות מפורטת שמתארת את הדמות והרקע, ורק אז להוסיף תיאור כללי.

האם חייבים להשתמש בשרבוטים נקיים ומדויקים?

לא, המודל תוכנן במיוחד לעבוד עם שרבוטים חופשיים, מרושלים ובעובי קו משתנה. הוא מזהה את הגבולות והמשמעות הסמנטית של הסקיצה גם אם מדובר בציור בסיסי מאוד.

איך מריצים

המודל שוקל 2.3 גיגה־בייט ומכיל כ־1.3 מיליארד פרמטרים, אבל זה רק משקל הבקרה. כדי להריץ אותו דרך ספריית diffusers אתם חייבים לטעון במקביל גם מודל בסיס של SDXL, מה שדורש כרטיס מסך עם לפחות 12 עד 16 גיגה־בייט זיכרון וידאו להסקה מקומית יציבה.

אם יש לכם שרת עם חומרה מתאימה, ההרצה המקומית הגיונית לגמרי ונותנת חופש מלא בבחירת מודל הבסיס. לעומת זאת, אם החומרה שלכם מוגבלת ואתם צריכים רק בדיקות מזדמנות, עדיף להקים שרת ענן ייעודי לפי שעה מאשר לנסות לדחוס את כל הצינור הזה לכרטיס חלש.

from diffusers import DiffusionPipeline

pipe = DiffusionPipeline.from_pretrained("xinsir/anime-painter")
img = pipe("a photo").images[0]

הרישיון

הפרויקט מופץ תחת רישיון Apache 2.0. מותר להשתמש בו לצרכים מסחריים, לשנות את המשקלים ולשלב אותו בתוך מוצרים, כל עוד שומרים על הודעות זכויות היוצרים והרישיון המקורי. צריך לזכור שמודל הבסיס שתבחרו להריץ תחתיו מגיע עם תנאי רישוי משלו, שלא קשורים לרישיון של המתאם הזה.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗