GPT
A

animagine-xl

קוד פתוח

Linaqrufopenrail++2023-08-04

  • diffusers
  • safetensors
  • stable-diffusion
  • stable-diffusion-diffusers
  • stable-diffusion-xl

התאמה של המודל הגדול של סטביליטי ליצירת איורי אנימה ברזולוציה גבוהה. הוא נשען על תגיות ייעודיות במקום שפה חופשית כדי להוציא תמונות חדות ומדויקות בסגנון יפני.

  • 2.6Bפרמטרים
  • 25.9 GBמשקל הקבצים
  • 469הורדות בחודש
  • 316לייקים

מה זה

הבסיס כאן הוא המודל הפופולרי ליצירת תמונות מבית סטביליטי בגרסת אחד נקודה אפס, שעבר אימון נוסף על תמונות אנימה נבחרות לאורך עשרים ושבעה אלף צעדים. המטרה הברורה היא לייצר איורים בסגנון יפני שנראים נקיים ומפורטים ישירות מהקופסה, בלי צורך להעמיס תוספים או מודלי עזר מורכבים.

האימון נעשה ברזולוציית בסיס של 1024 על 1024 פיקסלים, תוך שימוש בכלי לחלוקת יחסי גובה רוחב. זה מאפשר למודל לייצר תמונות במגוון יחסים, מתמונות רוחב קולנועיות ועד פורטרטים אנכיים צרים, בלי לעוות את הדמויות או לחתוך אותן בצורה מוזרה.

ההבדל העיקרי מול מודלים כלליים בגודל הזה טמון בצורת הקלט. הוא מבין תגיות מבוססות דנבורו הרבה יותר טוב מאשר תיאורים ארוכים, ולכן עבודה מולו דורשת רשימת מונחים ספציפיים שמתארים בגדים, הבעות, זוויות ותאורה.

מתאים ל

  • איור דמויות אנימה

    יצירת דמויות לפי מפרט לבוש, שיער והבעה בעזרת תגיות מוגדרות מראש.

  • רקעים וקונספט ארט

    הפקת תמונות ביחסי רוחב קולנועיים עבור משחקים ורומנים חזותיים.

  • אווטארים ותמונות פרופיל

    רינדור מהיר של פורטרטים ממוקדי פנים ברזולוציה מרובעת גבוהה.

איפה זה נופל

היוצר מציין במפורש שהמודל יורש את כל המגבלות הידועות של מודל הבסיס. זה אומר שבעיות באנטומיה, עיוותים באצבעות וידיים, וקושי ברינדור טקסט ברור יופיעו גם כאן. בנוסף, חובה להשתמש בתגיות שליליות קבועות ובתגיות סגנון כדי למנוע ירידה באיכות. אם תכתבו תיאור בשפה חופשית וטבעית, התוצאה תנטה לסגנון ריאליסטי במקום אנימה, וטקסט בעברית כמובן לא נתמך כלל.

שאלות
נפוצות

האם אפשר לתאר את התמונה במשפט רגיל באנגלית?

עדיף שלא. כרטיס המודל מזהיר שכתיבה בשפה טבעית במקום תגיות דנבורו תגרום לו לייצר תמונות במראה ריאליסטי במקום סגנון אנימה.

אילו תגיות חובה להוסיף לכל פרומפט?

היוצר ממליץ לפתוח תמיד במילים שמכוונות לאיכות מקסימלית, ולהגדיר תגיות שליליות שמסננות אנטומיה לקויה, ידיים מעוותות ורזולוציה נמוכה.

איך מריצים

כדי להריץ אותו מקומית מומלץ להשתמש בממשק כמו קומפי, או לחלופין בגרסאות עדכניות של ספריית דיפיוזרס בפייתון יחד עם מאיצי חישוב מתאימים. הקבצים שוקלים כמעט עשרים ושישה ג'יגה בייט ודורשים נפח זיכרון מכובד בכרטיס המסך כדי לייצר תמונה בודדת באיכות מלאה.

אם אין לכם כרטיס גרפי חזק עם מספיק זיכרון ייעודי, עדיף להריץ את העסק במחברת קולאב או לנצל פתרון ענן קיים, כי המודל כבד ויחנוק חומרה ביתית ממוצעת.

from diffusers import DiffusionPipeline

pipe = DiffusionPipeline.from_pretrained("Linaqruf/animagine-xl")
img = pipe("a photo").images[0]

הרישיון

הפרויקט מופץ תחת רישיון מסוג אופן רייל פלוס פלוס אם. הרישיון מאפשר שימוש מסחרי, אך כולל הגבלות שימוש שמטרתן למנוע יצירת תוכן פוגעני או מזיק, ומחייב להעביר את אותן הגבלות הלאה אם אתם מפיצים גרסה מותאמת שלו.

  • שימוש מסחרי
  • שינוי הקוד
  • מגבלות שימוש ברישיון

הרישיון המלא בעמוד המודל ↗