GPT
P

pixel-art-xl

קוד פתוח

nerijscreativeml-openrail-m2023-08-03

  • diffusers
  • text-to-image
  • stable-diffusion
  • lora

מתאם LoRA זעיר שמייצר תמונות פיקסל ארט מעל SDXL בלי צורך במילות הפעלה מיוחדות. הוא מתאים למי שבונה נכסים למשחקים ורוצה תוצאות מדויקות שקל להקטין.

  • 163 MBמשקל הקבצים
  • 13,774הורדות בחודש
  • 648לייקים

מה זה

מדובר במשקולות LoRA למודל Stable Diffusion XL ששוקלות 163 מגה בייט בלבד, כך שלא מורידים כאן מודל בסיס מלא אלא תוספת ייעודית. התפקיד שלו הוא להכריח את מנוע הדיפוזיה לייצר אסתטיקה נקייה של משחקי רטרו, בין אם מדובר במבט איזומטרי ובין אם לא, בלי שתצטרכו להנדס פרומפטים מסובכים של סגנון.

היוצר בדק אותו גם על גרסה 0.9 וגם על 1.0 של SDXL, והוא מסוגל לעבוד עם טקסט אנקודר בודד. בשונה ממודלים כבדים שמנסים לעשות הכול, ההתמקדות כאן היא בקווי מתאר חדים שמתאימים למשחקים, בתנאי שמבצעים עיבוד משלים נכון ביציאה.

מתאים ל

  • נכסים למשחקי דו מימד

    מייצר ספרייטים ודמויות בסגנון רטרו שמוכנים להקטנה ישירה למנוע המשחק.

  • סביבות איזומטריות

    מתאים לבניית אריחים ומבנים בזווית איזומטרית בלי להסתבך בהגדרות סגנון מורכבות.

  • פיתוח מהיר עם LCM

    משתלב עם מאיץ LCM ומאפשר יצירת סקיצות קונספט בשמונה צעדי רינדור בלבד.

איפה זה נופל

הפלט הישיר לא יוצא פיקסל פרפקט מהקופסה. כדי לקבל מראה אמיתי של פיקסלים חייבים להקטין את התמונה פי שמונה באלגוריתם Nearest Neighbors. בנוסף, חובה להשתמש ב־VAE מתוקן כמו גרסת 0.9 או תיקון fp16 כדי למנוע ארטיפקטים בתמונה, והיוצר מזהיר במפורש לא להשתמש במודל ה־refiner של SDXL שמחרב את האפקט.

שאלות
נפוצות

איזה מילת הפעלה צריך לכתוב בפרומפט בשביל לקבל את הסגנון?

אין צורך במילת הפעלה ייעודית. המודל מכויל לתת את הסגנון ישירות, אם כי בפרומפט השלילי מומלץ לשלול רינדור תלת מימדי ותמונות ריאליסטיות כדי לשמור על קווים נקיים.

למה התמונה יוצאת מטושטשת או עם מריחות צבע מוזרות?

זה קורה אם לא משתמשים ב־VAE מתוקן או אם שוכחים לבצע הקטנה פי שמונה באמצעות Nearest Neighbors. בנוסף, ודאו שלא הפעלתם את מודל ה־refiner ברקע, כי הוא מחליק את הפיקסלים ומקלקל את התוצאה.

איך מריצים

טוענים את קובץ ה־safetensors לתוך פייפליין של diffusers לצד SDXL Base, ומגדירים חוזק של 1.2 למתאם. הכרטיס מציג הרצה משולבת עם LCM LoRA שמאפשרת לייצר תמונה בשמונה צעדים בלבד עם guidance scale של 1.5, מה שמקצר את זמני הריצה משמעותית.

בגלל שזה SDXL, עדיין תצטרכו כרטיס מסך עם זיכרון וידאו מכובד כדי להחזיק את מודל הבסיס ב־fp16. למי שאין שרת עם GPU ייעודי וצריך רק כמה עשרות תמונות בודדות, הקמה של הסביבה הזו לבד תהיה כאב ראש מיותר ועדיף לפנות לפתרון מנוהל.

from diffusers import DiffusionPipeline

pipe = DiffusionPipeline.from_pretrained("nerijs/pixel-art-xl")
img = pipe("a photo").images[0]

הקבצים

3 קבצים במאגר, 163 MB סך הכול. הקישורים מובילים ישירות ל־Hugging Face.

הרישיון

הרישיון הוא creativeml-openrail-m, שזה הרישיון המוכר של משפחת SDXL. מותר להשתמש בו לצרכים מסחריים, אבל חלים איסורים ספציפיים על שימושים פוגעניים, מרמה או יצירת תכנים בלתי חוקיים, ואתם מחויבים להעביר את אותן הגבלות הלאה למשתמשי הקצה של המוצר שלכם.

  • שימוש מסחרי
  • שינוי הקוד
  • מגבלות שימוש ברישיון

הרישיון המלא בעמוד המודל ↗