GPT
K

Kenshi

קוד פתוח

SweetLunacreativeml-openrail-m2023-01-04

  • diffusers
  • stable-diffusion
  • stable-diffusion-diffusers
  • text-to-image
  • art

שילוב מודלים ליצירת תמונות שמתמקד בסגנון איור חצי ריאליסטי. הוא מתאים למי שמחפש אסתטיקה של אמנים דיגיטליים פופולריים בלי לאמן מודל מאפס.

  • 43.7 GBמשקל הקבצים
  • 319הורדות בחודש
  • 141לייקים

מה זה

מדובר במיזוג של מודלי תמונה מבוססי דיפוזיה, שנוצר מחיבור של משקלים כמו Nixeu, WLOP, Guweiz ו־BoChen. המטרה כאן היא להפיק סגנון אמנותי ספציפי שנשען על עולמות האנימה והפנטזיה החצי ריאליסטית, תוך שמירה על גמישות סגנונית מסוימת שנבדקה על פני כמה עשרות סגנונות שונים.

המאגר מכיל 43.7 ג'יגה בייט של קבצים בפורמט diffusers, עם גרסאות שונות כמו KENSHI 00 ו־KENSHI 01. הוא מתבסס על פרומפטים באנגלית וכולל מילות הפעלה ייעודיות לחיזוק סגנונות המקור, כך שהוא נותן אופי ציורי מובהק שלא תקבלו ממודלי בסיס סטנדרטיים בלי כוונון כבד.

מתאים ל

  • איורי קונספט לפנטזיה

    מתאים לדמויות עם תאורה דרמטית בסגנון שמחקה אמנים דיגיטליים מוכרים.

  • עבודה עם משקלי Lora

    מבנה המיזוג תוכנן מראש לקלוט הטמעות סגנון ומשקלי הרחבה נוספים.

  • הפקת ארט למשחקים

    מאפשר לייצר גרסאות חצי ריאליסטיות של דמויות באמצעות פרומפטים מורכבים.

איפה זה נופל

המודל הזה לא ידידותי למשתמשים חדשים. היוצר מציין במפורש שצריך פרומפטים ארוכים, מורכבים ועמוסי תגיות כדי לקבל תוצאה טובה, וממליץ להתקין תוסף להשלמת תגיות כדי לא ללכת לאיבוד. בנוסף, חובה לצרף VAE חיצוני ולהפעיל הגדלת רזולוציה עם תיקון ייעודי, מה שהופך את תהליך ההפקה לאיטי ומסורבל יותר בהשוואה למודלים שמספקים תוצאה חדה בריצה ראשונה.

שאלות
נפוצות

האם המודל כולל רכיב VAE פנימי או שחייבים להוריד קובץ נוסף?

חייבים להוריד קובץ חיצוני. היוצר מדגיש שחובה להשתמש ב־kl-f8-anime2.ckpt ממאגר waifu-diffusion כדי לקבל את הצבעים והתוצאות הנכונות.

האם אפשר להשתמש בפרומפטים קצרים ופשוטים?

לא מומלץ. הכרטיס מציין שהמודל דורש פרומפטים עשירים ומפורטים מאוד כדי להגיע לתוצאה טובה, ואפילו מציע להשתמש בתוספי השלמת תגיות או בניסוחים מ־ChatGPT.

איך מריצים

בגלל נפח כולל של מעל 40 ג'יגה בייט במאגר, תצטרכו נפח אחסון פנוי וכרטיס מסך מודרני עם מספיק זיכרון תצוגה כדי להריץ צינורות דיפוזיה מקומיים. היוצר ממליץ לעבוד בממשק AUTOMATIC1111 עם דוגם DPM++ 2M Karras, מעל 20 צעדים, ערכי CFG נמוכים יחסית בין 2 ל־7, ורזולוציית בסיס של 600 על 800 לפני שמשתמשים ב־Hires Fix להגדלה פי 1.5.

חובה להוריד בנפרד רכיב VAE חיצוני מסוג kl-f8-anime2, כי בלעדיו הצבעים והפירוט של הפלט נפגעים משמעותית. אם אין לכם חומרה ייעודית לתהליך כזה של רינדור והגדלה, עדיף להריץ את המשקלים על שרת ענן שכור לפי שעה מאשר לנסות להחזיק את כל המשקלים האלה על מחשב פיתוח רגיל.

from diffusers import DiffusionPipeline

pipe = DiffusionPipeline.from_pretrained("SweetLuna/Kenshi")
img = pipe("a photo").images[0]

הרישיון

המשקלים מופצים תחת רישיון CreativeML OpenRAIL-M. מותר להשתמש במודל לצרכים מסחריים או לספק אותו כשירות, אך חובה לצרף את תנאי הרישיון והגבלות השימוש לכל משתמש קצה. הרישיון אוסר על יצירה או הפצה מכוונת של תכנים בלתי חוקיים או מזיקים, וליוצרים אין זכויות על התמונות שתייצרו.

  • שימוש מסחרי
  • שינוי הקוד
  • מגבלות שימוש ברישיון

הרישיון המלא בעמוד המודל ↗