GPT
C

CyberRealistic

קוד פתוח

cyberdeliacreativeml-openrail-m2023-05-28

  • diffusers
  • stable-diffusion
  • sd-1.5
  • text-to-image
  • photorealistic

מודל תמונה שמכוון ישירות לפוטוריאליזם בלי שתצטרכו לכתוב פרומפטים באורך מגילה. הוא מבוסס על SD 1.5 ומתמקד בדיוק בפורטרטים ומרקמי עור אמינים.

  • 90.5 GBמשקל הקבצים
  • 89,212הורדות בחודש
  • 95לייקים

מה זה

מדובר בכוונון עמוק על גבי ארכיטקטורת Stable Diffusion 1.5, כשהמטרה היחידה שלו היא תמונות שנראות כמו צילום אמיתי ולא כמו אמנות דיגיטלית. היתרון הגדול שלו מול משקלים בסיסיים הוא ההתנהגות עם פרומפטים פשוטים. אתם מקלידים תיאור קצר ומקבלים תאורה טבעית, מרקם עור ועומק שדה בלי לשרשר מילות מפתח אינסופיות.

הקובץ כולל כבר VAE מובנה, כך שלא צריך להתעסק עם חיבור רכיבים חיצוניים כדי שהצבעים לא ייצאו דהויים. המודל מכוון ספציפית לצילומי אופנה, סצנות קולנועיות ודמויות אנושיות, ושם הוא מפיק תוצאות נקיות בהרבה מגרסאות SD 1.5 גנריות.

מתאים ל

  • פורטרטים לאתרי תדמית

    יצירת דמויות שנראות כמו צילום סטודיו אמיתי עם עומק שדה ותאורה טבעית.

  • צילומי אופנה וסטיילינג

    הפקת סצנות לבוש עם מרקם עור ואור צד דרמטי ישירות מפרומפט קצר.

  • פריים קולנועי לסטוריבורד

    בניית תמונות ריאליסטיות לפרויקטים ויזואליים בלי להסתבך בהגדרות מורכבות.

איפה זה נופל

המיקוד בצילום ריאליסטי פוגע בכל מה שמסביב. המודל מתקשה מאוד עם תוכן מופשט, ציורים, איורים או אנימה, כך שלא כדאי לבנות עליו לפרויקטים שדורשים סגנון אמנותי מגוון. בנוסף, תלוי בדוגם שבחרתם, העור והתאורה עלולים לצאת חלקים או נקיים מדי עד לרמה פלסטית, והוא עשוי לייצר תוכן רגיש אם לא תסננו את הקלט והפלט.

שאלות
נפוצות

האם חייבים להוריד קובץ VAE נפרד?

לא, ה־VAE כבר מוטמע בפנים בתוך קובץ ה־safetensors. המודל פולט תמונות עם צבעים נכונים וניגודיות מלאה ישר מהקופסה, בלי צורך לחבר רכיב חיצוני.

אפשר לייצר איתו איורים או סגנון אנימה?

עדיף שלא. האימון שלו ננעל כמעט לחלוטין על צילום מציאותי, ולכן בסגנונות מופשטים, ציור או אנימה התוצאות לרוב יוצאות בינוניות ומטה.

איך מקבלים תוצאה חדה אם הבסיס הוא רק 512 על 512?

ההמלצה הרשמית היא לייצר ב־512 על 512 ולאחר מכן להשתמש ב־Hires.fix יחד עם מגדיל ייעודי כמו NMKD-Siax. יצירה ישירה ברזולוציה גבוהה יותר עלולה לעוות את הדמויות.

איך מריצים

טוענים אותו דרך ספריית diffusers או ממשקים תואמים בעזרת קובצי safetensors. ההרצה המקומית צנועה למדי בזכות בסיס 1.5, וכרטיס מסך ביתי עם 8GB זיכרון יחזיק אותו בלי בעיה ברזולוציית הבסיס של 512 על 512.

כדי להוציא ממנו את המקסימום, מומלץ לעבוד עם 25 עד 30 צעדים, דוגם כמו DPM++ 2M Karras או Euler A, וערכי CFG בין 7 ל־8. מכיוון שהרזולוציה הטבעית נמוכה יחסית, בשביל תמונות חדות באמת תצטרכו להפעיל Hires.fix עם מגדיל תמונה כמו NMKD-Siax או NickelbackFS.

from diffusers import DiffusionPipeline

pipe = DiffusionPipeline.from_pretrained("cyberdelia/CyberRealistic")
img = pipe("a photo").images[0]

הרישיון

הרישיון הוא CreativeML Open RAIL++-M, שמאפשר שימוש מסחרי ולא מסחרי. החובה המרכזית היא לתת קרדיט ליוצר, ולא להשתמש בו ליישומים פוגעניים או מזיקים שהוגדרו בתנאי הרישיון המקוריים של המודל.

  • שימוש מסחרי
  • שינוי הקוד
  • מגבלות שימוש ברישיון

הרישיון המלא בעמוד המודל ↗