GPT
R

RealVisXL_V3.0

קוד פתוח

SG161222openrail++2023-12-16

  • diffusers
  • safetensors
  • endpoints_compatible

גרסה שמכוונת ישירות לתמונות פוטו-ריאליסטיות מטקסט, עם תמיכה בתוכן מצונזר ולא מצונזר. היא מיועדת למי שמחפש מראה אמין של מצלמה ולא סגנון ממוחשב או מצויר.

  • 2.6Bפרמטרים
  • 25.8 GBמשקל הקבצים
  • 13,748הורדות בחודש
  • 75לייקים

מה זה

מדובר במודל שמייצר תמונות מטקסט ומבוסס על ארכיטקטורה של 2.6 מיליארד פרמטרים, גודל טיפוסי למשפחת SDXL. המטרה המרכזית שלו היא לספק תוצאות פוטו-ריאליסטיות באיכות טובה, כולל תמיכה בתכני SFW וגם תוכן למבוגרים (NSFW). הוא נבנה כדי להתרחק מהמראה המאיר מדי או המצויר שמאפיין לעיתים קרובות מודלי בסיס, ולתת תחושה של צילום אמיתי.

היוצר ממליץ לעבוד עם דוגם DPM++ SDE Karras בטווח של 15 עד 30 צעדים, ולהשתמש בשלילה מפורשת של איורים, ציורים וגרפיקה תלת-ממדית כדי לשמור על הקו הריאליסטי. בנוסף, כדי לקבל תוצאה חדה באמת, ההמלצה הרשמית כוללת שימוש בשלב הגדלה (Hires Fix) עם מודל ייעודי כמו 4x-UltraSharp, יחד עם 10 צעדים נוספים וכוח ניקוי רעשים נמוך של 0.1 עד 0.5. אין כאן מדידות ביצועים מספריות או מבחנים רשמיים, כך שהשפיטה נעשית לפי איכות התמונה בעין.

מתאים ל

  • הדמיות צילום ריאליסטיות

    המודל אומן ספציפית לייצר מראה של צילום אמיתי ולא של גרפיקה ממוחשבת.

  • יצירת דמויות ללא צנזורה

    הוא כולל יכולת מובנית לייצר תמונות SFW וגם NSFW באיכות סבירה.

  • בדיקות קונספט מהירות

    עובד טוב בטווח של 15 עד 30 צעדים ומאפשר בדיקת רעיונות ויזואליים בזמן קצר.

איפה זה נופל

היוצר מציין במפורש שהמודל נמצא עדיין בשלבי אימון ואינו גרסה סופית, ולכן הוא מייצר לעיתים עיוותים וארטיפקטים ועלול לתפקד רע במקרים מסוימים. כדי למנוע ממנו לגלוש לסגנון מצויר או לעוות פנים, חייבים להזין רשימת פרומפט שלילי ספציפית שכוללת שלילת איורים, ציורים ואיכות ירודה. מעבר לכך, אם רוצים תוצאה נקייה ומפורטת, הוא תלוי בתהליך נוסף של Hires Fix, מה שמאריך את זמן היצירה ודורש עוד משאבי עיבוד.

אותה משפחה

RealVisXL יצא ב־4 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם המודל מוכן להטמעה במוצר סופי?

היוצר מבהיר שהמודל עדיין באימון ועלול לייצר ארטיפקטים. כדאי לבדוק אותו ביסודיות על תרחישי הקצה שלכם לפני שמשלבים אותו במערכת ייצור פעילה.

למה התמונות שיוצאות נראות מטושטשות או מצוירות?

המודל דורש פרומפט שלילי שמסנן סגנונות כמו איור ותלת-ממד, ובנוסף תלוי בשלב של Hires Fix כדי להגיע לרמת הפירוט המלאה.

איך מריצים

המשקל הכולל של הקבצים מגיע לכמעט 26 גיגה-בייט שמחולקים בין עשרות קבצים, אבל מודל כזה עם 2.6 מיליארד פרמטרים דורש בדרך כלל כרטיס מסך עם לפחות 12 עד 16 גיגה-בייט של זיכרון כדי להריץ תהליך יצירה בצורה סבירה. ההרצה נעשית ישירות דרך ספריית diffusers המוכרת בפייתון, כך שהשילוב בקוד קיים הוא די ישיר.

אם אין לכם שרת עם מאיץ גרפי מתאים, או שאתם רק רוצים לבדוק את התוצאות בלי להוריד עשרות גיגות, אפשר להשתמש בו ישירות בשירותי ענן כמו Mage שמארחים אותו, במקום להתעסק עם תשתיות ותחזוקה עצמית.

from diffusers import DiffusionPipeline

pipe = DiffusionPipeline.from_pretrained("SG161222/RealVisXL_V3.0")
img = pipe("a photo").images[0]

הרישיון

הרישיון הוא openrail++, שמאפשר שימוש חופשי יחסית כולל שימוש מסחרי, אבל כפוף למגבלות שימוש אתיות קבועות מראש. המגבלות האלה אוסרות פעילויות מזיקות כמו יצירת תוכן פוגעני, הטעיה, או שימושים בתחומים רגישים מסוימים, כך שחובה לוודא שהמוצר שלכם עומד בכללי ההתנהגות של הרישיון לפני ההפצה.

  • שימוש מסחרי
  • שינוי הקוד
  • מגבלות שימוש ברישיון

הרישיון המלא בעמוד המודל ↗