GPT
R

RealVisXL_V5.0

קוד פתוח

SG161222openrail++2024-08-05

  • diffusers
  • safetensors
  • endpoints_compatible

גרסה שמכוונת ישירות לפוטוריאליזם מבוסס SDXL. שווה לבדוק אותו אם אתם מחפשים תמונות אנושיות שנראות כמו צילום אמיתי ולא כמו ציור דיגיטלי.

  • 2.6Bפרמטרים
  • 38.8 GBמשקל הקבצים
  • 334,979הורדות בחודש
  • 219לייקים

מה זה

מדובר במודל שממיר טקסט לתמונה על בסיס ארכיטקטורת SDXL עם 2.6 מיליארד פרמטרים. המטרה המרכזית שלו היא לייצר תוצאות פוטוריאליסטיות באיכות טובה, גם בתכנים רגילים וגם בתכני מבוגרים, בלי המראה הפלסטי והמלוטש מדי שמאפיין לעיתים קרובות את מודלי הבסיס.

היוצר ממליץ כאן על שימוש בדוגם DPM++ SDE Karras עם מעל 30 צעדים, או DPM++ 2M Karras עם מעל 50 צעדים כדי להגיע לפירוט הנכון. לצד זה יש המלצה מפורשת לשלב שלב של Hires Fix כדי להעלות רזולוציה עם אפסקיילרים ייעודיים כמו 4x-UltraSharp, מה שמראה שהמודל מכוון מראש לרמת פירוט גבוהה שלא תמיד מתקבלת בריצה ישירה ראשונה.

מתאים ל

  • יצירת פורטרטים מציאותיים

    מתאים להפקת תמונות אנשים במראה של צילום אמיתי, בלי האפקט החלק והסינתטי של מודלים כלליים.

  • תמונות לפרויקטים הדורשים דיוק

    שימוש בפרמטרי הגדלה מומלצים מספק חדות טובה לרקעים ודמויות ברזולוציה גבוהה.

  • הפקת תוכן מבוגרים ממוקד

    היוצר מציין תמיכה מפורשת בתוכן NSFW באיכות טובה למי שזקוק לסגנון הזה.

איפה זה נופל

הכרטיס עצמו מדגיש צורך בהנחיה שלילית ארוכה כדי להימנע מבעיות של ידיים פגומות, אנטומיה שבורה, חוסר סימטריה בפנים ועיניים מעוותות. אם לא משתמשים בפרומפט שלילי מתאים, המודל עדיין נופל באותם כשלים מוכרים של גפיים ופרצופים. בנוסף, הוא מסוגל לייצר תכני NSFW, כך שמי שבונה מוצר פתוח לקהל הרחב חייב לשים שכבת סינון עצמאית לפני שהוא מציג תוצאות.

אותה משפחה

RealVisXL יצא ב־4 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם אפשר להריץ אותו בלי הגדרות מיוחדות ולקבל תוצאה טובה?

עדיף שלא. היוצר מציין במפורש צורך בבחירת דוגמים ספציפיים ומספר צעדים גבוה יחסית, לצד פרומפט שלילי שמטפל באנטומיה ופנים. ריצה על הגדרות ברירת מחדל של SDXL עלולה להניב עיוותים.

האם אני חייב להוריד את כל 38 הגיגה בייט?

לא בהכרח. המשקל הכולל כולל קבצים בפורמטים שונים וגרסאות מגוונות של המשקולות. ברוב המקרים מספיק להוריד קובץ safetensors יחיד שמתאים לסביבת העבודה שלכם, בדרך כלל באזור 6 עד 7 גיגה.

איך מריצים

בפועל מריצים אותו עם ספריית diffusers בפייתון או בממשקים כמו ComfyUI. הריפו כולל 28 קבצים במשקל כולל של 38.8 גיגה בייט, כך שצריך מקום פנוי בדיסק וכרטיס מסך עם לפחות 12 עד 16 גיגה זיכרון כדי לעבוד איתו בצורה סבירה, במיוחד כשמריצים מעל 30 צעדים ושלב הגדלה.

אם אתם רק בודקים רעיונות או שאין לכם חומרה ייעודית, המודל זמין גם בפלטפורמת Mage.Space. במקרים של עומס נקודתי או חוסר במעבד גרפי מתאים בשרת, שימוש בשירות מנוהל יחסוך את כאב הראש של ניהול קבצים בגודל הזה.

from diffusers import DiffusionPipeline

pipe = DiffusionPipeline.from_pretrained("SG161222/RealVisXL_V5.0")
img = pipe("a photo").images[0]

הרישיון

הרישיון הוא openrail++. הוא מאפשר שימוש מסחרי עקרוני, אבל כולל הגבלות שימוש נוקשות שאוסרות על יצירת תכנים פוגעניים, הטעיה, או שימושים מזיקים מוגדרים. אם אתם משלבים אותו במוצר, חובה לוודא שסוג השימוש שלכם לא מפר את תנאי הרישיון המקוריים של המשפחה הזו.

  • שימוש מסחרי
  • שינוי הקוד
  • מגבלות שימוש ברישיון

הרישיון המלא בעמוד המודל ↗