GPT
D

dreamlike-diffusion-1.0

קוד פתוח

dreamlike-artother2022-12-11

  • diffusers
  • safetensors
  • stable-diffusion
  • stable-diffusion-diffusers
  • text-to-image

גרסה מכווננת של סטייבל דיפיוז'ן 1.5 שמכוונת מראש לסגנון אמנותי מלוטש. חוסכת שרשור של עשרות מילות תיאור רק כדי לקבל תוצאה שנראית כמו איור מקצועי.

  • 860Mפרמטרים
  • 8.0 GBמשקל הקבצים
  • 4,257הורדות בחודש
  • 1,024לייקים

מה זה

בבסיס יושב מודל סטייבל דיפיוז'ן 1.5 עם כ־860 מיליון פרמטרים שעבר אימון נוסף על תמונות אמנותיות באיכות גבוהה. הוא נשען על אותו מבנה מוכר של מודלי תמונה מטקסט, כך שכל מי שכבר עובד עם המערכת המקורית ימצא כאן את אותה התנהגות בדיוק מבחינת כתיבת פרומפטים.

ההבדל המשמעותי מול המודל הגולמי הוא ברירת המחדל האסתטית. במקום להיאבק עם ניסוחים מסורבלים, מילה אחת כמו dreamlikeart דוחפת את היצירה לקו אמנותי ברור. הוא יודע לעבוד טוב יותר ברזולוציות מלבניות כמו 512 על 768 או יחסי תמונה של 16:9 ו־9:16, שמתאימות יותר לאיורים מאשר הריבוע הסטנדרטי.

מתאים ל

  • איורי קונספט למשחקים

    הסגנון האמנותי מובנה במודל ומייצר דמויות וסביבות מורכבות בלי צורך בהנדסת פרומפטים ארוכה.

  • תמונות יחסי ציבור מלבניות

    הוא מותאם מראש ליחסים של 16:9 ו־9:16 ברזולוציות מוגבהות כמו 512 על 768 פיקסלים.

  • יצירת נכסים לצוותים קטנים

    התמונות מותרות לשימוש מסחרי כל עוד הצוות שלכם מונה עשרה אנשים לכל היותר.

איפה זה נופל

המודל מבין אנגלית בלבד, כך שפניות בעברית פשוט לא יעבדו בלי תרגום מוקדם. מעבר לזה, הכוונון שלו נוטה חזק לסגנון אמנותי ספציפי, ואם תרצו תמונות ריאליסטיות לחלוטין תצטרכו לחפש גרסאות אחרות כמו פוטוריאל שהיוצרים שחררו בהמשך. הוא גם מתקשה בריבועים רגילים של 512 על 512 ומחייב מעבר לרזולוציות מעט גבוהות יותר כדי לקבל תוצאה נקייה.

שאלות
נפוצות

אפשר להעלות שירות בתשלום שמשתמש במודל הזה?

לא. הרישיון אוסר במפורש לארח את המודל בכל שירות שמייצר הכנסות או תרומות בלי אישור ישיר במייל מהמפתחים. שימוש מסחרי מותר רק בתוצרים עצמם ועבור צוותים קטנים.

איך מוציאים ממנו את המראה האמנותי המובטח?

משתמשים בפרומפטים רגילים של סטייבל דיפיוז'ן ומוסיפים את המילה dreamlikeart. בנוסף, עדיף להגדיר רזולוציות מלבניות כמו 640 על 640 או 512 על 768 פיקסלים במקום ברירת המחדל הישנה.

איך מריצים

טוענים את המשקלים דרך ספריית diffusers בפייתון עם torch.float16 ומעבירים לעיבוד בכרטיס הגרפי עם CUDA. קובץ המשקולות הרגיל שוקל 2.13 גיגה־בייט בפורמט ckpt, כך שכרטיס מסך ממוצע עם 6 עד 8 גיגה זיכרון יריץ אותו מקומית בלי דרמות.

אם אתם רק רוצים לבדוק איך הוא מגיב לפרומפטים שלכם לפני שאתם מורידים שמונה גיגה של קבצים, אפשר להריץ אותו בהדגמת Gradio בחינם או ישירות באתר של היוצרים.

from diffusers import DiffusionPipeline

pipe = DiffusionPipeline.from_pretrained("dreamlike-art/dreamlike-diffusion-1.0")
img = pipe("a photo").images[0]

הרישיון

הרישיון כאן הוא CreativeML OpenRAIL-M שעבר שינוי מגביל מאוד. אסור להריץ את המודל באתר או באפליקציה שמכניסים כסף או מקבלים תרומות בלי אישור במייל מהיוצרים. מותר להשתמש בתמונות שנוצרו לצרכים מסחריים, אבל רק בצוותים של עד עשרה אנשים, מה שפוסל אותו לחברות גדולות שרוצות להטמיע שירות יצירה פנימי.

הרישיון המלא בעמוד המודל ↗