GPT
D

dreamshaper-xl-turbo

קוד פתוח

Lykonopenrail++2023-12-05

  • diffusers
  • safetensors
  • stable-diffusion
  • stable-diffusion-diffusers
  • stable-diffusion-xl

גרסת טורבו שמייצרת תמונות בכמה צעדים בודדים במקום עשרות. היא מתאימה למי שרוצה את הסגנון של דרים-שייפר בלי לשלם בזמני המתנה ארוכים על כל יצירה.

  • 2.6Bפרמטרים
  • 32.3 GBמשקל הקבצים
  • 3,374הורדות בחודש
  • 46לייקים

מה זה

מדובר בהתאמה ממוקדת של המודל המוכר מעל בסיס הטורבו של SDXL, כשהמטרה היא לחתוך בצורה קיצונית את כמות הצעדים שדרושים לתמונה. בעוד שמודלים רגילים במשפחה הזו צריכים שלושים או ארבעים צעדים, פה מקבלים פלט מוגמר כבר בשישה צעדים, עם ערך guidance scale נמוך מאוד של 2. שילוב כזה של מודל טורבו עם תזמון מהיר חוסך זמן חישוב יקר על כרטיסי המסך, ומאפשר לקבל זמני מענה קצרים בהרבה עבור כל בקשה שמגיעה מהמשתמש.

המשקל של הקבצים מגיע ליותר משלושים ג'יגה בגלל שמדובר במבנה המלא של SDXL, כך שלא מדובר בכלי רזה שרץ בקלות על מחשב נייד פשוט. הקוד מותאם ישירות לספריית diffusers של פייתון, ועובד ישירות עם fp16 כדי לצמצם שימוש בזיכרון, אבל מאחורי הקלעים עדיין רצים מעל שניים וחצי מיליארד פרמטרים. אם אתם מחפשים סגנון ויזואלי של יצירות אמנות וציור דיגיטלי, הוא מביא את הטאץ' המוכר של סדרת דרים-שייפר בלי הסרבול של המתנה ארוכה בכל הרצה.

מתאים ל

  • יצירת פורטרטים בזמן אמת

    זמן הפקה מהיר בשישה צעדים מאפשר לבנות תמונות פרופיל ודמויות בלי שהמשתמש יחכה.

  • סיעור מוחות חזותי

    קבלת כיוונים עיצוביים ראשוניים תוך שניות בודדות לפני שמשקיעים ברינדור ארוך.

  • שילוב במוצרי צ'אט

    יכולת לייצר תמונה מתוך שיחה בלי להשהות את המענה ליותר מרגעים ספורים.

איפה זה נופל

המודל תומך רק בהנחיות טקסט באנגלית, כך שפרומפטים בעברית יפיקו שטויות או לא יעבדו כלל. מעבר לזה, ארכיטקטורת טורבו שרצה בשישה צעדים בלבד נוטה לפספס פרטים קטנים, ויש לה נטייה להציג עיוותים באצבעות, עיניים וטקסטים מורכבים יותר מאשר מודלים איטיים. כרטיס המודל לא כולל שום מבחני ביצועים, דוגמאות לבעיות או מדדי בנצ'מרק, ולכן אי אפשר לדעת מראש איך הוא מתמודד עם סגנונות מחוץ לתמונות פורטרט בלי שתבדקו אותו בעצמכם.

שאלות
נפוצות

כמה זיכרון בכרטיס המסך צריך כדי להריץ אותו?

המודל שוקל מעל שלושים ג'יגה בתיקייה, אבל בטעינה של חצי דיוק הוא דורש לפחות 16 ג'יגה זיכרון גרפי כדי לעבוד יציב. אם תנסו להריץ אותו על כרטיס עם שמונה או שנים-עשר ג'יגה, תיתקלו במחסור במקום אלא אם תשתמשו בטכניקות אופטימיזציה נוספות שלא מפורטות כאן.

אפשר לתת לו הנחיות בעברית?

לא, המודל אומן ותומך בשפה האנגלית בלבד. אם תזינו מילים בעברית הוא כנראה לא יבין את הבקשה ויפלוט תוצאה אקראית לחלוטין, לכן תצטרכו לתרגם את הטקסט לפני השליחה.

איך מריצים

מריצים אותו דרך ספריית diffusers עם פייתון, accelerate ו־transformers, בטעינת משקולות של fp16. בגלל הגודל העצום של המשקולות ושני מיליארד וחצי הפרמטרים, צריך כרטיס מסך של אנבידיה עם לפחות 16 ג'יגה של VRAM פנוי, אחרת תקבלו שגיאות זיכרון עוד לפני שההרצה תתחיל.

אם אתם לא צריכים שרת ייעודי שעובד עשרים וארבע שעות ביממה או שאין לכם חומרה חזקה מקומית, עדיף להשתמש ב־API מנוהל שמחזיק את המודל חם, במקום לספוג הורדה של עשרות ג'יגה ועמדת עבודה כבדה.

from diffusers import DiffusionPipeline

pipe = DiffusionPipeline.from_pretrained("Lykon/dreamshaper-xl-turbo")
img = pipe("a photo").images[0]

הרישיון

הרישיון הוא openrail++, שמתיר שימוש מסחרי אבל מטיל הגבלות ברורות נגד יצירת תוכן פוגעני, זיופים או שימושים לא חוקיים. אם אתם משלבים אותו במוצר שלכם, אתם מחויבים להעביר את אותן מגבלות הלאה למשתמשי הקצה.

  • שימוש מסחרי
  • שינוי הקוד
  • מגבלות שימוש ברישיון

הרישיון המלא בעמוד המודל ↗