GPT
A

AltDiffusion — הדגמה

קוד פתוח

BAAIcreativeml-openrail-m2022-09-30

  • gradio

ממשק ליצירת תמונות מטקסט או מתמונה קיימת, שמבוסס על Stable Diffusion. מתאים למי שמחפש סגנונות ספציפיים כמו ציור סיני מסורתי או סטימפאנק בלי להסתבך עם התקנות.

  • 13.5 GBמשקל הקבצים
  • הורדות בחודש
  • 113לייקים

מה זה

אתם מקבלים כאן שני מסלולים עיקריים בעזרת לשוניות נפרדות. במסלול הראשון מקלידים תיאור טקסטואלי, בוחרים סוג יצירה כמו ציור כללי או ציור סיני מסורתי, ומסמנים סגנונות עיצוב כמו צילום קולנועי או סטימפאנק. אפשר להגדיר סיד קבוע, לבחור רוחב וגובה בין 512 ל־1024 פיקסלים, ולקבוע אם לייצר בין תמונה אחת לארבע תמונות בגלריה.

המסלול השני עובד מתמונה לתמונה. מעלים תמונה, מסמנים עליה מסכה כדי להסתיר חלקים מסוימים, מוסיפים הנחיה כתובה ומקבלים גרסה ערוכה. המערכת מריצה מתחת את CompVis/stable-diffusion, וכוללת גם אפשרות לשלוח בלחיצת כפתור תוצאה שנוצרה מטקסט ישירות לעריכה בלשונית של תמונה לתמונה.

מתאים ל

  • איור בסגנון סיני מסורתי

    יצירת דימויים ויזואליים שנשענים על סגנון הציור הסיני המסורתי ישירות מתיאור טקסט.

  • עריכת אזורים בתמונה קיימת

    העלאת קובץ קיים, סימון מסכה על פרט שרוצים להחליף והזנת תיאור טקסט לשינוי המבוקש.

  • הפקת סטים של תמונות קונספט

    יצירה מקבילה של עד ארבע וריאציות לסגנונות כמו סטימפאנק או צילום קולנועי עם סיד מוגדר.

איפה זה נופל

הממשק כולל חסימות מובנות לקלטים בלתי הולמים ולתמונות שמסומנות כתוכן למבוגרים, כך שבמקרים כאלה תתקלו בשגיאה במקום בתמונה. החומרה החלשה הופכת יצירה של מספר תמונות ברזולוציה גבוהה לחוויה אטית מאוד. בנוסף, חלקי ממשק רבים מופיעים בסינית לצד אנגלית, ואין תמיכה מובנית בטקסטים בעברית.

שאלות
נפוצות

האם השימוש בממשק כרוך בתשלום?

לא, הממשק פתוח לחלוטין לגישה ישירה דרך הדפדפן. אין צורך להזין פרטי אשראי או לבחור מסלול בתשלום כדי להתחיל לייצר תמונות. כל האפשרויות זמינות מיד עם פתיחת העמוד.

כמה זמן לוקח לכל תמונה להיווצר?

האפליקציה רצה על חומרת מעבד בסיסית בלבד ללא כרטיס מסך גרפי. בגלל זה, זמן העיבוד ארוך משמעותית ממה שרואים במערכות מואצות GPU. בחירה ברזולוציה של 1024 פיקסלים או בארבע תמונות במקביל תאריך את ההמתנה עוד יותר.

מה קורה עם התמונות והטקסט שמעלים למערכת?

המידע נשלח ישירות לקוד השרת שמבצע את החישוב ומחזיר את התוצאה לגלריה בדפדפן. הקוד מכיל מסננים אוטומטיים שבודקים שהטקסט והתמונות אינם מוגדרים כתוכן למבוגרים או תוכן בלתי הולם. אם המערכת מזהה תוכן חסום, היא עוצרת ופולטת שגיאה.

מה ההבדל בין הכלי הזה לבין מודל הבסיס?

הכלי מציע מעטפת נוחה עם הגדרות סגנון מובנות מראש, כמו בחירה מהירה בציור סיני מסורתי או בסגנון קולנועי. בנוסף, הוא מחבר בין מנגנון יצירת הטקסט לבין עריכת תמונות קיימות עם מסכה בלשונית נפרדת, כך שלא צריך לבנות את ממשק העבודה לבד.

איך מריצים

בוחרים לשונית, מקלידים הנחיה בתיבת הטקסט ולוחצים על כפתור Generate. החומרה שהוגדרה להרצה היא מעבד רגיל בלבד ללא מאיץ גרפי ייעודי, מה שאומר שזמן ההמתנה לכל תמונה יהיה ארוך באופן מורגש, בייחוד אם בוחרים ברזולוציות של 1024 או בכמות של ארבע תמונות במקביל. אין צורך בהרשמה או התחברות כדי להתחיל לעבוד.

pip install -U huggingface_hub
hf download BAAI/AltDiffusion

הרישיון

הפרויקט פועל תחת רישיון creativeml-openrail-m. הרישיון מאפשר שימוש חופשי כולל שימושים מסחריים מסוימים, אך אוסר על יצירת תוכן פוגעני, מזיק או מפר חוק.

  • שימוש מסחרי
  • שינוי הקוד
  • מגבלות שימוש ברישיון

הרישיון המלא בעמוד המודל ↗