GPT
O

openjourney-v4

קוד פתוח

promptherocreativeml-openrail-m2022-12-11

  • diffusers
  • safetensors
  • stable-diffusion
  • text-to-image
  • endpoints_compatible

יש כאן גם סקירה על PromptHero עצמו.

התאמה של סטייבל דיפיוז'ן שמנסה לחקות את הסגנון הגרפי של מידג'רני מגרסה ארבע. המודל מתאים למי שרוצה תמונות עם מראה אמנותי מובהק בלי לשלם מנוי חודשי לשירות סגור.

  • 860Mפרמטרים
  • 12.2 GBמשקל הקבצים
  • 1,350הורדות בחודש
  • 1,251לייקים

מה זה

מדובר באימון המשך על בסיס סטייבל דיפיוז'ן 1.5, שנעשה בעזרת מאגר של מעל 124 אלף תמונות שנוצרו בגרסה הרביעית של מידג'רני. המפתחים רצו לשחזר את הטאץ' האמנותי והתאורה האופיינית של הכלי ההוא, אבל בתוך מודל פתוח שאפשר להתקין ולהריץ מקומית.

תהליך האימון לקח מעל 32 שעות, וכלל 12,400 צעדים על פני ארבע תקופות אימון. להבדיל מגרסאות מוקדמות של הפרויקט, כאן כבר אין צורך להוסיף פרומפט מיוחד כמו מילת הקוד שהייתה חובה קודם כדי להפעיל את הסגנון, והתוצאות מקבלות את האופי הרצוי ישירות מהתיאור החופשי שתכתבו.

מתאים ל

  • איורי קונספט למשחקים

    הסגנון הוויזואלי האמנותי של מידג'רני מתאים לייצור מהיר של דמויות, נופים ורעיונות גרפיים.

  • עטיפות ותמונות אווירה

    התאורה הדרמטית והצבעוניות העשירה מעניקות מראה מלוטש לפוסטים, מאמרים או רקעים.

  • הרצה מקומית ללא עלות

    מאפשר לעבוד אופליין ובחינם בלי תלות במנויים חודשיים לפלטפורמות סגורות.

איפה זה נופל

הבסיס הוא סטייבל דיפיוז'ן 1.5 הוותיק מסוף שנת 2022, ולכן הוא סוחב איתו את כל הבעיות המוכרות של הדור ההוא. הוא מתקשה ברינדור של טקסט בתוך תמונה, נוטה לייצר אנטומיה מעוותת של ידיים ואצבעות, ומתקשה להבין סצנות מורכבות עם המון פרטים נפרדים.

בנוסף, המודל אומן בצורה אגרסיבית על תמונות שנוצרו במערכת אחרת, מה שגורם לו לפעמים לכפות סגנון ציורי מודגש גם כשמבקשים ממנו משהו ריאליסטי או נקי. לפני שמשלבים אותו במוצר, צריך לבדוק היטב אם הסגנון שלו בכלל מתאים למיתוג שלכם.

אותה משפחה

openjourney יצא ב־2 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם צריך להוסיף מילים מיוחדות לפרומפט כדי לקבל את הסגנון?

בגרסה הזו כבר לא. בעוד שבגרסאות קודמות היה צריך להדביק מחרוזת ייעודית, כאן המודל מכויל לספק את הסגנון הגרפי באופן ישיר לכל תיאור טקסטואלי.

האם המודל מבין עברית בפרומפטים?

לא. הבסיס של המודל אומן על אנגלית, וכך גם הנתונים של מידג'רני. אם תכתבו בעברית תקבלו תוצאות אקראיות או שגיאות, ולכן חובה להזין הנחיות באנגלית בלבד.

איך מריצים

המודל רץ בעזרת ספריית diffusers הסטנדרטית בפייתון, כך שהשילוב בקוד קיים דורש מעט מאוד עבודה. עם כמעט 860 מיליון פרמטרים, כרטיס מסך ביתי עם 8 עד 12 גיגה זיכרון יספיק כדי לקבל תמונות תוך שניות בודדות.

אם אין לכם כרטיס מסך מתאים במחשב או בשרת, להוריד 12.2 גיגה של קבצים ולהחזיק מכונה ייעודית בענן יעלה כסף מיותר. במצב כזה, פנייה לפתרון שמגיש את המודל דרך ממשק רשת מרוחק תהיה פשוטה וזולה יותר להרצה מזדמנת.

from diffusers import DiffusionPipeline

pipe = DiffusionPipeline.from_pretrained("prompthero/openjourney-v4")
img = pipe("a photo").images[0]

הרישיון

הרישיון הוא creativeml-openrail-m, שמאפשר שימוש מסחרי חופשי כמעט לגמרי, אך כולל נספח של הגבלות שימוש אסורות כמו יצירת תוכן פוגעני, זיוף פנים או ייצור מידע מטעה. מי שמשלב את המודל במוצר מסחרי חייב לוודא שהאפליקציה שלו עומדת בתנאים האלה ושמגבלות הרישיון מועברות למשתמשי הקצה.

  • שימוש מסחרי
  • שינוי הקוד
  • מגבלות שימוש ברישיון

הרישיון המלא בעמוד המודל ↗