GPT
A

AWPortraitCN

קוד פתוח

Shakker-Labsother2024-12-04

  • diffusers
  • text-to-image
  • stable-diffusion
  • image-generation
  • flux

ההרחבה הזו מכוונת את מודל הבסיס ליצירת פורטרטים עם אסתטיקה ומאפיינים מזרח אסיאתיים. היא משפרת מרקמי עור בצילומי אופנה וסטודיו בלי להסתבך עם מילות הפעלה.

  • 361 MBמשקל הקבצים
  • 186הורדות בחודש
  • 215לייקים

מה זה

מדובר במשקולות LoRA שפותחו מעל FLUX.1-dev על ידי המשתמש DynamicWang עבור Shakker-Labs. המטרה העיקרית פה היא דיוק במראה של אנשים ממוצא סיני, בתאורות שונות כמו סטודיו, חוץ וצילומי אופנה. במקום המראה החלק והמלאכותי שלפעמים מתקבל במודלי בסיס, הדגש הושם על מרקם עור עדין ונאמן יותר למציאות.

הקובץ שוקל 361 מגה בלבד, מה שאומר שאתם לא מורידים מודל שלם אלא שכבת התאמה קלה. היוצרים ממליצים להריץ את זה יחד עם תהליך עבודה בשם AWPortraitSR אם רוצים להגיע לתוצאה שמדמה צילום גולמי אמיתי, בלי עיבוד יתר.

מתאים ל

  • צילומי אופנה וסטודיו

    יצירת דמויות ממוצא אסייתי עם תאורת סטודיו מוקפדת ומרקם עור משופר.

  • הפקת פורטרטים ריאליסטיים

    התאמת FLUX.1-dev לפנים סיניות בלי צורך להגדיר מילות טריגר בפרומפט.

  • הדמיות תוכן לשוק הסיני

    יצירת חומרי קונספט ויזואליים שמותאמים למאפיינים מקומיים ולאסתטיקה מדויקת.

איפה זה נופל

המודל ממוקד כולו באסתטיקה ובתווי פנים סיניים, כך שהוא לא יתאים לפרויקטים שדורשים גיוון אתני רחב יותר או סגנונות שאינם צילום אנושי. בנוסף, לקבלת המראה הריאליסטי המלא היוצרים מכוונים לשימוש בתהליך עבודה חיצוני נוסף בשם AWPortraitSR, מה שאומר שתמונות ישירות מההרחבה לבדה עלולות לא למצות את הפוטנציאל שהוצג בהדגמות.

שאלות
נפוצות

אפשר להשתמש במודל הזה ישירות לייצור מוצר מסחרי?

לא. המודל יושב תחת תנאי הרישיון הלא מסחרי של FLUX.1-dev, ולכן השימוש בו מוגבל למחקר, ניסויים ופרויקטים אישיים בלבד.

האם חייבים להשתמש במילת הפעלה מסוימת בפרומפט?

אין צורך במילות טריגר בכלל. מה שכן חשוב זה להגדיר בהגדרות הטעינה של ה־LoRA משקל בטווח של 0.9 עד 1 כדי לקבל את השינוי הוויזואלי המבוקש.

האם קובץ של 361 מגה בייט מספיק כדי להפיק תמונות?

לא לבד. מדובר במשקולות אימון מסוג LoRA, ולכן חייבים לטעון אותן יחד עם מודל הבסיס FLUX.1-dev שדורש משאבי מערכת נפרדים.

איך מריצים

טוענים את המשקולות דרך ספריית diffusers מעל מודל הבסיס FLUX.1-dev. בגלל שזה LoRA, אין צורך במילות הפעלה מיוחדות בפרומפט, אבל צריך להגדיר את משקל השכבה לערך שבין 0.9 ל־1 כדי לקבל את האפקט המלא.

אמנם ההרחבה עצמה קטנה מאוד, אבל היא מחייבת הרצה של FLUX.1-dev ברקע, ולכן תצטרכו כרטיס מסך חזק עם מספיק זיכרון וידאו להרצת מודל כזה. מי שלא מחזיק חומרה מתאימה מקומית יכול להשתמש בהרצה בענן באתר של Shakker AI, שם המודל זמין לניסוי ישיר.

from diffusers import DiffusionPipeline

pipe = DiffusionPipeline.from_pretrained("Shakker-Labs/AWPortraitCN")
img = pipe("a photo").images[0]

הרישיון

הרישיון מוגדר כ־other, ובפועל המודל כפוף לתנאי הרישיון הלא מסחרי של FLUX.1-dev. אי אפשר לשלב אותו במוצר שמייצר הכנסות או למכור את הפלטים שלו באופן מסחרי ללא הסדר מתאים מול בעלי הזכויות.

הרישיון המלא בעמוד המודל ↗