GPT
A

AWPortraitCN2

קוד פתוח

Shakker-Labsother2025-03-30

  • diffusers
  • text-to-image
  • stable-diffusion
  • image-generation
  • flux

התאמת LoRA לתמונות שמתמקדת באסתטיקה מזרח אסייתית, פורטרטים בכל הגילאים, לבוש מסורתי ונופים. שוקל פחות מגיגהבייט ונטען ישירות מעל מודל הבסיס בלי מילות הפעלה.

  • 596 MBמשקל הקבצים
  • 233הורדות בחודש
  • 116לייקים

מה זה

מדובר במשקולות LoRA שפותחו כגרסה שנייה למודל קודם באותה סדרה, מתוך מטרה לדייק יצירת דמויות וסביבות בסגנון מזרח אסייתי. ההבדל המרכזי מול הגרסה הקודמת הוא הרחבת מאגר האימון לפנים בקבוצות גיל שונות, לצד יכולת טובה יותר להבין תיאורים של אוכל, אדריכלות, נופים ותלבושות מסורתיות.

המודל מתחבר לספריית diffusers ורץ כתוספת שכבות, מה שמסביר את המשקל הצנוע שלו שעומד על 596 מגהבייט בלבד. היוצרים ממליצים להריץ אותו במשקל LoRA שנע בין 0.9 ל־1 כדי לקבל את הסגנון המלא בלי לשבור את יכולות מודל הבסיס שעליו הוא יושב.

מתאים ל

  • פורטרטים אסייתיים

    יצירת דמויות מדויקות בטווח גילאים רחב עם תווי פנים מותאמים, בלי עיוותים שמגיעים ממודלים מערביים.

  • סצנות היסטוריות ותרבותיות

    שילוב לבוש מסורתי ואדריכלות מזרחית שנשענים על אימון ממוקד בנושאים האלה.

  • הדמיות נוף ורחוב פיוטיות

    הפקת סביבות עירוניות או כפריות בסגנון מזרח אסייתי עם שליטה טובה באווירה.

איפה זה נופל

המודל מוגדר ומאומן באנגלית בלבד, כך שפרומפטים בעברית יתנו תוצאות אקראיות אם לא תתרגמו אותם מראש. המיקוד שלו מאוד ספציפי לאסתטיקה אסייתית, ולכן הוא לא מתאים ליצירת פורטרטים מערביים כלליים. מעבר לכך, היוצרים לא פרסמו מדדי ביצועים או השוואות כמותיות, כך שאין דרך לדעת כמה הוא עקבי בפרטים מורכבים לפני שמנסים אותו ידנית.

שאלות
נפוצות

האם צריך להוסיף מילות הפעלה מיוחדות בטקסט?

לא, המפתחים ציינו במפורש שאין צורך במילות הפעלה כדי לקבל את הסגנון. מספיק להגדיר את משקל ה־LoRA בטווח של 0.9 עד 1 ולתאר את הסצנה כרגיל.

האם אפשר להשתמש במודל הזה לפרויקט מסחרי שפתוח למשתמשים משלמים?

ממש לא. המודל שוחרר תחת תנאי הרישיון של FLUX.1-dev שאוסרים שימוש מסחרי מכל סוג, כך שתוכלו להריץ אותו רק לניסויים ופיתוח פנימי.

איך מריצים

בגלל שמדובר בתוסף LoRA קל משקל, אתם לא מריצים אותו לבד אלא טוענים אותו מעל מודל בסיס תואם דרך diffusers. החומרה שתצטרכו תיקבע לפי מודל הבסיס, שלפי תנאי הרישיון הוא כנראה ממשפחת FLUX.1-dev, מה שמחייב כרטיס מסך עם לפחות 16 עד 24 גיגהבייט זיכרון כדי לעבוד מקומית בצורה סבירה.

אם אין לכם כרטיס מסך חזק פנוי בשרת או בעמדת העבודה, אין היגיון להתעקש להרים את כל הסביבה לבד. במקרה כזה עדיף להשתמש בתשתית ענן או שירות שמציע מודלי בסיס עם טעינת משקולות חיצוניות לפי קריאה.

from diffusers import DiffusionPipeline

pipe = DiffusionPipeline.from_pretrained("Shakker-Labs/AWPortraitCN2")
img = pipe("a photo").images[0]

הרישיון

הרישיון מוגדר כ־other ומפנה בפועל לרישיון הלא מסחרי של FLUX.1-dev. המשמעות פשוטה: אסור להשתמש במודל הזה למוצרים מסחריים, למכור שירות סביבו או לגבות כסף על תמונות שנוצרות ממנו. הוא מיועד למחקר, בדיקות ושימוש אישי בלבד.

הרישיון המלא בעמוד המודל ↗