GPT
F

flux-klein-9b-virtual-tryon-lora

קוד פתוח

falapache-2.02026-02-24

  • diffusers
  • flux
  • flux-klein
  • lora
  • virtual-try-on

המודל הזה מלביש דמות מתמונה אחת בבגדים משתי תמונות נפרדות. הוא חוסך צילומים פיזיים ומייצר תמונת גוף מלא עם הבגדים המבוקשים.

  • 270 MBמשקל הקבצים
  • 6,001הורדות בחודש
  • 147לייקים

מה זה

מדובר במשקולת LoRA קטנה של 270 מגה בייט שמתלבשת על מודל הבסיס Flux Klein 9b Edit. התפקיד שלה מוגדר וצר, מדידה וירטואלית של בגדים. מעלים שלוש תמונות קלט בסדר קשיח של אדם, חלק עליון וחלק תחתון, ומקבלים תמונה אחת של הדמות לבושה באאוטפיט הזה ברזולוציה של עד 1024 פיקסלים.

בניגוד לכלים גנריים לעריכת תמונות שדורשים מסיכות ומאבדים את הפרופורציות של הבגד המקורי, כאן האימון כוון ישירות לחבר בין חלקי לבוש שונים לגוף. הוא תומך בגברים ונשים, במגוון תנוחות ומבני גוף, ומכיר פריטים נפוצים כמו טי שירטס, קפוצ'ונים, ז'קטים, ג'ינסים וחצאיות. כדי שהעסק יעבוד הוא דורש מילת הפעלה ייעודית, תיאור טקסטואלי מפורט של הפריטים וערכי הנחיה מדויקים.

מתאים ל

  • הדמיית קטלוג לאופנה

    מלבישים דוגמן בפריטי עליון ותחתון שונים ישירות מתמונות פריט על רקע נקי, בלי הפקות צילום יקרות לכל שילוב.

  • מדידה וירטואלית באתרי מכר

    משלבים בתוך חנות איקומרס כדי לאפשר לקונים להעלות תמונה ולראות איך בגד עליון ומכנסיים נראים עליהם יחד.

  • עיצוב ויצירת לוקבוק

    מייצרים שילובים חדשים של קולקציות מתוך תמונות מוצר קיימות עוד לפני תפירת הבגדים בפועל.

איפה זה נופל

הכלי מוגבל מאוד בתנאי הקלט שלו. הוא מחייב בדיוק שלוש תמונות לפי סדר, אדם, חלק עליון וחלק תחתון. אם יש לכם רק שמלה או רק חולצה להחלפה, המבנה הזה פחות מתאים. הוא תלוי לחלוטין ברקע נקי של תמונות הבגדים ובתאורה עקבית ביניהן. בנוסף, חובה לתאר בטקסט במדויק את הבגדים ואת האדם, אחרת הוא מתקשה להבין לבד מה לעשות.

שאלות
נפוצות

האם אפשר להריץ את המודל רק עם תמונה של חולצה בלי מכנסיים?

לא מומלץ. הארכיטקטורה אומנה ומצפה לקבל בדיוק שלוש תמונות לפי סדר של אדם, חלק עליון וחלק תחתון, וחריגה מהמבנה הזה תפגע בתוצאה הסופית.

האם אפשר להסתפק בהעלאת התמונות בלי לכתוב תיאור טקסטואלי מורכב?

המודל דורש פרומפט מפורט שמתחיל במילת ההפעלה TRYON ומתאר את הדמות ואת הבגדים. בלי תיאור של הצבעים והטקסטורות בטקסט, איכות ההלבשה יורדת משמעותית.

איך מריצים

הקובץ עצמו קל מאוד וזמין בשתי גרסאות, אחת לשימוש דרך diffusers או השרתים של fal, והשנייה מותאמת ישירות למי שעובד עם ComfyUI. אבל כאן מגיע המלכוד, ה־LoRA אמנם שוקלת מעט, אבל מודל הבסיס הוא Flux בגודל 9 מיליארד פרמטרים. להריץ דבר כזה מקומית דורש מעבד גרפי חזק עם מספיק זיכרון וידאו בשביל מודל הבסיס יחד עם פענוח שלוש תמונות קלט בו זמנית.

אם אין לכם כרטיס מתאים עם נפח VRAM משמעותי, אין טעם להסתבך עם התקנה מקומית. הפעלת המודל דרך ה־API שפורסם בקוד הדוגמה חוסכת תחזוקת שרתים כבדים ומשלמת רק פר ריצה של 28 צעדי דגימה.

from diffusers import DiffusionPipeline

pipe = DiffusionPipeline.from_pretrained("fal/flux-klein-9b-virtual-tryon-lora")
img = pipe("a photo").images[0]

הרישיון

הקוד והמשקולות שוחררו תחת רישיון apache-2.0. מותר להשתמש בהם לצרכים מסחריים, לשנות את הקוד ולהטמיע אותו במוצרים פרטיים בלי תמלוגים, כל עוד שומרים על הודעת זכויות היוצרים ומצרפים עותק של הרישיון המקורי.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗