GPT
V

virtual-tryoff-lora

קוד פתוח

falapache-2.02026-03-05

  • diffusers
  • flux.2
  • image-to-image
  • virtual-try-off
  • fal

המודל מבודד בגד מתוך תמונה של אדם שלובש אותו ומייצר תמונת פקשוט נקייה שלו. הוא מיועד למי שרוצה לחלץ פריטי אופנה ישירות מצילומים ללא צורך בצילום סטודיו נפרד.

  • 397 MBמשקל הקבצים
  • 3,265הורדות בחודש
  • 48לייקים

מה זה

במקום להלביש דוגמן וירטואלי, המודל הזה עושה בדיוק את הפעולה ההפוכה. אתם מספקים תמונה של אדם לבוש ופרומפט טקסטואלי שמגדיר את קטגוריית הבגד, ומקבלים תמונה בודדת של הפריט בלבד, כשהוא מונח או מצולם לבד על רקע נקי. המטרה שלו היא לשחזר את הגזרה, הטקסטורה, הצבע והעיצוב של הבגד המקורי מתוך התמונה שבה הוא נלבש.

מבחינת מבנה, זהו אימון LoRA שיושב על גבי מודל הבסיס FLUX.2-klein-base-9B. האימון עצמו בוצע לאורך 10,000 צעדים בקצב למידה של 0.00005, תוך שימוש במאגר של 300 זוגות תמונות ברזולוציה של 1024x1024 פיקסלים. ההתמקדות כאן היא במשימת image-to-image צרה מאוד של חילוץ בגדים, מה שמאפשר לו לשמור על מאפייני הבד בלי לנסות לפתור בעיות גנרטיביות רחבות יותר.

מתאים ל

  • יצירת קטלוג מאתרי אופנה

    חילוץ תמונות מוצר נקיות מתוך צילומי רחוב או צילומי דוגמנות קיימים.

  • אינדוקס פריטי יד שנייה

    המרת תמונות שמשתמשים מעלים כשהם לובשים את הבגד לתמונות פריט ברורות למכירה.

  • צנרת עיבוד תמונה בווידאו

    שילוב בתוך תהליכי עבודה שמייצרים סרטונים מפריטי לבוש מבודדים.

איפה זה נופל

האימון התבסס על מאגר קטן של 300 זוגות תמונות בלבד. דאטה־סט בהיקף כזה מעלה חשש כבד לגבי היכולת של המודל להתמודד עם פריטי לבוש יוצאי דופן, הדפסים מורכבים במיוחד או תנוחות גוף שמסתירות חלקים גדולים מהבגד. בנוסף, התהליך דורש הגדרה ידנית של קטגוריית הבגד בטקסט, כך שאם הפרומפט לא מדויק או שהבגד חריג, השחזור של הצבע והמרקם עלול להיפגע.

שאלות
נפוצות

האם אפשר להריץ את ה־LoRA הזה לבד בלי מודל נוסף?

לא. מדובר במשקלי התאמה בלבד ששוקלים כ־397 מגה־בייט, והם חייבים להיטען יחד עם מודל הבסיס FLUX.2-klein-base-9B כדי לייצר תמונות בפועל.

האם המודל יודע להפריד כמה בגדים מאותה תמונה?

התהליך מקבל תמונה אחת ופרומפט של קטגוריית בגד ומחזיר תמונה של פריט בודד. אם יש כמה פריטים, צריך להריץ את התהליך בנפרד עבור כל קטגוריה שרוצים לחלץ.

איך מריצים

כדי להריץ אותו עצמאית תצטרכו לטעון את משקלי ה־LoRA מעל מודל הבסיס FLUX.2-klein-base-9B. המודל תומך בספריית diffusers ויש לו גם קובץ safetensors ייעודי שמתאים ישירות לעבודה ב־ComfyUI, כך שאפשר לשלב אותו בצורה נוחה בצנרת עבודה קיימת.

משקל קובצי ה־LoRA עצמם הוא 397 מגה־בייט בלבד, אבל מודל הבסיס דורש חומרה כבדה שמסוגלת להחזיק תשעה מיליארד פרמטרים בזיכרון ה־GPU. אם אין לכם כרטיס מסך מתאים עם מספיק זיכרון וידאו להרצת מודל בגודל הזה, עדיף להשתמש ב־Playground או בסביבת העבודה של fal.ai, שמספקים גישה ישירה למודל ולתהליך העבודה בלי לנהל תשתית מקומית.

from diffusers import DiffusionPipeline

pipe = DiffusionPipeline.from_pretrained("fal/virtual-tryoff-lora")
img = pipe("a photo").images[0]

הרישיון

המודל שוחרר תחת רישיון apache-2.0. הרישיון הזה מאפשר שימוש מסחרי חופשי, שינוי של הקוד והמשקלים והפצה שלהם, כולל שילוב במוצרים סגורים. התנאי העיקרי הוא שמירה על הודעת זכויות היוצרים ונוסח הרישיון המקורי בקבצים שמפיצים הלאה.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗