GPT
Q

Qwen-Image-Edit-2509-White_to_Scene

קוד פתוח

dx8152apache-2.02025-10-24

  • diffusers
  • image-to-image

המודל הזה לוקח תמונות מוצר על רקע לבן ושותל אותן בסביבה חדשה לגמרי. הוא מיועד למי שמחפש פתרון קל משקל לעיבוד תמונות קטלוג בלי להסתבך עם עריכה ידנית.

  • 225 MBמשקל הקבצים
  • 2,664הורדות בחודש
  • 125לייקים

מה זה

מדובר במשקולות LoRA קלות במשקל של 225 מגה בייט, שמבוססות על Qwen לעריכת תמונה. המטרה כאן מאוד ממוקדת: לקבל תמונה עם רקע לבן, לזהות את האובייקט המרכזי, ולהלביש מאחוריו ומסביבו רקע שמתאים לפרומפט שתספקו.

היוצר לא פירסם מדדי ביצועים רשמיים או מבחני השוואה מספריים, אלא הדגמות גיף בלבד. מההדגמות האלה רואים שהמודל מתמקד בשמירה על צורת המוצר המקורי בזמן שהוא משנה את הרקע והתאורה סביבו. במקום להחליף פיקסלים בצורה גסה, הוא מנסה למזג את האובייקט בתוך הסצנה החדשה כדי שזה לא ייראה כמו הדבקה.

מתאים ל

  • החלפת רקע לתמונות מוצר

    השתלת מוצרים שצולמו בסטודיו על רקע לבן בתוך סביבות טבעיות לפי תיאור טקסטואלי.

  • יצירת חומרים שיווקיים

    הפקת וריאציות של אותו מוצר בסביבות שונות במהירות ובלי לצלם שוב בסטודיו.

  • פייפליין להזנת קטלוגים

    התאמת תמונות מלאי גולמיות לאתרי מסחר שדורשים רקעים עשירים יותר מרקע לבן חלק.

איפה זה נופל

החיסרון הברור ביותר הוא התלות במילת הפעלה בסינית: 白底图转场景. היוצר מסביר שצריך לכתוב את הפרומפט בסינית או לפחות להתחיל עם הביטוי הזה, מה שמסבך אוטומציות באנגלית או בעברית ומחייב שכבת תרגום בדרך.

בנוסף, הכרטיס לא מספק שום מידע כמותי על כשלונות בשמירה על פרטי המוצר, טקסטים או לוגואים עדינים. חובה לבדוק ידנית איך הוא מתמודד עם השתקפויות, צללים מורכבים ומוצרים בעלי שקיפות לפני שמשלבים אותו בפייפליין של מוצר אמיתי.

שאלות
נפוצות

האם אפשר להריץ את הקובץ הזה לבד?

לא. מדובר בתוסף LoRA במשקל 225 מגה בייט ולא במודל עצמאי. כדי להפיק תמונה חובה לטעון אותו על מודל הבסיס של Qwen יחד עם ה־LoRA הנוסף שצוין בהנחיות.

חייבים לכתוב פרומפטים בסינית?

כן, כרטיס המודל מציין מילת הפעלה ספציפית בסינית ומציג דוגמאות בסינית בלבד. אם תרצו לשלב אותו במערכת שעובדת בעברית או באנגלית, תצטרכו לתרגם את ההנחיות לסינית לפני הפנייה למודל.

איך מריצים

המשקל הכולל של הקבצים הוא 225 מגה בייט בלבד, כך שזמן ההורדה והאחסון זניחים לגמרי. כדי להריץ אותו צריך סביבת פייתון עם ספריית diffusers, אבל הוא לא עובד לבד. המפתח מציין במפורש שחובה לטעון במקביל גם את מודל הבסיס וגם LoRA נוסף בשם lightx2v/Qwen-Image-Lightning כדי לקבל תוצאות תקינות.

דרישות החומרה נגזרות ישירות ממודל הבסיס של Qwen שעליו מלבישים את המשקולות, ולא מגודל קובץ ה־LoRA עצמו. מי שרוצה לבדוק את הביצועים בלי להרים סביבה מקומית יכול להשתמש בהדגמה הזמינה בשירות RunningHub, או להשתמש במודל הבסיס דרך שירותי ענן.

from diffusers import DiffusionPipeline

pipe = DiffusionPipeline.from_pretrained("dx8152/Qwen-Image-Edit-2509-White_to_Scene")
img = pipe("a photo").images[0]

הקבצים

4 קבצים במאגר, 225 MB סך הכול. הקישורים מובילים ישירות ל־Hugging Face.

הרישיון

הרישיון המדווח הוא apache-2.0. זהו רישיון קוד פתוח מתירני שמאפשר שימוש חופשי, שינוי הקוד והפצה, כולל שימוש מסחרי מלא בתוך מוצר סגור, בלי תשלום תמלוגים. התנאי העיקרי הוא שמירה על הודעת זכויות היוצרים והרישיון המקורי. היוצר צירף קישור לתרומה וולונטרית בפייפאל למי שמשתמש במודל למטרות מסחריות, אבל זו בקשה בלבד ולא מגבלה משפטית מחייבת לפי תנאי הרישיון.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗