GPT
Q

qwen_image_edit_inpainting

קוד פתוח

ostrisapache-2.02025-09-03

  • diffusers
  • text-to-image
  • lora

המודל הזה מבצע עריכת תמונה בשיטת מסך ירוק על גבי Qwen. אתם צובעים שטח בירוק טהור, כותבים הנחיה בטקסט, והוא משלים את האזור לפי הבקשה.

  • 569 MBמשקל הקבצים
  • 6,848הורדות בחודש
  • 90לייקים

מה זה

מדובר במשקולת LoRA שפותחה עבור מודל Qwen Image Edit, וכל מטרתה היא עבודת אינפיינטינג נקודתית בתמונות. במקום להסתבך עם יצירת מסיכות אלפא מורכבות או ערוצים נפרדים בצינור העיבוד, הגישה כאן ישירה ופשוטה. אתם צובעים את החלק שרוצים להחליף בצבע ירוק בוהק, והמשקולת מזהה את השטח הצבוע בתור המקום הבלעדי שעליו יש להחיל את שינויי הטקסט.

התוספת שוקלת 569 מגה בייט בלבד, כך שהיא לא דורשת שטח אחסון כבד ונטענת ישירות מעל מודל הבסיס בספריית diffusers. אין בכרטיס המודל נתוני מבחן השוואתיים או ציוני בנצ'מרק, כך שאי אפשר לדעת מראש עד כמה הוא מדויק בשמירה על סגנון התמונה המקורית ביחס לפתרונות אינפיינטינג אחרים. מה שבטוח הוא שתהליך העבודה שהוא מציע חוסך התעסקות עם שכבות נפרדות למי שמעדיף לסמן שינויים בצורה ויזואלית ישירה על הפיקסלים.

מתאים ל

  • החלפת עצמים בצילום

    צובעים פריט בודד בירוק ומבקשים עצם חלופי שמשתלב באותה נקודה.

  • מחיקת רקעים ופרטים

    כיסוי אזורים מיותרים בירוק והשלמת הרקע בצורה שתואמת את סביבת התמונה.

  • שינוי הבעות פנים או לבוש

    סימון אזור ספציפי בגוף או בבגד לצורך שינוי פרטים מבלי להרוס את שאר הדמות.

איפה זה נופל

המגבלה המרכזית היא הדרישה הנוקשה לצבע ירוק טהור בערכי RGB של אפס, מאתיים חמישים וחמש, אפס. אם השטח שתצבעו יסטה אפילו במעט מהגוון הזה, או אם תהיה דחיסת תמונה שתשבש את ערכי הפיקסלים, הוא פשוט יפספס את המסיכה. חוץ מזה, היוצר כמעט לא פירט מגבלות טכניות בעמוד המודל, ולכן תצטרכו לבדוק בעצמכם איך הוא מתמודד עם תמונות ברזולוציה גבוהה או עם קצוות מורכבים.

שאלות
נפוצות

האם אפשר להשתמש בכל גוון ירוק לצורך הסימון?

לא. ההגדרה מחייבת ירוק טהור בלבד, עם ערכים מדויקים של אפס באדום ובכחול, ומאתיים חמישים וחמש בירוק. גוון אחר לא יזוהה כמו שצריך.

האם הקובץ הזה עובד לבדו כמחולל תמונות?

לא, מדובר במשקולת LoRA שצריכה להיטען מעל מודל הבסיס Qwen Image Edit כדי לפעול. אי אפשר לייצר בעזרתה תמונות מאפס בלי תשתית המודל המרכזי.

איך מריצים

המודל רץ בספריית diffusers כתוסף LoRA מעל מודל הבסיס של Qwen לעריכת תמונות. בגלל שמדובר רק במשקולת קטנה, צריכת המשאבים שלו זניחה יחסית, אבל אתם עדיין חייבים כרטיס מסך חזק מספיק כדי להחזיק בזיכרון את מודל התמונה הראשי.

אם אין לכם שרת עם מאיץ גרפי פנוי שמריץ כבר את סביבת העבודה של Qwen, עדיף להשתמש בפתרון מנוהל בענן או ב־API קיים. התקנה מקומית תדרוש מכם להגדיר את צינור התמונה המלא, לטעון את המשקולות האלו מעליו ולוודא שהקוד שלכם מכין את התמונות כראוי.

from diffusers import DiffusionPipeline

pipe = DiffusionPipeline.from_pretrained("ostris/qwen_image_edit_inpainting")
img = pipe("a photo").images[0]

הרישיון

הרישיון הוא Apache 2.0. מותר להשתמש בו לצרכים מסחריים, לשנות את הקוד ולהפיץ אותו בתוך מוצרים שלכם, כל עוד אתם מצרפים עותק של הרישיון המקורי ושומרים על הצהרות זכויות היוצרים.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗