GPT
Q

Qwen-Image-Edit-2511-Object-Remover

קוד פתוח

prithivMLmodsapache-2.02026-01-03

  • diffusers
  • lora
  • object-remover
  • art
  • image-to-image

מתאם משקלים קל שמיועד להעלמת עצמים מתמונות לפי הוראה טקסטואלית. הוא מתלבש ישירות על תשתית העריכה של קוון ושומר על הרקע המקורי.

  • 225 MBמשקל הקבצים
  • 9,116הורדות בחודש
  • 75לייקים

מה זה

מדובר במתאם מסוג לורה ששוקל 225 מגה בייט בלבד, ומיועד להרצה מעל מודל הבסיס של עריכת תמונות מבית קוון. המטרה שלו מוגדרת מאוד, מחיקת פריטים מתוך תמונה קיימת על בסיס הנחיית טקסט באנגלית, בלי להרוס את שאר הסצנה שמסביב. במקום לצייר מסיכה ידנית על האזור שרוצים למחוק כמו בכלים ישנים, כותבים לו מה להוריד והוא מנקה את החלק הזה לבד.

ההבדל המרכזי כאן לעומת שימוש במודל גנרטיבי כללי הוא ההתמקדות בעקביות. המתאם אומן לשמור על התאורה המקורית, הצללים והמרקם של הרקע במקום להמציא מחדש אזורים שלמים בתמונה. אפשר לחבר אותו גם למודל תאורה מואץ בארבעה צעדים כדי לקבל פלט מהיר ברזולוציה גבוהה. הוא תואם לגרסאות 2509 ו־2511 של מודל המקור, כך שמי שכבר מחזיק את המשקלים של קוון על השרת יכול להוסיף את יכולת המחיקה בקלות ובלי לבזבז נפח אחסון משמעותי.

מתאים ל

  • הסרת לוגואים

    מחיקת סימני מיתוג או טקסטים מחולצות ומוצרים לפי פרומפט טקסטואלי פשוט.

  • ניקוי אביזרים מפורטרטים

    הורדת משקפיים או שרשראות מתמונות פנים תוך שמירה מלאה על תווי הפנים והתאורה.

  • עריכת תמונות קטלוג

    סילוק עצמים מיותרים שנתפסו ברקע הצילום בלי לפגוע במרקם המקורי של הסצנה.

איפה זה נופל

המודל הזה תלוי לגמרי במבנה ניסוח קשיח. כדי שהוא יבצע מחיקה נקייה, צריך להשתמש בפרומפט ספציפי מאוד שכולל נוסח קבוע של שמירה על הרקע והפרטים המקוריים, יחד עם ציון שם העצם באנגלית. הוא לא תומך בעברית, כך שכל הנחיה חייבת לעבור תרגום. בנוסף, מדובר בהתאמה ממוקדת למחיקה בלבד, ולא בכלי שיודע להחליף אלמנט באלמנט אחר באותו צעד.

שאלות
נפוצות

האם הקובץ של 225 מגה בייט עובד לבד?

לא. זהו מתאם לורה בלבד, ולכן הוא חייב את מודל הבסיס המלא של קוון לעריכת תמונות כדי לפעול. ההורדה הקטנה רק מוסיפה את מיומנות המחיקה למודל העיקרי שכבר צריך להיות מותקן אצלכם.

איך אומרים למודל מה למחוק בלי להרוס את שאר התמונה?

הכרטיס מחייב שימוש בנוסח קבוע באנגלית. אתם משלבים את שם האובייקט בתוך תבנית שמבקשת במפורש להסיר את הפריט תוך שימור הרקע והאלמנטים הנותרים, בדיוק כפי שהוגדר באימון.

איך מריצים

כדי להריץ אותו צריך להחזיק קודם כל את מודל הבסיס המלא של קוון, שאינו כלול בקבצים האלה. הקוד רץ דרך ספריית דיפיוזרס, דורש פייתון עם חבילות כמו אקסלרייט וטרנספורמרס, וטוען את קובצי הלורה ישירות לתוך הפייפליין. צריך כרטיס מסך מבוסס קודה עם תמיכה בביפלוט16, או מכשיר אפל שמריץ אמ פי אס.

מי שאין לו כרטיס מסך חזק שמסוגל לטעון את מודל הבסיס הגדול של קוון, לא ירוויח מהמשקל הקטן של המתאם הזה. במצב כזה עדיף להשתמש בפתרון ענן או בממשק חיצוני מוכן, כי הרצת תשתית כזו עבור כמה מחיקות בודדות תדרוש משאבי שרת כבדים בהרבה ממה שנראה לפי 225 המגה בייט של הקובץ.

from diffusers import DiffusionPipeline

pipe = DiffusionPipeline.from_pretrained("prithivMLmods/Qwen-Image-Edit-2511-Object-Remover")
img = pipe("a photo").images[0]

הקבצים

4 קבצים במאגר, 225 MB סך הכול. הקישורים מובילים ישירות ל־Hugging Face.

הרישיון

הרישיון הוא אפאצ'י 2.0, שזה רישיון קוד פתוח מתירני מאוד. מותר להשתמש בו במוצרים מסחריים, לשנות את הקוד ולהפיץ אותו הלאה, כל עוד שומרים על הודעת זכויות היוצרים ונוסח הרישיון המקורי. אין כאן הגבלה על שילוב באפליקציות פנימיות או חיצוניות.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗