GPT
Q

Qwen-Image-Edit-2511-Object-Adder

קוד פתוח

prithivMLmodsapache-2.02026-01-04

  • diffusers
  • lora
  • object-adder
  • art
  • image-to-image

המתאם הזה מתמחה בהוספת עצמים ספציפיים לתמונות קיימות. מי שבוחר בו רוצה לשתול אלמנט בלי שהתאורה, הצללים והרקע המקורי ישתנו או ייהרסו מסביב.

  • 225 MBמשקל הקבצים
  • 12,338הורדות בחודש
  • 40לייקים

מה זה

מדובר במתאם מסוג LoRA ששוקל 225 מגה בייט בלבד, ונבנה כדי להתלבש על מודל הבסיס של Qwen לעריכת תמונה. המטרה הבלעדית שלו היא לפתור בעיה מוכרת בעריכת תמונה גנרטיבית, שבה הוספה של פריט חדש גורמת לעיוות של כל הסצנה מסביב. לפי התיעוד הוא מיועד לשמור במדויק על טקסטורות, מבנה הסצנה והתאורה הקיימת בזמן שהוא משלב את הפריט המבוקש.

המשקל הנמוך של הקבצים מראה שלא מדובר במודל מלא אלא בשכבת משקלים קטנה ויעילה. היא תואמת לגרסאות 2509 ו־2511 של מודל הבסיס, ומאפשרת לשלב מודל ייעודי להאצה שמסוגל לעבוד ב־4 צעדים בלבד כדי לקבל תוצאה מהירה ברזולוציה גבוהה.

מתאים ל

  • הלבשת מוצרים ופריטי לבוש

    הוספת פריטים כמו כובעים או משקפיים על גבי דמויות קיימות תוך שמירה על התאורה המקורית של הפנים.

  • שילוב סמלים ומיתוג

    הטמעת סמלים או עיצובים גרפיים על גבי משטחים בתמונה בלי לפגוע במרקם ובצללים הטבעיים מסביב.

  • עיבוד תמונות מהיר במוצר

    הפעלת עריכות נקודתיות ב־4 צעדים בלבד בעזרת מודל האצה מתאים כדי לקבל זמני תגובה קצרים למשתמשים.

איפה זה נופל

המתאם הזה דורש שימוש בנוסח הנחיה קבוע ונוקשה מאוד כדי להפעיל את ההתנהגות הרצויה. הוא אומן עבור משימה אחת בלבד, הוספת עצמים, ולכן לא מתאים להסרה, לשינוי סגנון או לעריכות צבע כלליות. בנוסף, השפה המוגדרת היא אנגלית בלבד, כך שלא כדאי לנסות לתת לו הנחיות בעברית בלי לתרגם אותן קודם. מי שצריך עריכות מורכבות יותר יצטרך לבדוק ידנית איך הוא מתמודד עם זוויות צילום חריגות או סצנות עמוסות מדי.

שאלות
נפוצות

האם אפשר להריץ את המתאם הזה בלי מודל הבסיס?

לא. מדובר בקובץ LoRA במשקל 225 מגה בייט שמכיל רק משקלי התאמה. הוא מחייב הורדה וטעינה מלאה של Qwen-Image-Edit ברקע דרך ספריית diffusers.

האם אפשר לכתוב לו הנחיות חופשיות לגמרי?

הכרטיס מדגיש שיש להשתמש בתבנית טקסט קבועה מראש שכוללת הנחיה לשמור על התאורה והרקע, ואליה מוסיפים את העצם הספציפי שרוצים לייצר.

איך מריצים

טוענים את מודל הבסיס של Qwen דרך ספריית diffusers בפורמט bfloat16 על כרטיס מסך, וטוענים לתוכו את משקלי ה־LoRA האלה. הריצה המקומית דורשת כרטיס תואם CUDA או מעבדי אפל עם mps, כשהמשקל הנוסף של המתאם עצמו זניח ורוב צריכת הזיכרון נקבעת לפי מודל הבסיס.

אם אין לכם כרטיס מסך חזק שמחזיק את מודל הבסיס של Qwen בזיכרון, עדיף לפנות ל־API חיצוני שמארח את המודלים האלה במקום לנסות להרים את כל הסביבה לבד.

from diffusers import DiffusionPipeline

pipe = DiffusionPipeline.from_pretrained("prithivMLmods/Qwen-Image-Edit-2511-Object-Adder")
img = pipe("a photo").images[0]

הקבצים

4 קבצים במאגר, 225 MB סך הכול. הקישורים מובילים ישירות ל־Hugging Face.

הרישיון

המתאם משוחרר ברישיון apache-2.0. מותר להשתמש בו לצרכים מסחריים, לשנות אותו, להפיץ אותו ולשלב אותו במוצרים סגורים, כל עוד שומרים על הודעת זכויות היוצרים והרישיון המקורי. יש לוודא בנפרד גם את תנאי הרישיון של מודל הבסיס של Qwen שעליו הוא מולבש.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗