GPT
Q

Qwen-Image-Edit-2509-LoRAs-Fast-Fusion

רץ בדפדפן

prithivMLmodsapache-2.02025-11-17

  • gradio
  • mcp-server

עריכת תמונות ממוקדת באמצעות שילוב מודל Qwen עם מתאמי LoRA ייעודיים. אתם מעלים תמונת בסיס ותמונת ייחוס, ויוצרים שילובים מוגדרים בלי להסתבך בהתקנות.

  • הורדות בחודש
  • 116לייקים

מה זה

אתם מעלים שתי תמונות, תמונת בסיס ותמונת ייחוס, כותבים הנחיית טקסט ובוחרים מתאם LoRA מתוך תפריט ייעודי. הפלט שמתקבל הוא תמונה מעובדת בפורמט PNG שמשלבת אלמנטים משני המקורות לפי המשימה שהגדרתם.

מאחורי הקלעים רץ צינור עיבוד המבוסס על מודל Qwen לעריכת תמונות יחד עם מתאמים שונים, כמו מתאם להעברת תאורה של dx8152 או מתאמי הדבקת עיצובים על חולצות של ostris. המערכת משתמשת ברכיבי diffusers עם סדרן מסוג FlowMatchEulerDiscreteScheduler ומעבד תאימות מהיר להאצת החישוב.

הדוגמאות המוכנות מציגות מגוון שימושים מעשיים. בין היתר אפשר לראות העברת תאורה מתמונה אחת לאחרת, הדבקת איור על חולצה, החלפת מרקם של ספל בעץ, שילוב משקפיים על פנים של דמות ואפילו התאמת תחפושת של דמות אנימה על אדם אמיתי תוך שמירה על תווי הפנים.

מתאים ל

  • הדבקת גרפיקה על ביגוד

    לקיחת קובץ עיצוב שטוח והלבשתו באופן מותאם על גבי חולצה של אדם בתמונת הבסיס.

  • העברת תאורה וגוונים

    שינוי האור והצבעים בתמונה המקורית כך שיתאימו לאווירה ולתאורה של תמונת הייחוס.

  • שינוי מרקמים וחומרים

    החלפת חומר הגלם של פריט מסוים, למשל הפיכת ספל רגיל לספל בעל טקסטורת עץ.

  • הלבשת אלמנטים וקוספליי

    העברת תסרוקת, בגדים ואביזרים מדמות מצוירת ישירות לתצלום של אדם אמיתי.

איפה זה נופל

הכלי מציב דרישה קשיחה להעלות שתי תמונות עבור משימות מיזוג, מרקם או החלפת פנים, ואם תנסו לעבוד עם תמונה אחת תקבלו שגיאה. ההדגמות שמובנות בממשק לא נשמרות במטמון, כך שכל דוגמה דורשת ריצה מחדש.

בנוסף, חלק מהמתאמים עלולים להיכשל בטעינה בזמן הריצה. כדאי לזכור שברירת המחדל של צעדי הדגימה נמוכה מאוד כדי לאפשר מהירות, מה שעלול לפגוע בדיוק או בפרטים הקטנים של התוצאה לעומת ריצה מלאה.

שאלות
נפוצות

האם השימוש בחינם?

כן, הממשק פתוח לשימוש חופשי בדפדפן. מאחר שהוא רץ על תשתית שיתופית עם חומרת zero-a10g, עשוי לחול זמן המתנה אם יש עומס של משתמשים.

מה קורה לתמונות שאני מעלה?

התמונות נשלחות לזיכרון של השרת לצורך עיבוד בלבד ומטופלות ישירות דרך ספריית התמונות בקוד. עם זאת, מדובר בסביבה מקוונת ולא בשרת פרטי שלכם.

כמה זמן לוקח לקבל תמונה?

הריצה בנויה להיות מהירה למדי מכיוון שהיא מוגדרת כברירת מחדל ל־4 צעדי דגימה בלבד. יחד עם זאת, אם המעבד הגרפי צריך להפעיל את עצמו מחדש או שיש תור, זה ייקח קצת יותר זמן.

במה זה שונה משימוש רגיל במודל Qwen?

כאן מקבלים צינור מובנה שמחבר מראש מתאמי LoRA ספציפיים למשימות מוגדרות מראש. במקום לקנפג את המשקולות והמתאמים בקוד משלכם, בוחרים משימה מתוך תפריט מוכן.

איך משתמשים

טוענים את שתי התמונות לממשק, בוחרים את המתאם המתאים מהרשימה, מקלידים את ההנחיה ולוחצים על הכפתור הראשי. ההגדרות המתקדמות סגורות כברירת מחדל, אבל דרכן אפשר לשלוט על מספר צעדי הדגימה שעומד על 4 כברירת מחדל, או על ערך ה־Guidance Scale שמוגדר על 1.0.

ההרצה מתבצעת על מעבד גרפי מדגם zero-a10g דרך ספריית spaces. זה אומר שזמן ההמתנה תלוי בהקצאת המשאבים באותו רגע, ויכול להיות תור קצר עד שהמעבד הגרפי מתעורר לפעולה.

הרישיון

הקוד והסביבה מפורסמים תחת רישיון apache-2.0, שמאפשר שימוש חופשי ושינוי של הקוד. עם זאת, התמונות שאתם מעלים מועברות דרך שרתי השירות שבו הממשק מתארח, ויש לבדוק את תנאי הרישיון של כל מתאם LoRA נפרד שנטען פנימה.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא ב־Hugging Face ↗