GPT
Q

Qwen-Edit-2509-Upscale-LoRA

קוד פתוח

vafipas663gpl-3.02025-11-05

  • diffusers
  • lora
  • image-to-image

הגדלת תמונות מבוססת דיפוזיה שמשחזרת פרטים מצילומים הרוסים. הפתרון פונה למי שצריך להציל תמונות עם דחיסת JPEG קיצונית או מריחות תנועה כבדות.

  • 34.3 GBמשקל הקבצים
  • 16,887הורדות בחודש
  • 232לייקים

מה זה

מדובר בסט מתעדכן של משקלי LoRA עבור משימות תמונה לתמונה בספריית diffusers, שנועד לחדד ולהגדיל צילומים עד לרזולוציה של 2.4 מגה פיקסל. הוא אומן על גרסאות מסוננות של Unsplash-Lite ו־UltraHR-100K ומכוון ספציפית לצילום ריאליסטי כמו נופים, פורטרטים, רכבים ואדריכלות.

הייחוד כאן הוא ארסנל ההשחתות שהוכנס באימון. הוא יודע להתמודד עם דחיסת JPEG באיכות 5%, מריחת תנועה של עד 64 פיקסלים, רעש של 50% ושבירת צבעים עד 3 ביט, לצד פגמים שנשארו ממודלי הגדלה אחרים. האיכות הסופית נשענת על פרומפט מילולי, ככל שהתיאור הטקסטואלי של הסצנה עשיר יותר, כך השחזור של הטקסטורות מדויק יותר.

מתאים ל

  • שחזור צילומים ישנים

    הצלת תמונות שצולמו במצלמות דיגיטליות ישנות עם רעש גבוה או מריחות תנועה עד 64 פיקסלים.

  • תיקון דחיסת רשת

    ניקוי ארטיפקטים כבדים מצילומים שעברו כיווץ JPEG עד איכות 5% ברשתות חברתיות.

  • ליטוש אחרי אפסקייל

    הסרת פיקסליזציה וטשטוש שנוצרו באלגוריתמים קלאסיים שהגדילו תמונה עד פי 16.

איפה זה נופל

הפרויקט נמצא בעבודה שוטפת והקבצים מתעדכנים תוך כדי תנועה, כך שאין כאן גרסה סופית ויציבה. הוא אומן אך ורק על צילומי מצלמה וייכשל לחלוטין באיורים, גרפיקה ממוחשבת, אנימציה, שלטים וטקסט. בנוסף, חובה לכתוב פרומפט ידני שמתאר את הסצנה, אי אפשר פשוט לזרוק אליו תמונה ולקוות לנס.

שאלות
נפוצות

למה יש 27 קבצים שונים ששוקלים יחד מעל 34 ג'יגה בייט?

היוצר מעלה צ'קפוינטים מרובים תוך כדי אימון ובדיקות של גרסאות שונות. אתם לא צריכים להוריד את כל המאגר, אלא רק את שני קובצי ה־LoRA הספציפיים שמומלצים כרגע ומופעלים יחד בשרשרת.

האם הוא מתאים לעיבוד של לוגואים, פונטים או איורי תלת מימד?

לא. הכרטיס מציין במפורש שהאימון לא כלל גרפיקה, CGI, טקסט או איורים, והוא מכוון אך ורק לצילום מהעולם האמיתי.

איזה דוגם נותן את התוצאות הטובות ביותר לפי המפתח?

היוצר מציין כי דוגם LCM הוא הטוב ביותר יחד עם שמונה צעדים, ואחריו ברשימה נמצאים Euler Ancestral ו־Euler הרגיל.

איך מריצים

ההרצה בפועל מסורבלת מעט ודורשת שרשור של שני מתאמים שונים, LoRA A ואחריו LoRA B, לפי צמדים מומלצים שהמפתח מעלה. ההגדרה מתבססת על תהליך עבודה ב־ComfyUI ששמור בקובצי המאגר, תוך שימוש במודל Lightning בשמונה צעדים, דוגם LCM ורכיב ModelSamplingAuraFlow עם ערך shift נמוך מ־0.3.

המאגר שוקל 34.3 ג'יגה בייט בגלל עשרות צ'קפוינטים וגרסאות v3 ו־v4 חלופיות, כך שצריך לבחור רק את הקבצים המתאימים ולא למשוך הכול. למי שרק רוצה לבדוק תוצאות לפני שמכינים סביבת הרצה וכרטיס מסך מתאים, קיים דמו פעיל ב־Spaces של Hugging Face.

from diffusers import DiffusionPipeline

pipe = DiffusionPipeline.from_pretrained("vafipas663/Qwen-Edit-2509-Upscale-LoRA")
img = pipe("a photo").images[0]

הקבצים

27 קבצים במאגר, 34.3 GB סך הכול. הקישורים מובילים ישירות ל־Hugging Face.

הרישיון

הרישיון הוא GPL-3.0, וזה אומר רישיון קוד פתוח מדבק ומגביל מאוד. מותר להשתמש ולשנות, אבל אם אתם מפיצים מוצר או שירות שמבוססים עליו, תהיו חייבים לחשוף את קוד המקור המלא תחת אותו רישיון בדיוק. לחברות שמפתחות מערכות סגורות מדובר בבעיה משפטית שמונעת שילוב ישיר.

הרישיון המלא בעמוד המודל ↗