GPT
Q

Qwen-Image-Edit-2511-Upscale2K

קוד פתוח

joyfoxapache-2.02025-12-29

  • diffusers
  • image-generation
  • lora
  • Qwen-Image
  • image-to-image

הורדת תמונות והגדלה שלהן לאזור ה־2K בלי לאבד פרטים נעשית כאן באמצעות תוסף קל משקל. מדובר בפתרון ממוקד שמתחבר ישירות לסביבת העבודה שלכם.

  • 583 MBמשקל הקבצים
  • 1,371הורדות בחודש
  • 162לייקים

מה זה

מדובר באימון מסוג LoRA שיושב על גבי מודל הבסיס Qwen-Image-Edit-2511 ומיועד למשימות תמונה לתמונה. המטרה המרכזית שלו היא הגדלה חדה של תמונות קיימות לרזולוציה של בערך 2K, תוך שמירה על איכות המקור. המשקל הכולל של הקבצים עומד על 583 מגה בייט בלבד בחלוקה לשמונה קבצים בפורמט Safetensors, מה שאומר שלא מורידים כאן מודל ענק שלם מאפס אלא רק את שכבת ההתאמה.

הפיתוח בוצע על ידי מעבדת הבינה המלאכותית של חברת Chongqing Valiant Cat, והשימוש המיועד והמתועד שלו הוא בתוך סביבת ComfyUI. במקום להחזיק כלי נפרד וחיצוני לצורכי אפסקייל, אתם מחברים את המשקולות האלו לזרימת העבודה הקיימת של מודל העריכה של Qwen ומבצעים את פעולת ההגדלה כחלק ישיר מהתהליך.

מתאים ל

  • הגדלת חדות ב־ComfyUI

    שילוב ישיר בזרימות עבודה של עריכת תמונה שמשתמשות במודל הבסיס של Qwen.

  • שדרוג רזולוציה ל־2K

    שיפור איכות של תמונות קיימות לגודל גבוה יותר בלי להחליף את המודל המרכזי.

  • הרצה מקומית קלת משקל

    הוספת יכולת הגדלה באמצעות קובץ מתאם קטן של 583 מגה בייט בלבד.

איפה זה נופל

התיעוד של הכלי מינימלי ומשאיר הרבה סימני שאלה. בעמוד המודל מצוין במפורש שאין מילת הפעלה קבועה, ודרושות בדיקות מרובות לגבי הניסוח המדויק של הפרומפט. בנוסף, למרות שהשם מדבר על 2K, הטקסט מציע פקודה שמבקשת הגדלה ל־4K, מה שמעיד על חוסר עקביות בבדיקות של היוצרים. אין כאן שום מדדי ביצועים או דוגמאות מובנות להשוואה, כך שחייבים לבחון ידנית איך התוצאה נראית על סגנונות תמונה שונים לפני שמסתמכים עליו.

שאלות
נפוצות

האם המודל הזה עובד לבד בלי מודלים נוספים?

לא. מדובר במשקולות אימון מסוג LoRA, ולכן אתם חייבים להחזיק גם את מודל הבסיס Qwen-Image-Edit-2511 כדי להפעיל אותו.

באיזו שפה כותבים לו הנחיות?

השפה המוגדרת בכרטיס היא אנגלית בלבד. מילת ההפעלה המומלצת בדוגמה נכתבה באנגלית, ואין אינדיקציה לכך שהוא מבין הנחיות בעברית.

האם הוא מגדיל תמונות ל־2K או ל־4K?

שם המודל והתיאור מגדירים הגדלה לכיוון רזולוציית 2K. ההנחיה לדוגמה מדברת על 4K, אך היות ומדובר בכלי מבוסס פרומפטים יש לבדוק מה התוצאה בפועל בכל רזולוציה.

איך מריצים

אתם צריכים סביבת ComfyUI עובדת עם מודל הבסיס Qwen-Image-Edit-2511, ואליה מחברים צומת LoRA עם הקבצים של הפרויקט הזה. היוצרים מספקים קובץ זרימת עבודה מוכן בשם Upscale.json שמגדיר את החיבורים הנדרשים בספריית diffusers.

מבחינת חומרה, דרישות הזיכרון נקבעות בעיקר על ידי מודל הבסיס של Qwen ולא בגלל שכבת ה־LoRA הזו, ששוקלת רק 583 מגה בייט. אם אין לכם כרטיס מסך שמריץ את מודל הבסיס בצורה חלקה ברזולוציות של 2K, אין טעם להוריד את המשקולות למחשב המקומי ועדיף לפנות לפתרונות מנוהלים בענן.

from diffusers import DiffusionPipeline

pipe = DiffusionPipeline.from_pretrained("joyfox/Qwen-Image-Edit-2511-Upscale2K")
img = pipe("a photo").images[0]

הרישיון

הפרויקט מפורסם תחת רישיון apache-2.0. זהו רישיון קוד פתוח מתירני שמאפשר שימוש מסחרי, שינוי של הקוד והפצה מחדש, כל עוד שומרים על הודעות זכויות היוצרים ומצרפים עותק של הרישיון המקורי.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗