GPT
Q

Qwen-Image-Edit-MeiTu

קוד פתוח

joyfoxapache-2.02025-10-23

  • diffusers
  • gguf
  • image-editing
  • consistency
  • aesthetics

גרסת כוונון מבוססת שנאי דיפוזיה לעריכת תמונות, שנועדה לשמור על עקביות מבנית ואסתטיקה. היא מתאימה למי שצריך עיבוד תמונה מדויק בלי לפרק את הקומפוזיציה המקורית.

  • 78.7 GBמשקל הקבצים
  • 396הורדות בחודש
  • 154לייקים

מה זה

מדובר בגרסה משופרת של מודל עריכת התמונות מבית Qwen, שעברה אימון ייעודי על ידי מעבדת Valiant Cat במטרה לשפר את היציבות המבנית ואת איכות הנראות. המודל מתמקד במשימות של תמונה לתמונה, תוך שילוב משוב על צבעים, ניגודיות, תאורה ושמירה על פרטים קטנים כמו מרקמים וטיפוגרפיה. הוא מתאים לשינויים סמנטיים מורכבים בפורטרטים, מוצרים ונופים.

הייחוד כאן נשען על זיקוק העדפות אסתטיות ומודלי שפה חזותיים לפי המאמר המלווה של החוקרים. במקום סתם להחליף פיקסלים באזור מסוים, הוא שומר על התאורה הכללית והרצף המרחבי של הפריים. עם זאת, אין בדף נתוני מדידה מספריים או השוואות בנצ'מרק סטנדרטיות, כך שההבטחות לגבי שיפור באיכות נשענות בעיקר על הדוגמאות שהועלו ועל ניסוי עצמאי.

מתאים ל

  • ריטוש פורטרטים

    שיפור מרקם עור ותאורה תוך שמירה על תווי הפנים המקוריים של המצולם.

  • עיבוד תמונות מוצר

    התאמת צבעים ואיזון תאורה בקטלוגים מסחריים בלי לפגוע במבנה המוצר עצמו.

  • עריכה באנגלית ובסינית

    מתאים לצוותים שעובדים בשפות הנתמכות ומשלבים אותו ישירות ב־ComfyUI.

איפה זה נופל

המודל תומך רק באנגלית ובסינית, כך שאי אפשר להזין לו הנחיות בעברית ישירות ולצפות לתוצאה טובה. מעבר לכך, דף המודל מציג תמונות הדגמה יפות אך נעדר לחלוטין מדדי ביצועים כמותיים, כך שקשה לדעת מראש מתי הוא נכשל בהבנת הנחיות מורכבות. משקל הקבצים החריג יוצר צוואר בקבוק משמעותי בזמני הטעינה ובמשאבים הנדרשים.

שאלות
נפוצות

האם המודל יבין הנחיות עריכה שנכתבו בעברית?

לא, המודל אומן ותומך רק בשפות אנגלית וסינית. אם תכתבו פרומפט בעברית תקבלו תוצאות שגויות או הזיות, ולכן חובה לתרגם את ההנחיות לאנגלית לפני השליחה.

כמה זיכרון וידאו אני צריך בשביל להריץ אותו מקומית?

עם משקל קבצים כולל של קרוב ל־79 גיגה בייטים, תצטרכו כרטיסי מסך ארגוניים עם זיכרון גבוה מאוד כדי לטעון אותו לפעולה מלאה. מחשב פיתוח רגיל עם כרטיס מסך בודד לא יעמוד בעומס בלי אופטימיזציות כבדות.

איך מריצים

כדי לעבוד איתו צריך להוריד כמעט 79 גיגה בייטים של משקולות בפורמט Safetensors הפרוסים על פני 15 קבצים, באמצעות ספריית diffusers או בשילוב workflow ייעודי לתוכנת ComfyUI שמחליף את צומת ה־Unet.

משקל כזה דורש חומרה כבדה מאוד, שרת עם כרטיסי מסך בעלי זיכרון וידאו נרחב, ולא כרטיס ביתי ממוצע. אם אין לכם תשתית ענן ייעודית או צורך קריטי לשמור את התמונות בשרת מקומי, החזקת מודל בגודל הזה לבד תהיה יקרה ומסורבלת מאוד ביחס לשימוש בפתרונות מרוחקים.

ollama run hf.co/joyfox/Qwen-Image-Edit-MeiTu:qwen_image_edit_meitu_Q5_K_S

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הרישיון הוא Apache 2.0, שמאפשר שימוש מסחרי מלא, שינוי של הקוד והמשקולות והפצה שלהם במוצר שלכם. התנאי העיקרי הוא שמירה על הודעות זכויות היוצרים והרישיון המקורי, בלי חובת פתיחת הקוד שלכם.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗