GPT
Q

Qwen-Image-Edit-GGUF

קוד פתוח

QuantStackapache-2.02025-08-18

  • gguf
  • image-to-image
  • en
  • zh

גרסה מכווצת בפורמט GGUF לעריכת תמונות מבוססת הנחיות טקסט. היא מיועדת למי שרוצה להריץ מודל image to image מקומית בתוך ComfyUI בלי לחנוק את כרטיס המסך עם משקלים מלאים.

  • 163 GBמשקל הקבצים
  • 16,160הורדות בחודש
  • 297לייקים

מה זה

מדובר בהמרה ישירה של המודל Qwen-Image-Edit לפורמט GGUF, שנועדה להקל על הרצה מקומית של משימות עריכת תמונה. המבנה כאן מורכב מכמה רכיבים נפרדים, כולל מודל ראשי שיושב בתיקיית ה־unet, מקודד טקסט מסוג Qwen2.5-VL-7B יחד עם קובץ mmproj, ורכיב VAE ייעודי.

היתרון המרכזי של ההמרה הזו הוא היכולת לשלב מודל ראייה ושפה חזק בתוך תהליך יצירת ועריכת תמונות, ישירות בסביבת עבודה מוכרת כמו ComfyUI. במקום להסתמך על שירותי ענן סגורים, מקבלים שליטה מלאה על תהליך ה־image to image עם אופטימיזציות שמאפשרות שימוש בחומרה ביתית או שרתים קטנים יחסית.

מתאים ל

  • עריכת תמונות בתוך ComfyUI

    מאפשר לערוך תמונות קיימות באמצעות הוראות טקסט בתוך תהליכי עבודה מקומיים, בעזרת התוסף ComfyUI-GGUF.

  • פייפליין מקומי באנגלית

    מתאים למי שחייב לעבד תמונות מקומית ללא הוצאת מידע לרשת, בתנאי שההנחיות נכתבות באנגלית או בסינית.

  • בדיקת מודלי ראייה ועריכה

    פתרון נוח לבחינת היכולות של משפחת Qwen לעריכת תמונה מונחית שפה על גבי חומרה מקומית מוגבלת.

איפה זה נופל

הכרטיס לא מספק נתוני ביצועים, מדדי השוואה או דוגמאות פלט, כך שקשה לדעת מראש עד כמה הקוונטיזציה פגעה באיכות התמונה או בדיוק העריכה. בנוסף, המודל תומך רשמית רק באנגלית ובסינית, כך שאי אפשר לבנות עליו להוראות בעברית. ההתקנה דורשת התעסקות ידנית עם ארבעה רכיבים נפרדים, וכל שגיאה במיקום הקבצים תמנע ממנו לעלות.

שאלות
נפוצות

האם חובה להוריד את כל 163 הג'יגה של המאגר?

לא. המשקל הכולל נובע מכך שהמאגר מכיל גרסאות שונות וקבצים מרובים. אתם צריכים להוריד רק קובץ מודל ראשי אחד ברמת הכימות הרצויה, לצד מקודד הטקסט, קובץ ה־mmproj וה־VAE.

האם המודל יבין הנחיות עריכה בעברית?

השפות הנתמכות שצוינו הן אנגלית וסינית בלבד. הוא כנראה יתקשה מאוד להבין פרומפטים בעברית או יתעלם מהם, ולכן מומלץ לכתוב את ההנחיות באנגלית.

איך מריצים

כדי להריץ אותו בפועל תצטרכו להתקין את התוסף ComfyUI-GGUF ולפזר את הקבצים בתיקיות המתאימות: המודל הראשי ב־unet, מקודד הטקסט וה־mmproj בתיקיית text_encoders, וה־VAE בתיקייה שלו. המאגר כולל 17 קבצים במשקל כולל של 163 ג'יגה, כך שלא מורידים הכל אלא בוחרים את הקבצים והכימות הספציפי שמתאים לזיכרון שלכם.

אם אין לכם כרטיס מסך חזק עם מספיק זיכרון וידאו שיכול להחזיק גם את המודל וגם את מקודד ה־7B, זה יהיה אטי מאוד. במקרה כזה, עדיף להשתמש ב־API חיצוני במקום להילחם בהגדרות מקומיות.

ollama run hf.co/QuantStack/Qwen-Image-Edit-GGUF:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הרישיון המדווח הוא apache-2.0, שמאפשר שימוש מסחרי, שינוי והפצה חופשית בקוד פתוח. עם זאת, היוצרים מציינים שתנאי הרישיון וההגבלות של מודל המקור המקורי עדיין חלים כאן במלואם, ולכן כדאי לבדוק את תנאי השימוש של Qwen המקורי לפני שילוב במוצר.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗