GPT
Q

Qwen-Image-gguf

קוד פתוח

city96apache-2.02025-08-05

  • gguf
  • text-to-image
  • en
  • zh

הסבה של מודל יצירת התמונות Qwen-Image לפורמט GGUF מאפשרת להריץ אותו מקומית דרך ComfyUI. קוונטיזציות נמוכות שומרות על שכבות קריטיות בדיוק גבוה כדי למנוע קריסה באיכות.

  • 199 GBמשקל הקבצים
  • 50,279הורדות בחודש
  • 294לייקים

מה זה

מדובר בהמרה ישירה של מודל יצירת התמונות Qwen-Image למבנה GGUF, שמיועד בעיקר למי שרוצה להריץ יצירת תמונה על חומרה ביתית או שרתים מוגבלים במקום לסחוב משקלים מלאים. המודל מייצר תמונות מטקסט ותומך באנגלית ובסינית, בלי תמיכה מוצהרת בעברית.

החידוש כאן מתרכז בקוונטיזציה עצמה. בגרסאות כמו Q5_K_M, Q4_K_M ובמיוחד ברמות הדחיסה הנמוכות כמו Q3 ו־Q2, הופעל מנגנון שמשאיר את השכבה הראשונה והאחרונה בדיוק גבוה. המטרה היא להשאיר אפילו גרסה מכווצת מאוד כמו Q2_K במצב שמיש שמייצר פלט סביר, בניגוד לקוונטים רגילים שנוטים להתפרק ברמות האלו.

מתאים ל

  • עבודה מקומית ב־ComfyUI

    הרצת יצירת תמונות ישירות בתוך פייפליין קיים באמצעות התוסף ComfyUI-GGUF.

  • בדיקות על כרטיסי מסך קטנים

    שימוש בגרסאות מכווצות כמו Q2_K או Q3_K ששומרות על שכבות קצה בדיוק גבוה.

  • סביבות דו-לשוניות

    יצירת תמונות מתוך טקסט שנכתב באנגלית או בסינית ללא צורך במודל תרגום נוסף.

איפה זה נופל

הכרטיס עצמו מדגיש שדוגמת הפלט המוצגת היא מדגם של תמונה אחת בלבד ולא מייצגת. אין כאן נתוני מדידה מסודרים, מבחני ביצועים או השוואה מתועדת מול מודלים מקבילים.

בנוסף, המודל מוגדר רשמית לאנגלית וסינית בלבד, כך שפרומפטים בעברית ידרשו תרגום מראש כדי לא לקבל תוצאות שבורות. שילוב של שלושה רכיבים נפרדים מחייב גם התעסקות בתחזוקה וסכנת שגיאות הגדרה בשרשרת העבודה.

שאלות
נפוצות

האם מספיק להוריד רק את קובץ ה־GGUF מהמאגר?

לא. כדי שהמערכת תעבוד נדרשים שלושה רכיבים שונים. מלבד המודל הראשי מהמאגר הזה, תצטרכו להוריד בנפרד מקודד טקסט Qwen2.5-VL-7B וקובץ VAE ייעודי, ולמקם אותם בתיקיות המוגדרות.

האם המודל מבין פרומפטים בעברית?

השפות הנתמכות שצוינו הן אנגלית וסינית בלבד. אם תכתבו פרומפטים ישירות בעברית, סביר להניח שהתוצאות יהיו בלתי צפויות או שגויות, ולכן עדיף לתרגם את הטקסט לאנגלית לפני השליחה.

איך מריצים

ההרצה מתבצעת בתוך ComfyUI בעזרת התוסף ComfyUI-GGUF. לא מדובר בקובץ בודד שפותחים וזהו, אלא צריך להוריד בנפרד מקודד טקסט מסוג Qwen2.5-VL-7B ורכיב VAE ייעודי, ולשים כל אחד מהם בתיקייה שלו לפי ההוראות.

מאגר הקבצים כולו שוקל 199 גיגה בייט בגלל פיצול של גרסאות שונות, אבל אתם מורידים רק קובץ בודד שמתאים לזיכרון שלכם. אם כרטיס המסך שלכם חלש מכדי להחזיק את המודל יחד עם מקודד הטקסט וה־VAE, תצטרכו לרדת לגרסאות ה־Q2 או ה־Q3, או פשוט לעבור ל־API חיצוני במקום להילחם בזמני יצירה איטיים.

ollama run hf.co/city96/Qwen-Image-gguf:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הרישיון המדווח הוא Apache 2.0, שמתיר שימוש מסחרי, שינוי קוד והפצה חופשית. יחד עם זאת, מצוין במפורש שמדובר בכימות של מודל קיים ולא באימון חדש, ולכן כל תנאי הרישיון וההגבלות של המודל המקורי Qwen-Image עדיין חלים עליו במלואם.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗