GPT
Q

Qwen-Image-GGUF

קוד פתוח

QuantStackapache-2.02025-08-05

  • gguf
  • text-to-image
  • en
  • zh

גרסת GGUF מכווצת למודל יצירת התמונות של Qwen, שמתאימה להרצה מקומית דרך ComfyUI. היא נועדה למי שרוצה לשלוט בייצור תמונות על החומרה שלו בלי ענן.

  • 161 GBמשקל הקבצים
  • 15,821הורדות בחודש
  • 50לייקים

מה זה

הפרויקט הזה מביא המרה ישירה של מודל יצירת התמונות Qwen-Image לפורמט GGUF. במקום להחזיק משקלים כבדים בפורמט המקורי, מקבלים קבצים שאפשר להטעין ישירות לתוך סביבות עבודה מקומיות שתומכות בפורמט הזה, בעיקר כשרוצים לחסוך בזיכרון תצוגה בלי לוותר על המודל המלא.

המבנה כאן מפוצל לכמה רכיבים נפרדים. המודל הראשי יושב בתיקיית ה־unet, מקודד הטקסט מבוסס על Qwen2.5-VL-7B ודורש הורדה בנפרד, ויש גם רכיב VAE עצמאי. השילוב הזה נשען על הבנת טקסט חזקה של מודל ויז'ואל שפועל באנגלית ובסינית, מה שמסייע לו לפרש הנחיות טקסט מורכבות יותר בהשוואה למודלים פשוטים.

מתאים ל

  • ייצור תמונות ב־ComfyUI

    מתאים למי שכבר עובד עם התוסף ComfyUI-GGUF ורוצה לשלב את המודל של Qwen ישירות בתהליכי העבודה הקיימים שלו.

  • הנחיות באנגלית וסינית

    ניצול מקודד הטקסט של Qwen2.5-VL לפענוח פקודות מפורטות ומדויקות בשפות הנתמכות.

  • עבודה מקומית ללא ענן

    שמירה על פרטיות מלאה של החומרים וייצור גרפיקה מקומית על החומרה שלכם ללא תלות ברשת.

איפה זה נופל

המודל תומך רק באנגלית ובסינית. הנחיות בעברית פשוט לא יעבדו כאן ותצטרכו לתרגם הכל מראש. בנוסף, לא מדובר בהתקנה של קליק אחד אלא בהרכבה ידנית של שלושה חלקים שונים בתוך ComfyUI, כולל תלות בתוסף חיצוני. אם אחד הרכיבים לא מוגדר נכון, שום דבר לא ייצא.

אותה משפחה

Qwen-Image יצא ב־2 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם אפשר להשתמש במודל הזה עם הנחיות בעברית?

המודל מאומן על אנגלית וסינית בלבד. הנחיות בעברית יפיקו תוצאות שגויות או לא רלוונטיות, ולכן חייבים לתרגם את הפרומפט לאנגלית לפני השליחה למקודד הטקסט.

האם מספיק להוריד רק את הקובץ הראשי מכאן?

לא. המערכת מחייבת הורדה של מקודד הטקסט Qwen2.5-VL-7B ושל רכיב ה־VAE בנפרד, והנחת כל אחד מהם בתיקייה הייעודית שלו בתוך ComfyUI.

איך מריצים

כדי להריץ אותו בפועל, מתקינים את התוסף ComfyUI-GGUF של city96 ושמים את הקבצים בנתיבים המתאימים. סך כל הקבצים במאגר מגיע ל־161 גיגה-בייט שמחולקים ל־16 קבצים, כך שצריך כונן מהיר ומרווח רק כדי להוריד את הגרסאות השונות, לצד כרטיס מסך חזק עם מספיק זיכרון כדי להחזיק את המודל, המקודד וה־VAE יחד.

אם אין לכם כרטיס מסך ייעודי רציני או סבלנות להגדיר צינור עיבוד שלם בעצמכם, עדיף להשתמש ב־API מנוהל של המודל המקורי ולחסוך את כאב הראש של התחזוקה והחומרה.

ollama run hf.co/QuantStack/Qwen-Image-GGUF:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

המאגר מדווח תחת רישיון apache-2.0, מה שמתיר שימוש מסחרי, שינוי והפצה חופשית בקוד פתוח. עם זאת, היוצרים מציינים שכל תנאי הרישיון וההגבלות של מודל המקור המקורי עדיין חלים כאן, ולכן חובה לוודא שאין תנאים ספציפיים שהוגדרו במקור לפני שמשלבים אותו במוצר מסחרי.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗