GPT
Z

z-image-gguf

קוד פתוח

gguf-orgapache-2.02025-12-01

  • gguf
  • en

גרסת GGUF מכווצת למודל יצירת תמונות שמתאימה למי שרוצה להריץ אותו מקומית בתוך ComfyUI או דרך שורת הפקודה. החבילה מציעה משקלים קלים יותר בלי להחזיק כרטיסי מסך תעשייתיים יקרים.

  • 81.5 GBמשקל הקבצים
  • 14,024הורדות בחודש
  • 57לייקים

מה זה

מדובר בהמרה של מודל התמונות z-image לפורמט GGUF, שמחולק לקבצים שונים כדי לאפשר שילוב ישיר בסביבות עבודה מקומיות. הוא נשען על מקודד טקסט חיצוני ממשפחת Qwen3 בנפח של 4B, יחד עם רכיב VAE נפרד ומודל הדיפוזיה עצמו. ההפרדה הזו נותנת לכם גמישות לבחור את גרסת מקודד הטקסט המועדפת עליכם מתוך רשימת גרסאות נתמכות.

בניגוד למודלים שדורשים משקלי פייתורץ' מלאים וכבדים, הפורמט הזה מאפשר לעבוד ישירות מול כלי שורת פקודה ייעודי בשם gguf-connector או לזרוק את הקבצים לתיקיות המתאימות בממשק ComfyUI. המאגר כולל מגוון רמות כימוס, החל מגרסאות טורבו מקוצצות ועד קבצים מלאים יותר, כך שאפשר לתמרן בין דרישות הזיכרון לאיכות התוצאה.

מתאים ל

  • עבודה מקומית ב־ComfyUI

    מאפשר לשלב מודל תמונה בפורמט מכווץ ישירות לתוך תהליכי עבודה קיימים ללא צורך בהמרות נוספות.

  • הרצה מהירה בטרמינל

    מתאים למי שרוצה לייצר תמונות ישירות משורת הפקודה באמצעות הכלי הייעודי ולבחור רמות כימוס שונות.

  • התאמת מקודדי טקסט שונים

    נותן חופש לחבר גרסאות שונות של Qwen3-4B לפי צורכי הפרויקט ומשאבי המחשוב שלכם.

איפה זה נופל

הכרטיס מציג שילוב רכיבים מורכב ולא מודל אחוד שעובד בלחיצת כפתור אחת. אתם תלויים לחלוטין בהורדה ובסנכרון של שלושה חלקים נפרדים, כולל בחירת מקודד טקסט חיצוני שיכול להשפיע מהותית על הבנת ההנחיות. אין שום תיעוד רשמי לגבי ביצועי המודל בשפות שאינן אנגלית, אין נתוני מדדים מסודרים, ואם המטרה שלכם היא להריץ פרומפטים בעברית, סביר מאוד שתקבלו תוצאות עקומות או התעלמות מוחלטת מההוראות.

שאלות
נפוצות

האם צריך להוריד את כל 81.5 הגיגה-בייט של המאגר?

ממש לא. המשקל הכולל מייצג 27 קבצים שונים שכוללים רמות כימוס מגוונות. אתם צריכים לבחור רק את גרסת הדיפוזיה שמתאימה לנפח הזיכרון שלכם, לצד קובץ VAE ומקודד טקסט מתאים.

האם המודל מבין הנחיות בעברית?

הכרטיס מגדיר תמיכה באנגלית בלבד. גם אם מקודד הטקסט של Qwen מכיר מעט עברית, החיבור למודל התמונה הספציפי הזה לא נבדק לכך, ולכן מומלץ לכתוב פרומפטים באנגלית.

איך מריצים

כדי להריץ אותו, מורידים את הקבצים הרלוונטיים ומסדרים אותם בתיקיות ComfyUI המתאימות: ה־VAE בנפרד, מקודד ה־Qwen3 בתיקיית מקודדי הטקסט, ומודל הדיפוזיה עצמו בתיקייה שלו. לחלופין, אפשר להשתמש בכלי gguf-connector ולהריץ את הפקודה שמציגה תפריט בחירה מהיר בין קובצי הטורבו כמו q3_k_s או iq4_nl שנמצאים בתיקייה.

סך כל הקבצים במאגר שוקל 81.5 גיגה-בייט, אבל מורידים רק את הקוונטיזציה שצריכים. אם אין לכם כרטיס מסך עם זיכרון ייעודי שמסוגל להחזיק במקביל את מודל הדיפוזיה ואת מקודד הטקסט של ה־4B, תמצאו את עצמכם מתמודדים עם זמני יצירה איטיים מאוד, ובמקרה כזה עדיף לשלם לפי תמונה ב־API חיצוני.

ollama run hf.co/gguf-org/z-image-gguf:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

המודל מופץ תחת רישיון apache-2.0. זהו רישיון קוד פתוח מתירני שמאפשר שימוש מסחרי, שינוי של הקוד והפצה מחדש בתוך מוצרים, בתנאי ששומרים על הודעת זכויות היוצרים וההצהרה המקורית.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗