GPT
Z

Z-Image-Distilled

קוד פתוח

GuangyuanSDapache-2.02026-01-31

  • safetensors
  • Z
  • text-to-image
  • en
  • zh

גרסת זיקוק של מודל Z-Image הבסיסי, שמקצרת זמני ריצה ל־5 עד 8 צעדים. הפתרון נועד למי שרוצה לבדוק התאמת LoRA בלי לשלם באובדן המגוון והסגנון של המקור.

  • 195 GBמשקל הקבצים
  • 6,787הורדות בחודש
  • 161לייקים

מה זה

הפרויקט הזה לוקח את מודל התמונות Z-Image ומזקק אותו כדי להוריד דרסטית את כמות צעדי הריצה מ־28 עד 50 צעדים במקור לכדי 5 עד 15 בלבד. בניגוד לגרסת ה־Turbo הרשמית, המפתח נמנע משימוש במשקלים שלה כדי לשמור על הגיוון הסגנוני, האנטומיה וההתנהגות הטבעית של מודל הבסיס.

המאגר עבר כמה גלגולים רצופים, כולל שילוב Direct Preference Optimization לשיפור תאורה, צבע ומרקמים, לצד גרסאות מתאמים ושיתוף פעולה עם פרויקטים כמו VideoX-Fun ו־Alibaba-PAI. התוצאה היא מודל שמייצר תמונות ריאליסטיות עם התאמה טובה לתוספי LoRA, תוך עבודה בערכי CFG נמוכים מאוד של 1.0 עד 1.5 ודוגם Euler עם simple scheduler.

מתאים ל

  • בדיקת מתאמי LoRA

    מאפשר בדיקה מהירה מאוד של קובצי LoRA מותאמים על בסיס Z-Image בלי להמתין לעשרות צעדי ריצה בכל פעם.

  • יצירת קונספט ראשוני

    מספק תוצאה ראשונית תוך 5 עד 8 צעדים ושומר על רמת אנטומיה ומגוון סגנוני רחב יותר מגרסאות הטורבו.

  • צינור שילוב מודלים

    מתאים לעבודה בשילוב עם מודלים כמו Klein 9B לצורך דיוק פרטים ועידון התוצאה בצינור עבודה רב שלבי.

איפה זה נופל

הזיקוק פוגע ישירות ביכולת של המודל לייצר טקסט, במיוחד כשמדובר באותיות קטנות, שם הקריאות ירודה משמעותית בהשוואה למודל הבסיס. בעיה נוספת היא נטייה לעיוותי צבע, בעיקר גוון כחול בולט שמופיע עם דוגמים מסוימים. מעבר לזה, המודל מתקשה לשמור על יציבות ולהישמע להנחיות שליליות כאשר מעלים את ערך ה־CFG מעל 1.0.

שאלות
נפוצות

למה שהמודל ידרוש שטח אחסון של 195 גיגה-בייט?

המאגר בהאגינג פייס מכיל את כל גרסאות הפיתוח המצטברות, כולל V1, V2, V3, Veris ו־AGILE בפורמטים שונים. אין צורך להוריד את כולם, ואפשר להסתפק בקובץ הדגם הספציפי שבו רוצים להשתמש או בגרסת LoRA של 1.06 גיגה-בייט.

באיזה ערכי הגדרות מומלץ להשתמש בריצה?

היוצרים ממליצים להגדיר CFG נמוך סביב 1.0 עד 1.5, כמות של 5 עד 15 צעדים, ודוגם מסוג Euler עם scheduler מסוג simple. שימוש בערכי CFG גבוהים יותר יפגע באיכות וביכולת לעבוד נכון עם פרומפט שלילי.

מה עדיף, המודל הזה או Z-Image-Turbo הרשמי?

הגרסה הזו עדיפה אם אתם מחפשים גיוון אקראי רחב והתאמה מדויקת יותר למשקלי LoRA על בסיס Z-Image המקורי. מנגד, גרסת הטורבו עדיין עשויה לפעול מעט מהר יותר, אך במחיר של פחות חופש סגנוני.

איך מריצים

הריפוזיטורי הזה כבד מאוד ומכיל 195 גיגה-בייט שמחולקים בין 45 קבצים, כולל משקלים של גרסאות שונות כמו Lucis, Veris ו־AGILE, לצד גרסאות LoRA בנפח של 1.06 גיגה-בייט. כדי להריץ את המודל המלא תצטרכו נפח אחסון מהיר וכרטיס מסך חזק, אם כי קיימים פורמטים מכווצים כמו FP8 או NVFP4 המותאמים לארכיטקטורת Blackwell של אנבידיה כמו כרטיסי סדרת RTX 50, B200 ו־PRO 6000.

ההרצה מתבצעת בעיקר דרך ComfyUI ומסתמכת על תזרימי העבודה של Z-Image. אם אתם לא צריכים לאמן או לבדוק תאימות ספציפית למשקלי LoRA על תשתית מקומית, הורדת כל המשקלים האלה למחשב בודד היא משימה מיותרת ועדיף להסתמך על מתאם ה־LoRA הקל בלבד או על שירות ענן ייעודי.

pip install -U huggingface_hub
hf download GuangyuanSD/Z-Image-Distilled

הקבצים

45 קבצים במאגר, 195 GB סך הכול. הקישורים מובילים ישירות ל־Hugging Face.

הרישיון

המודל מופץ תחת רישיון Apache-2.0, שמאפשר שימוש חופשי לצרכים מסחריים ופרטיים. מותר לשנות את הקוד והמשקלים, להפיץ אותם מחדש ולשלב אותם בתוך מוצרים מסחריים, כל עוד מצרפים עותק של הרישיון המקורי והודעת זכויות יוצרים.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗