GPT
Z

Z-Image-Turbo-AIO

קוד פתוח

SeeSee21apache-2.02025-12-03

  • z-image-turbo
  • text-to-image
  • image-generation
  • diffusion
  • comfyui

גרסה ארוזה של מודל התמונות מבית עליבאבא שמפיקה תמונה בשמונה צעדים בלבד. מתאים למי שרוצה ריצה מקומית מהירה מאוד בלי להרכיב בנפרד מקודד טקסט ורכיב פענוח.

  • 95.8 GBמשקל הקבצים
  • 151הורדות בחודש
  • 296לייקים

מה זה

מדובר בחבילה שמאחדת את המודל הבסיסי של מעבדת עליבאבא, בעל 6 מיליארד פרמטרים, יחד עם הקידוד והפענוח בקובץ אחד. המערך כולל מודל פוטו-ריאליסטי וגרסת אנימה שעברה מיזוג עם רכיבי התאמה ייעודיים. הרעיון המרכזי כאן הוא מהירות הפעולה, כאשר יצירת התמונה דורשת בין שמונה לתשעה צעדי דיגיטציה בלבד.

הריפוזיטורי הזה כולל תזרימי עבודה ייעודיים לקומפי יו-איי, שתומכים בחיבורים כמו רשתות בקרה לזיהוי עומק וקצוות, ומודל השבחה מבוסס דיפיוז'ן. בנוסף, המודל יודע לרנדר טקסט מובנה בתוך התמונה עצמה, אבל רק בשפות אנגלית וסינית.

מתאים ל

  • רינדור תמונות בריצה מקומית

    מייצר תמונה בשמונה צעדים בלבד על כרטיס ביתי של שמונה גיגה.

  • יצירת איורי אנימה

    גרסת האנימה הייעודית כוללת מיזוג התאמות מוכן ללא צורך בהתקנה נוספת.

  • שילוב טקסט שלטים באנגלית

    יודע לצייר שלטים וכתובות קריאות באותיות לטיניות מתוך הנחיה טבעית.

איפה זה נופל

המודל מוגבל מאוד בנוקשות ההגדרות שלו. אי אפשר לשחק עם ערך ההנחיה מעבר לערך הבודד שנקבע לו, מה שמקטין את השליטה הידנית בתוצאה, והוא דורש פרומפטים ארוכים של מאה עד שלוש מאות מילים כדי להפיק משהו טוב. בנוסף, יכולת רינדור הטקסט קיימת באנגלית ובסינית בלבד, כך שטקסט בעברית לא יעבוד פה. מעבר לזה, כדי לנצל את יכולות השליטה המתקדמות כמו רשת הבקרה נדרשות חבילות הרחבה חיצוניות שמורידות עוד מודלים כבדים למחשב.

שאלות
נפוצות

חייבים להוריד את כל 95 הגיגה כדי להתחיל לעבוד?

ממש לא. המאגר מכיל עשרות קבצים שמפצלים את המודל לגרסאות דיוק שונות כמו 8 ביט ו־16 ביט, הן לאנימה והן לפוטו-ריאליזם. אתם בוחרים ומורידים רק קובץ אחד ששוקל בין 10 ל־20 גיגה בהתאם לזיכרון של כרטיס המסך שלכם.

האם המודל יצליח לרנדר טקסט בעברית על שלטים בתמונה?

לא. התמיכה ברינדור טקסט מובנה בתוך התמונות מוגבלת לפי היצרן לשפות אנגלית וסינית בלבד. אם תבקשו מילים בעברית תקבלו עיוותים וג'יבריש.

למה התמונות יוצאות מקולקלות כשאני מוסיף הנחיות שלילה?

המבנה של המודל דורש עבודה עם ערך הנחיה קבוע של 1.0 ואיפוס התניה במקום שדה שלילה סטנדרטי. שינוי הערכים האלה או הוספת מילות שלילה רגילות פוגעים באלגוריתם הצעדים המהיר של הדיפיוז'ן.

איך מריצים

המודל פותח במיוחד עבור סביבת קומפי יו-איי, ואפשר להריץ אותו דרך צומת טעינת מודל סטנדרטית. המפרט מציג תאימות לכרטיסי מסך עם 8 גיגה זיכרון וידאו, כאשר גרסת 8 ביט שוקלת כעשרה גיגה, בעוד גרסאות הדיוק המלא שוקלות סביב 20 גיגה. כלל הקבצים בריפו שוקלים 95.8 גיגה בגלל ריבוי הגרסאות, אבל אתם צריכים להוריד רק קובץ בודד שמתאים לחומרה שלכם.

חובה לקבע את ערך ההנחיה על 1.0 בדיוק, ולא להשתמש בהנחיות שלילה רגילות אלא באיפוס התניה. אם אין לכם מעבד גרפי מקומי עם שמונה גיגה פנויים לפחות או שאתם לא עובדים עם קומפי יו-איי, עדיף לצרוך מודלים דרך ספק ענן חיצוני.

pip install -U huggingface_hub
hf download SeeSee21/Z-Image-Turbo-AIO

הרישיון

הפרויקט מופץ תחת רישיון אפאצ'י 2.0. הרישיון הזה מתיר שימוש מסחרי חופשי, שינוי של המשקלים והפצה מחדש, בלי תשלום תמלוגים. התנאי העיקרי הוא שמירת הודעת זכויות היוצרים והצהרת הרישיון המקורית של עליבאבא והיוצר בקבצים שמפיצים הלאה.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗