GPT
Z

Z-Image-Turbo-GGUF

קוד פתוח

unslothapache-2.02025-12-21

  • ggml
  • gguf
  • quantized
  • unsloth
  • text-to-image

גרסת קוונטיזציה של מודל יצירת תמונות עם 6 מיליארד פרמטרים שרץ בשמונה צעדים בלבד. מתאים למי שרוצה לייצר תמונות פוטו-ריאליסטיות מהר ועל חומרה מקומית נגישה.

  • 84.2 GBמשקל הקבצים
  • 134,585הורדות בחודש
  • 258לייקים

מה זה

מדובר בהמרה של Z-Image-Turbo לפורמט GGUF בעזרת השיטה של Unsloth, שמרימה שכבות קריטיות לדיוק גבוה יותר כדי לשמור על איכות הפלט. המודל המקורי מבוסס על ארכיטקטורת single-stream דיפוזיה עם שישה מיליארד פרמטרים. הרעיון המרכזי כאן הוא זיקוק שמאפשר לייצר תמונה מלאה בשמונה צעדי הערכה בלבד במקום עשרות צעדים כמקובל.

הוא מתמקד ביצירת תמונות פוטו-ריאליסטיות ורינדור טקסט בתוך התמונה באנגלית ובסינית. לפי דירוג ההעדפה האנושית של עליבאבא, גרסת הטורבו מציגה ביצועים תחרותיים מאוד מול מודלים פתוחים מובילים, כשהיתרון המעשי הוא מהירות הפקה גבוהה מאוד ביחס לגודל שלו.

מתאים ל

  • ייצור תמונות בזמן אמת

    זמן הפקה קצר במיוחד של שמונה צעדים בלבד, שמאפשר תוצאות מהירות בלי להמתין עשרות שניות.

  • שילוב טקסט גרפי באנגלית

    הארכיטקטורה נבנתה במיוחד כדי לרנדר טקסט מדויק וברור על גבי אובייקטים בתוך התמונה.

  • הרצה על חומרה מקומית

    גרסת ה־GGUF מאפשרת ניצול משאבים טוב יותר גם למי שמחזיק כרטיסי מסך של 16 גיגהבייט זיכרון.

איפה זה נופל

המודל מתועד ומותאם רשמית לשפה האנגלית והסינית בלבד. אין שום תיעוד לתמיכה בעברית, כך שלא כדאי לצפות לרינדור של אותיות עבריות או להבנה של הנחיות מורכבות בעברית ללא תרגום מקדים.

בנוסף, מדובר במודל מזוקק לשמונה צעדים. זה מעולה למהירות, אבל לעיתים בא על חשבון גמישות ועמידה קפדנית בהנחיות חריגות או עמוסות בפרטים זעירים, דבר שחייבים לבדוק נקודתית מול הדרישות שלכם לפני שילוב במערכת פעילה.

שאלות
נפוצות

האם המודל תומך בהזנת פרומפטים בעברית או בהצגת טקסט עברי בתמונה?

התיעוד הרשמי מציין במפורש תמיכה באנגלית ובסינית בלבד. המודל לא אומן להציג טקסט עברי בתמונה, וכדי לקבל תוצאות מדויקות עדיף לתרגם את ההנחיות שלכם לאנגלית לפני השליחה.

מה המשמעות של גרסת GGUF בהשוואה למודל המקורי?

פורמט GGUF מייצג קוונטיזציה של המשקלים כדי לחסוך בזיכרון ולהקל על הרצה בסביבות מקומיות מגוונות. השיטה של Unsloth שומרת על דיוק גבוה בשכבות הקריטיות כדי למנוע פגיעה מורגשת באיכות התמונה.

איך מריצים

המודל המקורי דורש כרטיס עם 16 גיגה זיכרון גרפי כדי לרוץ בנוחות מקומית, או מאיצי שרתים לתגובה של שבריר שנייה. הקבצים בפורמט GGUF מאפשרים להריץ אותו דרך ספריות מבוססות ggml על גבי מעבדים רגילים או כרטיסי מסך ביתיים בצורה גמישה יותר.

אם אין לכם כרטיס עם מספיק זיכרון או שאתם לא רוצים להתעסק עם ניהול תלויות והורדה של עשרות גיגהבייטים, פשוט תשתמשו בהדגמות הרשת או ב־API. הרצה מקומית משתלמת רק כשחייבים פרטיות מלאה או שליטה מוחלטת בזמני התגובה.

ollama run hf.co/unsloth/Z-Image-Turbo-GGUF:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

המודל מופץ תחת רישיון Apache 2.0. מותר להשתמש בו לצרכים מסחריים, לשנות אותו, להפיץ אותו ולשלב אותו בקוד סגור, בתנאי ששומרים על הודעות זכויות היוצרים והרישיון המקורי.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗