GPT
Z

leejet/Z-Image-Turbo-GGUF

קוד פתוח

leejetapache-2.02025-11-30

  • gguf
  • text-to-image
  • image-generation
  • stable-diffusion.cpp
  • z-image-turbo

גרסת GGUF מכווצת למודל יצירת תמונות שמאפשרת להריץ אותו מקומית. הוא מיועד למי שרוצה לייצר תמונות על חומרה חלשה יחסית בלי להחזיק כרטיס מסך מפלצתי בשרת.

  • 27.6 GBמשקל הקבצים
  • 46,574הורדות בחודש
  • 58לייקים

מה זה

מדובר בהמרה של Z-Image-Turbo לפורמט GGUF שביצע leejet, עבור הרצה ישירה בפרויקט stable-diffusion.cpp. המטרה המרכזית כאן היא לחתוך את דרישות הזיכרון של מודל יצירת התמונות המקורי, ולהביא אותו למצב שאפשר להריץ על מעבדים גרפיים צנועים במיוחד. המודל מתמקד ביצירת תמונה מטקסט ומקבל הנחיות באנגלית ובסינית בלבד.

במקום להסתבך עם סביבות פייתון כבדות, המבנה הזה נשען על קוד C++ יעיל שמאפשר פריקה של חלק מהמשקלים לזיכרון המעבד. החבילה כוללת מגוון רמות כימוס, החל מאיכות מלאה כמעט בפורמט bf16 ועד לחיתוכים אגרסיביים כמו q2_K או q3_K. ההבדל בין הגרסאות מתבטא ישירות בחדות של הפרטים הקטנים ודיוק הטקסט בתוך התמונה מול צריכת הזיכרון בפועל.

מתאים ל

  • עבודה מקומית על מחשב אישי

    מאפשר לייצר תמונות על כרטיסי מסך ביתיים עם 4GB בלבד בלי לשלם על שירותי ענן.

  • בניית אפליקציות מנותקות רשת

    מתאים לתוכנות שרצות מקומית על חומרת קצה ללא צורך בחיבור אינטרנט רציף.

  • הטמעה בפרויקטי C++

    משתלב ישירות עם ספריות קלות ללא צורך בהתקנת סביבת פייתון מסורבלת.

איפה זה נופל

התמיכה מוגבלת לשפות אנגלית וסינית, כך שאי אפשר לתת הנחיות בעברית ישירות למודל. בנוסף, רמות הכימוס הנמוכות ביותר גורמות לאיבוד פרטים, עיוותים ופגיעה קשה ביכולת של המודל לייצר טקסט קריא בתוך התמונות. שרשרת ההרצה מחייבת תלויות נוספות כמו קובצי VAE ומודל שפה נפרד, מה שמסבך את ההקמה הראשונית.

שאלות
נפוצות

האם המודל יבין הנחיות בעברית?

לא, המודל מוגדר ומאומן לעבוד עם אנגלית וסינית בלבד. אם תכתבו פרומפט בעברית תקבלו תוצאות משובשות או ריקות. הפתרון היחיד הוא לתרגם את הטקסט לאנגלית לפני ששולחים אותו לפקודת ההרצה.

איזו רמת כימוס כדאי לבחור להרצה ראשונה?

עבור כרטיס עם 4GB זיכרון מומלץ להתחיל מגרסת Q3_K שמאזנת בין דרישות החומרה לאיכות התמונה. אם יש לכם יותר זיכרון פנוי, גרסאות כמו q4_K או q5_0 ייתנו חדות טובה יותר ופחות מריחות. ירידה לכימוס נמוך יותר מומלצת רק אם המחשב נתקע מחוסר זיכרון.

איך מריצים

כדי להריץ אותו משתמשים בבינארי של stable-diffusion.cpp דרך שורת הפקודה. יש להוריד את קובץ המודל ברמת הכימוס שבחרתם, לצד מקודד טקסט מסוג Qwen3 ומודל VAE מתאים, ולהגדיר את הפרמטרים של התמונה ישירות בפקודה.

היתרון הגדול הוא היכולת לרדת עד כרטיסי מסך עם 4GB זיכרון בלבד בזכות דגל offload-to-cpu וכימוס נמוך כמו Q3_K. אם אין לכם כרטיס כזה או שאתם צריכים אלפי תמונות בדקה, עדיף להשתמש בפתרון ענן מרוחק ולא להעמיס את החומרה המקומית.

ollama run hf.co/leejet/Z-Image-Turbo-GGUF:Q4_0

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הקבצים משוחררים תחת רישיון apache-2.0, בהתאם לרישיון של מודל המקור. הרישיון הזה מתיר שימוש מסחרי חופשי, שינוי של המשקלים והפצה בתוך מוצר פרטי, בתנאי ששומרים על הודעת זכויות היוצרים ומצרפים עותק של תנאי הרישיון.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗