GPT
Q

Qwen3-4b-Z-Image-Engineer-V2.5

קוד פתוח

BennyDaBallapache-2.02026-01-17

  • safetensors
  • gguf
  • image-generation
  • prompt-engineering
  • qwen

הכלי מרחיב רעיונות בסיסיים להנחיות טכניות מפורטות ליצירת תמונות, ומשמש גם כמקודד טקסט ישיר למודלים כמו Z-Image-Turbo. הוא פותר את הצורך לחשוב לבד על תאורה, עדשות וקומפוזיציה.

  • 29.3 GBמשקל הקבצים
  • 1,399הורדות בחודש
  • 64לייקים

מה זה

המודל מבוסס על ארכיטקטורת Qwen 3 עם 4 מיליארד פרמטרים, ועבר אימון LoRA על כל 36 השכבות שלו באמצעות 10,000 איטרציות. הבסיס שלו אינו מודל שיחה רגיל, אלא מקודד הטקסט המקורי של Z-Image-Turbo, שאומן ספציפית על כ־34,678 דוגמאות של הרחבת הנחיות שנוצרו על ידי Qwen3 VL 30B.

התפקיד שלו כפול. מצד אחד הוא יודע לקבל רעיון גולמי קצר ולהפוך אותו לתיאור ויזואלי מורכב עם מונחים מקצועיים של צילום, סוגי פילם וזוויות תאורה. מצד שני, אפשר לחבר אותו ישירות כמקודד טקסט חלופי בתהליך היצירה כדי לקבל תוצאות מגוונות ונקיות יותר מאותו סיד, בניגוד לגרסת V1 המוקדמת שסבלה מארטיפקטים קשים, או למודל הבסיס שמייצר תמונות גנריות למדי.

מתאים ל

  • שדרוג פרומפטים אוטומטי

    הרחבת ביטויים קצרים להנחיות צילום עשירות בתוך פייפליין מקומי לפני שליחה לגנרטור התמונות.

  • מקודד טקסט ב־ComfyUI

    החלפת ה־CLIP המקורי ב־Z-Image-Turbo כדי להשיג תאורה טבעית יותר ופרטים מדויקים בכל יצירה.

  • בניית כלי עיצוב פנימיים

    הטמעה באפליקציות מקומיות שדורשות ממשק שפה פשוט שהופך להגדרות תמונה טכניות, ללא עלויות ענן.

איפה זה נופל

זה לא מודל שיחה כללי ולא מנוע לכתיבת קוד. אם תבקשו ממנו לענות על שאלות ידע, לתרגם או לעשות משימות טקסט סטנדרטיות, תקבלו תוצאות חלשות במקרה הטוב, או תיאורי תמונות לא קשורים במקרה הרע.

בנוסף, הנתונים אומנו מול מודלי תמונה מסוימים כמו Z-Image-Turbo ו־Flux2 Klein. אם אתם עובדים עם מודלים אחרים בעלי רגישות שונה למילות מפתח, ההרחבות שלו עלולות להעמיס מושגים טכניים שלא ישפיעו כלל או ישבשו את התוצאה הסופית. אין שום תיעוד ליכולות שלו בעברית, ולכן חובה להזין ולקבל ממנו הנחיות באנגלית בלבד.

אותה משפחה

Qwen3-4b-Z-Image-Engineer יצא ב־3 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם אפשר להשתמש בו ישירות כמודל צ'אט?

לא. הוא עבר כוונון ייעודי להבנת סצנות ויזואליות והרחבת תיאורים עבור מנועי תמונה. שימוש בו כצ'אטבוט רגיל יניב טקסטים מוזרים שנוטים לתיאורי תאורה ועדשות במקום תשובות ענייניות.

איזו גרסת קוונטיזציה כדאי להוריד למחשב אישי?

גרסת Q5_K_M היא הבחירה המאוזנת ביותר, שכן היא שוקלת 2.7 גיגה בייט ושומרת על איכות הטקסט כמעט במלואה. אם הזיכרון בכרטיס המסך שלכם לחוץ במיוחד לצד מודל התמונה, אפשר לרדת ל־Q4_K_M ששוקלת 2.3 גיגה בייט.

איך מריצים

כדי להריץ אותו מקומית יש גרסאות GGUF שמתאימות לכלים כמו Ollama, LM Studio או llama.cpp, לצד צומת ייעודי עבור ComfyUI. בגרסת Q5_K_M המאוזנת הוא שוקל 2.7 גיגה בייט בלבד, מה שאומר שהוא ירוץ בלי בעיה גם על כרטיס מסך בסיסי עם 6 עד 8 גיגה זיכרון, או על מעבדי אפל סיליקון סטנדרטיים. אפילו גרסת Q8_0 תופסת רק 4 גיגה בייט זיכרון.

בגודל כזה ממש אין שום סיבה לשלם על API חיצוני. הוא קל מספיק כדי לשבת ברקע של תחנת העבודה שלכם לצד מודל התמונה הראשי, בלי להעמיס על המשאבים ובלי לשלוח את ההנחיות לשרתים מרוחקים.

ollama run hf.co/BennyDaBall/Qwen3-4b-Z-Image-Engineer-V2.5:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הפרויקט מופץ תחת רישיון apache-2.0. מותר להשתמש בו לצרכים מסחריים ופרטיים, לשנות את המשקלים ולהפיץ אותם מחדש. התנאי המרכזי הוא שמירה על הודעת זכויות היוצרים וציון הרישיון המקורי בקבצים שלכם, ללא נטילת אחריות מצד היוצר.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗