GPT
Q

Qwen3-4b-Z-Image-Engineer-V4

קוד פתוח

BennyDaBallapache-2.02026-02-04

  • transformers
  • safetensors
  • gguf
  • text-generation
  • prompt-engineering

הוא לוקח רעיון בסיסי לתמונה ומרחיב אותו לתיאור קולנועי מדויק, בלי להישען על שירות חיצוני. מתאים במיוחד למי שמריץ מודלי תמונה מקומית ורוצה שליטה אופטית מלאה.

  • 37.5 GBמשקל הקבצים
  • 7,136הורדות בחודש
  • 165לייקים

מה זה

זהו מודל טקסט של ארבעה מיליארד פרמטרים שעבר אימון מלא על בסיס ארכיטקטורת Qwen 3, ולא רק שכבת התאמה קלה. הוא אומן על 55,000 דוגמאות שמשלבות ניתוח של צילומים מקצועיים ויצירה סינתטית, במטרה לשמש גם כמנוע הרחבת פרומפטים וגם כטקסט אנקודר עבור מחולל התמונות Z-Image-Turbo.

במקום לזרוק מילות תואר ריקות, הוא מוסיף פרטים על עדשות, זוויות תאורה והיררכיה חזותית בין הרקע לחזית. יוצר המודל מדווח על ירידה של חמישים וחמישה אחוזים במדד הלוס באימות ביחס לגרסת הבסיס, יחד עם שיטות רגולריזציה שנועדו למנוע ממנו להיתקע בלולאות טקסט מוכרות.

מתאים ל

  • הרחבת פרומפטים ב־ComfyUI

    חיבור ישיר לתוסף ייעודי שמרחיב רעיון גולמי לתיאור מפורט עם הגדרות תאורה ועדשה.

  • טקסט אנקודר ל־Z-Image

    שימוש במודל כרכיב קידוד טקסט שמייצר תוצאות מגוונות מאותו סיד ראשוני.

  • יצירת תיאורי צילום מקומיים

    תרגום קונספט קצר להוראות בימוי חזותיות על מחשב אישי בלי לשלוח מידע לרשת.

איפה זה נופל

אורך ההקשר באימון עמד על 640 טוקנים בלבד, כך שהוא לא בנוי לשיחות ארוכות, זיכרון מתמשך או ניתוח מסמכים. המודל אומן באנגלית בלבד, ובסיס האימון שלו הוא גרסה נטולת סינונים, כך שאין בו מנגנוני בטיחות מובנים מפני יצירת תוכן בעייתי. חובה לבדוק את התוצרים שלו לפני שמשלבים אותו ישירות במערכת אוטומטית שחשופה למשתמשי קצה.

אותה משפחה

Qwen3-4b-Z-Image-Engineer יצא ב־3 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

איזו גרסת קובץ כדאי להוריד למחשב אישי רגיל?

עבור רוב המשתמשים גרסת Q8_0 ששוקלת 4.3 גיגה תיתן איכות כמעט זהה למקור. אם הזיכרון בכרטיס הגרפי מוגבל מאוד, גרסת Q4_K_M תופסת רק 2.5 גיגה ומספקת פשרה טובה.

האם המודל מבין וכותב עברית?

המודל הוגדר ואומן עבור השפה האנגלית בלבד. כדי להפיק ממנו תוצאות טובות עבור תמונות, חובה לעבוד מולו באנגלית.

איך מריצים

אפשר להריץ אותו מקומית דרך LM Studio, Ollama או תוסף ייעודי ל־ComfyUI. משקל המודל השלם בפורמט המקורי דורש כרטיס גרפי עם זיכרון נדיב, אבל בגרסאות מכווצות כמו Q4_K_M הוא יורד לשני גיגה וחצי בלבד ונכנס כמעט בכל כרטיס מודרני פשוט.

אם אתם מחפשים את הגרסה הכי עדכנית, היוצר כבר שחרר את V6 כגרסה ייעודית חדשה יותר למחולל התמונות. אם אתם צריכים רק מדי פעם לשפר שורת טקסט ואין לכם עניין להחזיק משאבי חישוב מקומיים, עדיף פשוט לקרוא לכל מודל שפה כללי ב־API.

ollama run hf.co/BennyDaBall/Qwen3-4b-Z-Image-Engineer-V4:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הרישיון הוא Apache 2.0. זהו רישיון קוד פתוח מתירני שמאפשר שימוש מסחרי, שינוי של הקוד והפצה מחדש במוצרים סגורים. התנאי המרכזי הוא שמירה על הודעת זכויות היוצרים והרישיון המקורי בקבצים שמפיצים.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗