GPT
Q

Qwen3-4b-Z-Image-Turbo-AbliteratedV1

קוד פתוח

BennyDaBallapache-2.02026-01-28

  • safetensors
  • gguf
  • qwen3
  • abliterated
  • heretic

גרסה עוקפת סירובים למקודד טקסט של תמונות, שמיועדת למי שנמאס לו מהטפות מוסר. המודל מבוסס על ארבעה מיליארד פרמטרים ומסיר חסימות כמעט לחלוטין בלי לפגוע ביכולת.

  • 4Bפרמטרים
  • 40,960טוקנים בהקשר
  • 32.8 GBמשקל הקבצים
  • 24,424הורדות בחודש

מה זה

מדובר במודל שפה בגודל 4B שמיועד לשמש כמקודד טקסט עבור מחוללי תמונות מסוג Z-Image-Turbo. היוצר לקח את המודל המקורי והריץ עליו שיטה בשם p-e-w heretic לאורך אלף ניסיונות. המטרה היתה לנטרל את מנגנוני הסירוב המובנים, הן לגבי יצירת תמונות שנויות במחלוקת והן בסירובים כלליים של שיחה.

התוצאה היא מודל מרוקן מעכבות כמעט לגמרי, אבל בלי הניוון השכלי שקורה בדרך כלל בהתערבויות כאלה. מדד KL Divergence עומד על 0.0004 זעיר, מה שאומר שהמשקולות שלו כמעט לא התרחקו מהמקור והוא שמר על האינטליגנציה ועל יכולת ניתוח הטקסט המקורית שלו. במבחני עומס שנעשו עליו, שיעור הסירוב ירד ל־4 מתוך 100 בלבד.

בגודל כזה, לקבל מקודד טקסט שלא נתקע על כל מילה רגישה ועדיין מבין הנחיות מורכבות זה יתרון ברור. הוא חוסך את הצורך לנסח פרומפטים בדרכים עקיפות כדי להתחמק ממסננים.

מתאים ל

  • קידוד פרומפטים לתמונות

    מתאים לחיבור מול Z-Image-Turbo כשרוצים לתאר סצנות מורכבות בלי לחטוף סירובים על מילים תמימות.

  • פייפליין מקומי ללא צנזורה

    אידיאלי להתקנה מקומית במחשב שאינו מחובר לרשת, למי שצריך חופש יצירתי מוחלט בעיבוד טקסט.

  • יצירת תוכן למבוגרים

    משמש כבסיס טקסטואלי לפרויקטים שבהם מודלים מסחריים רגילים מסרבים לפעול בגלל הגדרות בטיחות מחמירות.

איפה זה נופל

היוצר מודה בפירוש ששיעור הסירוב עומד על 4 מתוך 100, כך שעדיין יש מקרים בודדים שבהם המודל יסרב לייצר פלט. בנוסף, הסרת מסנני הבטיחות אומרת שאין שום רשת ביטחון. הוא יפלוט טקסטים בעייתיים בלי לחשוב פעמיים. לפני שמשלבים אותו במוצר עם לקוחות קצה, חובה לבדוק איזה פלטים מגיעים למחולל התמונות כדי לא להסתבך עם תוכן פוגעני או לא חוקי.

שאלות
נפוצות

האם המודל יוצר תמונות בעצמו?

לא. מדובר במודל שפה המשמש כמקודד טקסט עבור מערכת Z-Image-Turbo. הוא מעבד את הפרומפט שלכם ומכין אותו עבור מחולל התמונות בפועל.

איזו גרסה של המודל כדאי להוריד?

הגרסה המאוזנת ביותר היא Q5_K_M ששוקלת 2.89 גיגה בייט ומספקת דיוק כמעט מלא. אם הזיכרון בכרטיס המסך שלכם מוגבל מאוד, אפשר לרדת ל־Q4_K_M בלי להרגיש הבדל משמעותי.

איך מריצים

כדי להריץ אותו לא צריך שרת יקר. יש גרסאות מכווצות בפורמט GGUF שמתחילות מ־1.67 גיגה בייט בגרסת Q2_K ומגיעות ל־8.05 גיגה בייט בדיוק מלא של F16. הגרסה המומלצת, Q5_K_M, שוקלת רק 2.89 גיגה בייט, כך שאפשר להריץ אותה בקלות על כרטיס מסך ביתי בסיסי או אפילו על מעבד סביר של מחשב נייד.

אם אתם מחברים אותו לפייפליין מקומי של יצירת תמונות, אין שום סיבה להשתמש ב־API חיצוני. המודל שוקל מעט, רץ מהר מקומית, ונותן שליטה מלאה בלי תלות ברשת או בשירותים חיצוניים שעשויים לחסום את הבקשות שלכם.

ollama run hf.co/BennyDaBall/Qwen3-4b-Z-Image-Turbo-AbliteratedV1:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הרישיון הוא Apache 2.0. מותר להשתמש בו לצרכים מסחריים, לשנות את המשקולות, להפיץ אותו מחדש ולשלב אותו במוצרים סגורים. התנאי היחיד הוא שמירה על הודעת זכויות היוצרים והרישיון המקורי בקבצים שלכם.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗