GPT
H

Huihui-Qwen3-VL-4B-Instruct-abliterated

קוד פתוח

huihui-aiapache-2.02025-10-16

  • transformers
  • safetensors
  • qwen3_vl
  • image-text-to-text
  • abliterated

גרסה נטולת סירובים של מודל ראייה ושפה קומפקטי. הוא נועד למי שצריך ניתוח תמונות וטקסט בלי לקבל הודעות שגיאה על תוכן רגיש.

  • 4.4Bפרמטרים
  • 262,144טוקנים בהקשר
  • 8.3 GBמשקל הקבצים
  • 18,673הורדות בחודש

מה זה

מדובר במודל ראייה וטקסט המבוסס על הארכיטקטורה של Qwen3-VL בגודל 4.4 מיליארד פרמטרים, שעבר תהליך הסרת סירובים. המפתח עיבד רק את רכיב הטקסט בשיטת abliteration כדי למנוע ממנו לענות שהוא לא יכול לתאר או לנתח את התמונה שהעליתם, בעוד שרכיב הראייה עצמו נשאר ללא שינוי.

הוא שומר על חלון הקשר ענק של 262,144 טוקנים, מה שמאפשר להזין מסמכים ארוכים או רצפי תמונות גדולים. הייחוד כאן הוא הפתיחות לנתח כל קלט חזותי בלי חסימות פנימיות, דבר שנדיר למצוא במודלים רשמיים בגודל כזה שנוטים לצנזר נושאים רפואיים, ביטחוניים או שנויים במחלוקת.

מתאים ל

  • מחקר וניתוח תמונות רגישות

    מאפשר לעבד תמונות שמודלים רגילים מסרבים לנתח, בלי לקבל סירובים אוטומטיים.

  • סביבות בדיקה מבוקרות

    מתאים לבחינת עמידות של מערכות סינון טקסט וראייה פנימיות מול פלטים חופשיים לחלוטין.

  • הרצה מקומית ומאובטחת

    עובד במחשב מקומי דרך Ollama לשמירה מלאה על פרטיות המידע החזותי בלי לשלוח שום דבר לרשת.

איפה זה נופל

ההסרה של מנגנוני הבטיחות הופכת אותו למסוכן לשימוש ישיר מול לקוחות. הוא עלול לפלוט תוכן פוגעני, שגוי או בעייתי משפטית בלי שום אזהרה, והיוצרים מציינים במפורש שהוא מיועד למחקר ולניסויים ולא לפרודקשן ציבורי.

בנוסף, מאחר שרק רכיב הטקסט עבר התאמה ולא רכיב הראייה, ייתכנו מקרים שבהם המודל יתקשה לפרש את התמונה עצמה אם רכיב הראייה המקורי לא הוכשר עליה היטב. חובה להציב שכבת בקרה אנושית על הפלטים.

שאלות
נפוצות

האם המודל יסרב לנתח תמונות מסוימות?

המודל עבר תהליך שמבטל את מנגנוני הסירוב המובנים בטקסט, כך שהוא לא אמור להחזיר הודעות כמו 'אני לא יכול לנתח את התמונה הזו'. עם זאת, היכולת שלו בפועל תלויה באיכות הזיהוי של רכיב הראייה המקורי שלא שונה.

האם כדאי לשלב אותו באפליקציה ציבורית למשתמשי קצה?

ממש לא מומלץ. היעדר מנגנוני הבטיחות אומר שהוא עלול לייצר תוכן לא הולם או פוגעני ישירות למשתמשים, והיוצרים מדגישים שהוא מתאים רק לסביבות מחקר ופיתוח מבוקרות.

איך מריצים

במשקל כולל של 8.3 גיגה בייט, המודל נכנס בקלות לכרטיס מסך ביתי בודד עם 12 או 16 גיגה זיכרון וידאו, או בריצה מקומית על מחשב נייד חזק. אפשר להריץ אותו ישירות דרך ספריית transformers בפייתון, או למשוך גרסה מוכנה לתוך Ollama בגרסה 0.12.7 ומעלה בפקודה אחת.

אם אתם צריכים זמני תגובה אפסיים בעומס כבד או שאין לכם כרטיס גרפי מתאים, עדיף להשתמש בשרתי ענן או ב־API חיצוני. עם זאת, הרצה עצמאית היא הדרך היחידה לשמור על התמונות שלכם פרטיות לגמרי, במיוחד כשמדובר במודל לא מצונזר.

from transformers import pipeline

pipe = pipeline("image-text-to-text", model="huihui-ai/Huihui-Qwen3-VL-4B-Instruct-abliterated")
print(pipe("שלום"))

הרישיון

הרישיון המדווח הוא Apache 2.0, רישיון קוד פתוח מתירני מאוד. אתם רשאים להשתמש בו לצרכים מסחריים, לשנות אותו, להפיץ אותו ולשלב אותו בתוכנה סגורה, בתנאי שאתם שומרים על הודעות זכויות היוצרים והרישיון המקורי. היוצרים מסירים כל אחריות לנזקים שייגרמו מהשימוש.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗