GPT
H

Huihui-Qwen3-VL-30B-A3B-Instruct-abliterated

קוד פתוח

huihui-aiapache-2.02025-10-05

  • transformers
  • safetensors
  • qwen3_vl_moe
  • image-text-to-text
  • abliterated

גרסה נטולת סינונים למודל ראייה ושפה עם חלון של 262,144 טוקנים. הוא נועד למי שצריך ניתוח תמונות וטקסט בלי סירובים מובנים של המערכת המקורית.

  • 31Bפרמטרים
  • 262,144טוקנים בהקשר
  • 57.9 GBמשקל הקבצים
  • 1,161הורדות בחודש

מה זה

מדובר במודל ראייה וטקסט שמבוסס על הארכיטקטורה של Qwen3 עם מנגנון Mixture of Experts, הכולל 31,070,754,032 פרמטרים. ההבדל המרכזי מול גרסת המקור הוא תהליך abliteration שבוצע על רכיב הטקסט בלבד, במטרה לעקור את מנגנוני הסירוב המובנים. לפי היוצרים שלו, השינוי מונע ממנו להחזיר תשובות כמו חוסר יכולת לתאר או לנתח תמונה מסוימת.

המודל תומך בחלון הקשר של 262,144 טוקנים, מה שמאפשר להזין מסמכים ארוכים או רצפי שיחה ממושכים יחד עם קלט ויזואלי. שימו לב שרכיב הראייה עצמו לא עבר עיבוד מחדש, אלא רק האופן שבו שכבות הטקסט מייצרות את המענה הסופי.

מתאים ל

  • ניתוח תמונות ללא חסימות

    מתאים לבדיקת תמונות שמודלים רגילים מסרבים לנתח או לתאר בגלל מסנני בטיחות מחמירים.

  • מחקר על עקיפת סינונים

    משמש כלי לבחינת ההשפעה של abliteration על שכבות הטקסט במודלים מולטימודליים.

  • עיבוד מסמכים ארוכים

    מנצל חלון של 262,144 טוקנים לניתוח טקסט מורכב לצד תמונות ותרשימים.

איפה זה נופל

ההסרה של מנגנוני הבטיחות הופכת אותו לבעייתי בסביבות ייצור. יוצרי המודל מציינים בפירוש שהוא עלול לייצר פלטים שנויים במחלוקת, פוגעניים או רגישים, וממליצים להגביל את השימוש למחקר ולניסויים בסביבה מבוקרת. אין פה שום סינון ברירת מחדל, ומי שמריץ אותו אחראי לבדוק כל פלט כדי לא להסתבך עם תוכן לא חוקי או בעייתי.

שאלות
נפוצות

האם המודל יסרב לתאר תמונות מסוימות?

היוצרים ביצעו abliteration לחלק הטקסטואלי כדי למנוע הודעות סירוב, כך שהוא אמור לענות בלי להכריז שאינו יכול לנתח את התמונה.

מה נדרש כדי להריץ אותו דרך Ollama?

צריך לעדכן לגרסה Ollama-v0.12.7 לפחות, ולהריץ ישירות את המזהה huihui_ai/qwen3-vl-abliterated:30b-a3b-instruct.

האם כדאי לשלב אותו באפליקציה ציבורית?

לא מומלץ לחבר אותו למשתמשי קצה ללא סינון נוסף. המפתחים מדגישים שהבטיחות הופחתה משמעותית ושיש לבצע בקרה ידנית.

איך מריצים

המשקל הכולל של הקבצים מגיע ל־57.9 GB שמחולקים ל־27 קבצים נפרדים, כך שאתם צריכים זיכרון וידאו משמעותי כדי להחזיק אותו בזיכרון. אפשר להריץ אותו דרך transformers או באמצעות Ollama החל מגרסה 0.12.7 עם הפקודה ollama run huihui_ai/qwen3-vl-abliterated:30b-a3b-instruct.

אם אין לכם שרת ייעודי עם כרטיסי מסך חזקים שמתאימים למשקל של 57.9 GB, תצטרכו לחפש קוונטיזציה או לפנות לפתרונות ענן, כי הרצה מקומית על מחשב רגיל פשוט תיחנק.

from transformers import pipeline

pipe = pipeline("image-text-to-text", model="huihui-ai/Huihui-Qwen3-VL-30B-A3B-Instruct-abliterated")
print(pipe("שלום"))

הרישיון

הרישיון המדווח הוא apache-2.0, שמאפשר שימוש חופשי וגם שימוש מסחרי, שינוי של הקוד והפצה מחדש. עם זאת, היוצרים מבהירים שהם לא לוקחים אחריות על התוצאות, כך שכל הסיכון המשפטי והמעשי בשימוש בפלטים חל עליכם בלבד.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗