GPT
S

SuperQwen3.8-27b-abliterated

קוד פתוח

Jiunsongapache-2.02026-08-24

  • transformers
  • safetensors
  • qwen3_5
  • image-text-to-text
  • qwen3.8

גרסה נטולת סירובים של מודל המולטימודל 28B, שגם עוצרת את החשיבה החוזרת של מודל המקור. מי שיבחר בה מחפש הרצה מקומית מלאה בלי מגבלות בטיחות מובנות ועם יכולת ראייה.

  • 28Bפרמטרים
  • 262,144טוקנים בהקשר
  • 51.8 GBמשקל הקבצים
  • 1,587הורדות בחודש

מה זה

מדובר בעריכת משקלים ישירה של מודל המקור מבית Qwen, שמטרתה העיקרית היא איפוס נטיית הסירוב. במבחן שנערך מול 32 שאילתות שהמקור סירב לרובן המוחלט, הגרסה הזו ענתה על כולן בלי לייצר פלטים ריקים, תוך שמירה מלאה על שכבות הראייה המקוריות והיכולת להפעיל כלים.

בנוסף לנטרול הסירובים, נעשה שינוי בתבנית ברירת המחדל של תהליך ההסקה. מודל המקור נטה לחשיבת יתר ולופים במאמץ גבוה, וכאן הוגדרה רמת ביניים עם תנאי עצירה שמונע חזרות ברגע שנמצאה תשובה, מה שעבר 36 בדיקות תקינות מוגדרות מראש. המודל שומר על היכולת לעבד טקסטים ארוכים ונבדק בהצלחה בשליפת מידע בתוך חלון של 262,043 טוקנים.

מתאים ל

  • ניתוח מסמכים ותמונות

    מאפשר עיבוד תמונות ומסמכים ארוכים יחד בלי שהמודל יסרב לנתח מידע רגיש או פיננסי.

  • סוכן חצי-אוטונומי מוגבל לולאות

    התאמת תבנית ההסקה מונעת חזרות בלתי נגמרות בזמן פתרון בעיות והפעלת כלים.

  • שליפת מידע מטקסטים ענקיים

    נבדק בפועל על קונטקסט מלא של 262 אלף טוקנים לצורך מציאת פרטים מוסתרים.

איפה זה נופל

ההסרה של מנגנוני הסירוב משאירה את המודל חשוף לחלוטין לפלטים לא בטוחים או מטעים, וכל מנגנוני הסינון נופלים עליכם. במבחני היכולת מול המקור נרשם ציון של 7 מתוך 8, כך שקיימת פגיעה קלה בביצועים ביחס למודל הבסיס. בנוסף, בדיקת ההרחבה למיליון טוקנים הופסקה ידנית ולא הושלמה, כך שאין שום הבטחה ליציבות מעבר לחלון המקורי, והשפות הרשמיות הן אנגלית וקוריאנית בלבד בלי תמיכה מוצהרת בעברית.

שאלות
נפוצות

האם המודל עובד בעברית?

השפות שהוגדרו בכרטיס המודל הן אנגלית וקוריאנית בלבד. הוא עשוי לפלוט עברית בזכות ארכיטקטורת הבסיס, אך אין עליה שום בדיקה או התחייבות לאיכות.

מה המשמעות של הסרת הסירובים בפועל?

המודל עבר עריכה שביטלה את נטיית הבסיס לסרב לבקשות. זה אומר שהוא יענה גם על שאלות שמודל המקור דחה, ואינו כולל שכבת הגנה פנימית.

האם צריך מתאם LoRA כדי להריץ אותו?

לא, המשקלים שוחררו ישירות בפורמט BF16 מלא. טוענים אותו ישירות דרך ספריית transformers כמו כל מודל רגיל.

איך מריצים

המודל מגיע במשקלי BF16 מלאים ששוקלים קרוב ל־52 גיגה בייט, כך שאי אפשר להריץ אותו על כרטיס ביתי סטנדרטי בלי קוונטיזציה. תצטרכו חומרה ברמת שרת עם לפחות 64 עד 80 גיגה בייט של זיכרון גרפי, כמו A100 או כרטיסים מקבילים, רק כדי לטעון אותו לפני שמתחילים לחשב קונטקסט ארוך.

קצב הפענוח שנמדד במערכת ניסוי עומד על כ־4.34 טוקנים לשנייה למשתמש בודד. אם אתם צריכים שירות מהיר לייצור או מענה למשתמשים רבים במקביל, שרת בודד לא יספיק ויהיה עדיף להשתמש בתשתית ייעודית מבוזרת או בפתרון מנוהל.

from transformers import pipeline

pipe = pipeline("image-text-to-text", model="Jiunsong/SuperQwen3.8-27b-abliterated")
print(pipe("שלום"))

הקבצים

52 קבצים במאגר, 51.8 GB סך הכול. הקישורים מובילים ישירות ל־Hugging Face.

הרישיון

הרישיון הוא Apache 2.0, שמאפשר שימוש מסחרי חופשי, שינוי של הקוד והפצה פנימית או חיצונית במוצרים. התנאי העיקרי הוא שמירה על הודעות זכויות היוצרים והרישיון המקורי, בלי תשלום תמלוגים ובלי מגבלות על סגירת הקוד שפיתחתם מעליו.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗