GPT
Q

Qwen3.5-27B-heretic

קוד פתוח

coder3101apache-2.02026-02-25

  • transformers
  • safetensors
  • qwen3_5
  • image-text-to-text
  • heretic

גרסה נטולת צנזורה של מודל המולטימודל בגודל 27B. היא מיועדת למי שחייב מודל שיענה על שאלות בלי סירובים מלאכותיים.

  • 27Bפרמטרים
  • 262,144טוקנים בהקשר
  • 51.0 GBמשקל הקבצים
  • 119,267הורדות בחודש

מה זה

מדובר בהסרת מגבלות של מודל הבסיס באמצעות כלי בשם Heretic, בשיטת חיתוך וקטורים שמכונה MPOA. היוצר התערב ישירות בשכבות הקשב והחישוב של הרשת כדי לנטרל את מנגנוני הסירוב המובנים. המדד המרכזי מראה ששיעור הסירובים של המודל צנח מ־94 מתוך 100 במקור ל־14 בלבד כאן, בזמן שמרחק ההתפלגות מהמשקלים המקוריים נשאר נמוך, 0.0653.

חוץ מזה, הבסיס עצמו משלב ארכיטקטורה של Gated DeltaNet עם שכבות קשב ומקבל תמונות וטקסט יחד. במבחני הביצועים של מודל המקור הוא מציג יכולות קידוד חזקות, כמו ציון 72.4 ב־SWE-bench ו־80.7 ב־LiveCodeBench, יחד עם חלון הקשר נרחב מאוד.

מתאים ל

  • מחקר על מנגנוני סירוב

    מאפשר לבדוק התנהגות של מודל שקטעו ממנו את וקטור הסירוב, ביחס למודל הבסיס המקורי.

  • עבודה עם טקסטים רגישים

    מתאים לניתוח מסמכים משפטיים או היסטוריים שהיו נחסמים אוטומטית במודלים רגילים.

  • בוט פנימי ללא הגבלות תוכן

    מספק יכולות ניתוח טקסט ותמונה בסביבה מבוקרת שבה הסירובים של מודל המקור פשוט מפריעים.

איפה זה נופל

התערבות כירורגית במשקלים נוטה לפגוע בעקביות, גם כשהמרחק הסטטיסטי נראה קטן. ב־14 מקרים מתוך 100 הוא עדיין סירב, כך שהצנזורה לא נעלמה לגמרי, ומצד שני הוא פתוח לחלוטין לפליטת תוכן רעיל או בעייתי. בנוסף, המבחנים שמופיעים בכרטיס שייכים למודל המקורי של עליבאבא ולא נמדדו מחדש על הגרסה הזו לאחר השינוי, כך שקשה לדעת אם יכולות הקוד או פתרון הבעיות נחלשו.

שאלות
נפוצות

האם המודל שמר על יכולות הקידוד המצוינות של מודל הבסיס?

הנתונים בטבלה נלקחו ישירות מהכרטיס של מודל המקור ולא נמדדו מחדש לאחר השינוי. שינוי משקלים באמצעות MPOA בדרך כלל משמר ביצועים כלליים, אבל כל התערבות כזו עלולה לפגוע ביציבות במשימות היגיון מורכבות.

אפשר להריץ אותו על כרטיס מסך בודד של מחשב ביתי?

לא בגרסה הזו. הקבצים שוקלים 51.0 גיגה בייט ודורשים יותר מ־60 גיגה בייט זיכרון וידאו להרצה ישירה, לכן תצטרכו שרת מתאים או גרסה מכווצת.

איך מריצים

המשקל הגולמי של הקבצים עומד על 51.0 גיגה בייט, כך שלהרצה מקומית מלאה בפורמט המקורי תצטרכו שרת עם שני כרטיסי 24 גיגה בייט או כרטיס מקצועי אחד של 48 עד 80 גיגה בייט לפחות. אם אין לכם חומרה כזו זמינה, מומלץ לחכות לגרסאות מכווצות או לשקול עבודה מול ספק שמריץ שרת ייעודי.

המודל מתאים ישירות לכלים כמו vLLM, Transformers ו־SGLang. מי שמתכנן להשתמש במלוא חלון ההקשר יצטרך לקחת בחשבון צריכת זיכרון משמעותית נוספת עבור ה־KV cache מעבר לגודל המשקלים הבסיסי.

from transformers import pipeline

pipe = pipeline("image-text-to-text", model="coder3101/Qwen3.5-27B-heretic")
print(pipe("שלום"))

הרישיון

הרישיון המדווח הוא apache-2.0, מה שמאפשר שימוש מסחרי, שינוי קוד והפצה של המשקלים כמעט בלי מגבלות, מלבד מתן קרדיט ושמירה על תנאי הרישיון המקוריים.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗