GPT
S

SuperGLM-5.2-abliterated-NVFP4

קוד פתוח

Jiunsongmit2026-07-13

  • transformers
  • safetensors
  • glm_moe_dsa
  • text-generation
  • glm-5.2

גרסה ענקית של 381 מיליארד פרמטרים בכיול NVFP4, שממנה נוטרלו מנגנוני הסירוב המובנים. היא נועדה למי שצריך מודל עצום שלא חוסם בקשות, בלי לאבד את דחיסת החומרה של אנבידיה.

  • 381Bפרמטרים
  • 1,048,576טוקנים בהקשר
  • 433 GBמשקל הקבצים
  • 1,434הורדות בחודש

מה זה

מדובר בעיבוד ישיר למשקולות של GLM-5.2 מבית אנבידיה, שבוצע עליהם תהליך הסרת סירובים ממוקד. היוצר שינה 124 מטריצות BF16 ספציפיות של שכבות הצידוד והמומחים המשותפים, והטמיע את השינויים ישירות לתוך הקבצים כך שאין צורך במתאמי LoRA בזמן ריצה. שאר המומחים המכוילים בפורמט NVFP4 נשארו זהים למקור בבייט הבודד, לצד תמיכה בחלון עבודה עצום של מעל מיליון טוקנים.

בבדיקות הקבלה של HarmBench מול קטגוריית התוכן ההקשרי, המודל רשם 2 סירובים בלבד מתוך 160 הרצות, ללא אף מחרוזת סירוב מפורשת. הוא עבר בהצלחה 16 מתוך 16 בדיקות שפיות בסיסיות של פלט בלי עיוותי מבנה. הבדיקות האלה מאשרות רק שהוא עונה כמעט לכל בקשה ולא מייצר טקסט שבור, אבל הן לא מודדות יכולות חשיבה כלליות.

מתאים ל

  • מחקרי עמידות ובטיחות

    בדיקת גבולות של מודלים ענקיים ללא התנגדות מובנית של מנגנוני סירוב רגילים.

  • עיבוד טקסטים רגישים

    ניתוח מסמכים רפואיים, משפטיים או ביטחוניים שמודלים מסחריים חוסמים בטעות.

  • ניתוח הקשרים ארוכים

    הזנת כמויות ענק של נתונים תחת חלון של מעל מיליון טוקנים בסביבת Blackwell.

איפה זה נופל

ההערכה בכרטיס כוללת 16 בדיקות איכות בסיסיות בלבד, שנועדו לבדוק שאין שבירת פלט ולא מהוות מדד יכולת אמיתי. אין שום נתונים על רמת הביצועים שלו במשימות קוד, מתמטיקה או הבנת שפה מורכבת לעומת מודל המקור. בנוסף, הסרת חסמי הבטיחות והסירוב דורשת בדיקה זהירה מצדכם, כי הוא עלול לייצר תוכן מסוכן או שגוי בלי התרעה.

שאלות
נפוצות

האם אפשר להריץ את המודל על כרטיסי מסך מדורות קודמים?

המשקולות מכוילות בפורמט NVFP4 שפותח במיוחד לארכיטקטורת Blackwell. ניסיון להריץ אותו על ארכיטקטורות קודמות כמו Ada Lovelace או Hopper ידרוש המרות משקל מורכבות או שלא ייתמך כלל על ידי המנוע של SGLang.

האם המודל מהיר יותר מהגרסה המקורית של אנבידיה?

לא. מפתח המודל מציין במפורש שההסבה לא מציעה שום שיפור במהירות הריצה לעומת המקור. המטרה היחידה בשינויים הייתה נטרול הסירובים תוך שימור פורמט הקבצים והמשקולות.

איך מריצים

כדי להריץ אותו בפועל דרושה חומרת Blackwell ייעודית שתומכת בפורמט NVFP4. היוצר בדק את המודל על שרת של 8 כרטיסי RTX PRO 6000 דרך SGLang עם מנוע flashinfer_cutlass וחלוקת משקולות בדרגת 8. נפח הקבצים עומד על 433 גיגה בייט, כך שאי אפשר להסתדר כאן עם חומרה ביתית רגילה.

אם אין לכם גישה לאשכול שרתים ייעודי מהדור החדש של אנבידיה, הניסיון להעלות אותו לבד חסר סיכוי טכני. במצב כזה, פנייה לפתרונות ענן או שימוש במודל שרץ מאחורי API זמין יהיו האפשרות המעשית היחידה.

from transformers import pipeline

pipe = pipeline("text-generation", model="Jiunsong/SuperGLM-5.2-abliterated-NVFP4")
print(pipe("שלום"))

הקבצים

59 קבצים במאגר, 433 GB סך הכול. הקישורים מובילים ישירות ל־Hugging Face.

הרישיון

המודל מופץ תחת רישיון MIT. מדובר ברישיון קוד פתוח מתירני מאוד, שמאפשר שימוש מסחרי, שינוי קוד, הרצה והפצה בלי תשלום תמלוגים. התנאי היחיד הוא שמירת הודעת זכויות היוצרים והפטור מאחריות של היוצר בקבצי הפרויקט.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש

הרישיון המלא בעמוד המודל ↗