GPT
G

GLM-5.3-Flash-UNCENSORED-FP8

קוד פתוח

dealignaimit2026-08-26

  • safetensors
  • glm5_next
  • abliterated
  • uncensored
  • crack

גרסה נטולת מגבלות סינון של GLM-5.3-Flash, שמגיעה בכיול FP8 ישירות למשקולות. מי שבוחר בה מחפש מודל ענק עם ראייה וחלון של מיליון טוקנים שלא מסרב לבקשות.

  • 321Bפרמטרים
  • 1,048,576טוקנים בהקשר
  • 306 GBמשקל הקבצים
  • 3,015הורדות בחודש

מה זה

המודל הזה לוקח את הארכיטקטורה של GLM-5.3-Flash ומסיר ממנו את מנגנוני הסירוב ברמת הטנסורים עצמם, בלי שכבות LoRA או פרומפטים עוקפים. מדובר במודל תערובת מומחים שמפעיל 18 מיליארד פרמטרים בפועל מתוך 321 מיליארד בכל טוקן, יחד עם יכולת עיבוד תמונה וחלון הקשר של מיליון טוקנים.

בבדיקות של המפתחים על מדד MMLU הוא קיבל 87.33 אחוז, ציון ששומר על היכולות הכלליות של מודל הבסיס ואף עוקף אותו במעט. במבחן HarmBench-320 נרשמו אפס סירובים, מה שאומר שהוא עונה ישירות על בקשות שגרסאות בסיס רגילות חוסמות אוטומטית, כולל סביב זכויות יוצרים ותוכן מוגבל.

מתאים ל

  • מחקר אבטחת מידע

    ניתוח חולשות וקוד זדוני בלי חסימות אוטומטיות שמפריעות להערכת סיכונים.

  • ניתוח מסמכים מוגנים

    עיבוד טקסטים שמעלים בדרך כלל דגלי זכויות יוצרים במודלים מסחריים רגילים.

  • מענה טכני מורכב

    ניצול הקשר של מיליון טוקנים ותמיכה בתמונות בתוך מערכות פיתוח פנימיות.

איפה זה נופל

ההסרה של מנגנוני הבטיחות תלויה במצב החשיבה. במצב חשיבה נמוך המודל שומר על חלק מסירובי הבסיס במכוון, כדי למנוע פגיעה באיכות, כך שחופש הפעולה המלא קיים רק כשהחשיבה כבויה או מוגדרת על המקסימום. בנוסף, בפירוק נושאי MMLU רואים ירידה חדה בביצועים בתרחישי מוסר מ־83.3 אחוז ל־66.7 אחוז, ובמדעי המחשב לרמה האקדמית חלה נסיגה קלה. המודל מתועד באנגלית בלבד ודורש בדיקה מעמיקה לפני שילוב שלו במערכות שחשופות לקהל.

שאלות
נפוצות

האם המודל יפעל על כרטיסי מסך ביתיים?

לא. משקל הקבצים לבדו עומד על 306 גיגה בייט בפורמט FP8. תצטרכו לפחות ארבעה כרטיסי שרת מסוג H100 או H200 כדי לטעון ולהריץ אותו.

למה המודל עדיין מסרב לפעמים לבקשות?

העריכה של המשקולות נעשתה בצורה שמרנית במצבי חשיבה מסוימים. אם תריצו אותו עם רמת חשיבה נמוכה תיתקלו בסירובים, ולכן צריך לעבוד ללא חשיבה או במאמץ מקסימלי.

האם אפשר להשתמש בו במוצר מסחרי?

מבחינת רישיון MIT מותר להשתמש בו לכל מטרה. עם זאת, בגלל שאין עליו הגנות בטיחות, כל סיכון של פלט בעייתי הוא באחריותכם הבלעדית.

איך מריצים

כדי להריץ אותו מקומית צריך מערך של ארבעה כרטיסי H100 או H200, כי המשקולות תופסות 306 גיגה בייט ומיועדות לעבודה בטנזור מקבילי בארכיטקטורת Hopper. ההרצה נעשית דרך vLLM סטנדרטי עם הגדרות תואמות לניתוח כלים וחשיבה, ותמיכה בחיזוי מרובה טוקנים שמאיץ את הקצב ל־211 טוקנים בשנייה.

הקובץ דורש קומפילציה בזמן עלייה עם nvcc. אם אין לכם גישה לשרת עם ארבעה כרטיסי שרת מודרניים, אין טעם לנסות להרים אותו על חומרה ביתית ועדיף לפנות לתשתית ענן ייעודית.

pip install -U huggingface_hub
hf download dealignai/GLM-5.3-Flash-UNCENSORED-FP8

הקבצים

74 קבצים במאגר, 306 GB סך הכול. הקישורים מובילים ישירות ל־Hugging Face.

הרישיון

הרישיון הוא MIT, מה שנותן חופש כמעט מוחלט לשימוש פרטי או מסחרי, שינוי של המשקולות ושילוב במוצרים. התנאי היחיד הוא שמירת הודעת זכויות היוצרים של המפרסמים. כל האחריות על הפלט, במיוחד במודל נטול רסן, נופלת על מי שמריץ ומפיץ אותו.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש

הרישיון המלא בעמוד המודל ↗