GPT
G

GLM-4.7-Flash-Uncensored-HauhauCS-Aggressive

קוד פתוח

HauhauCSmit2026-01-24

  • gguf
  • uncensored
  • glm4
  • moe
  • en

גרסה נטולת סינונים לחלוטין למודל המהיר של GLM, בלי חסימות ובלי מעצורים. מתאים למי שחייב תשובות ישירות על נושאים שהמקור מסרב לגעת בהם.

  • 125 GBמשקל הקבצים
  • 16,836הורדות בחודש
  • 41לייקים

מה זה

מדובר בהסרת מנגנוני הסירוב מהמודל GLM-4.7-Flash של חברת Z.ai, בלי שינוי בדאטה או ביכולות המקוריות. המודל בנוי בארכיטקטורת תערובת מומחים עם 31 מיליארד פרמטרים בסך הכול, אבל מפעיל רק כשלושה מיליארד בכל מעבר, מה שנותן לו מהירות תגובה גבוהה ביחס לגודלו המלא יחד עם חלון הקשר של 202 אלף טוקנים.

ההבדל העיקרי כאן הוא רמת האגרסיביות בהסרת החסימות. זו לא התאמה עדינה, אלא דריסה כמעט מוחלטת של תבניות הסירוב, מה שמבטיח שהוא יענה גם על פרומפטים שגרסאות מאוזנות יותר דוחות. מבחינת שפות, המודל מיועד רשמית לאנגלית ולסינית בלבד.

מתאים ל

  • מחקר תוכן לא מצונזר

    בדיקת תגובות וניתוח טקסטים ללא התערבות של מנגנוני בטיחות וסירוב מובנים.

  • עיבוד מסמכים ארוכים

    ניתוח טקסטים של עד 202 אלף טוקנים במהירות גבוהה בזכות שימוש בשלושה מיליארד פרמטרים פעילים בלבד.

  • משחקי תפקידים וכתיבה

    יצירת דיאלוגים וסיפורים חופשיים בלי לחשוש מחסימות פתאומיות באמצע העלילה.

איפה זה נופל

ההסרה האגרסיבית של הסינונים פוגעת באמינות. הכרטיס מציין במפורש שאם אתם צריכים סוכנים או משימות קוד שדורשות דיוק ויציבות גבוהה, הגרסה הזו פחות מתאימה ועדיף לקחת את גרסת Balanced. בנוסף, אין תמיכה מוצהרת בעברית, והוא עלול לייצר תכנים בעייתיים בלי שום שכבת הגנה פנימית.

שאלות
נפוצות

אפשר להריץ את המודל הזה על Ollama?

לא מומלץ. כרטיס המודל מזהיר שיש תקלות בתבנית השיחה בתוכנה הזו. עדיף להריץ אותו עם llama.cpp, LM Studio או Jan.

למה לבחור בגרסת Aggressive במקום Balanced?

הגרסה הזו מתאימה רק אם ניסיתם את גרסת Balanced והיא עדיין סירבה לפרומפטים שלכם. למשימות פיתוח וסוכנים עדיף להישאר עם הגרסה המאוזנת כדי לא לאבד יציבות.

איך מריצים

יש ארבע גרסאות מכווצות בפורמט GGUF להורדה, ממשקל של 17 גיגה בגרסת Q4_K_M ועד 56 גיגה לקובץ ה־FP16 המלא. כדי להריץ את הגרסה הקלה בנוחות דרוש כרטיס מסך עם לפחות 24 גיגה זיכרון, בעוד שהגרסאות הגדולות יותר ידרשו חומרה כבדה בהרבה או חלוקה בין מעבד לכרטיס מסך.

אפשר להריץ אותו דרך llama.cpp, LM Studio, Jan או koboldcpp, אבל היוצר ממליץ במפורש לא להשתמש ב־Ollama בגלל בעיות בתבנית השיחה. בהגדרות הריצה של llama.cpp חייבים לבטל את ה־repeat penalty, להגדיר min-p ל־0.01 ולהשתמש בדגל jinja כדי לקבל פלט תקין.

ollama run hf.co/HauhauCS/GLM-4.7-Flash-Uncensored-HauhauCS-Aggressive:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הרישיון הוא MIT, מה שאומר שיש לכם חופש מלא לעשות איתו מה שתרצו, כולל שימוש מסחרי, שינויים והפצה בקוד סגור. התנאי היחיד הוא שמירת הודעת זכויות היוצרים המקורית והסרת אחריות מהיוצר. קחו בחשבון שהיעדר הסינונים במודל מטיל את כל האחריות המשפטית והתוכנית עליכם אם תחשפו אותו למשתמשי קצה.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש

הרישיון המלא בעמוד המודל ↗