GPT
G

gemma-4-31B-it-uncensored-GGUF

קוד פתוח

TrevorJSapache-2.02026-04-05

  • gguf
  • abliteration
  • uncensored
  • gemma-4
  • text-generation

גרסה מכווצת ומנוטרלת מסירובים של גמא בגודל 31 מיליארד פרמטרים. היא מתאימה למי שרוצה להריץ שרת מקומי חופשי מצנזורה בלי לחטוף סירובים מלאכותיים.

  • 47.8 GBמשקל הקבצים
  • 7,552הורדות בחודש
  • 46לייקים

מה זה

מדובר בהמרה לפורמט GGUF של מודל שעבר תהליך הסרת סירובים בשיטה שנקראת norm-preserving biprojected abliteration על בסיס המודל המקורי של גוגל. המטרה פה היא לבטל את מנגנוני הבטיחות שגורמים למודל לסרב לענות לבקשות מסוימות, בלי לפגוע במשקלים הכלליים של הרשת מעבר למה שחייבים.

הקבצים מחולקים לשתי גרסאות כימות עיקריות, Q4_K_M ו־Q8_0, שנועדו להקל על הטעינה למחשב מקומי או לשרת פרטי. מכיוון שמדובר ביצירה של הקהילה שמבוססת על שינוי וקטורי הפעלה פנימיים, הוא פונה ישירות למי שמחפש מודל הוראות שלא מטיף מוסר ולא מתחמק מתשובות בעבודה שוטפת באנגלית.

מתאים ל

  • מחקר אבטחה ובדיקות חדירה

    מאפשר לבדוק תרחישי תקיפה וקוד זדוני ללא חסימות מערכתיות מובנות.

  • כתיבה חופשית ללא מגבלות

    מייצר טקסטים יצירתיים ועלילתיים בלי סירובים על נושאים רגישים.

  • אימון ובדיקת סינונים

    משמש כבסיס גולמי שמעליו אתם יכולים לבנות שכבת בטיחות פרטית משלכם.

איפה זה נופל

המודל מוגדר רשמית לשפה האנגלית בלבד, כך שלא כדאי לבנות עליו לפרויקטים בעברית או למשימות רב לשוניות מורכבות בלי לבדוק אותו קודם. בנוסף, הסרת מנגנוני הסירוב אומרת שהאחריות כולה עליכם, כי הוא פשוט לא יעצור פלטים בעייתיים או מסוכנים אם תבקשו ממנו. מעבר לזה, הכרטיס אינו מציג מדדי ביצועים מלאים ומפנה למקור, כך שחובה לוודא שהתהליך לא פגע ביכולות החשיבה והקוד במשימות הספציפיות שלכם.

שאלות
נפוצות

האם המודל תומך בעבודה בעברית?

הכרטיס מגדיר תמיכה באנגלית בלבד. יכול להיות שהוא יבין מעט עברית בזכות נתוני האימון המקוריים של גוגל, אבל איכות הפלט לא מובטחת ולא הייתי מסתמך עליו למשימות מקומיות.

באיזה קובץ כדאי לבחור מבין השניים?

אם יש לכם כרטיס מסך בודד של 24 ג'יגהבייט, קובץ ה־Q4_K_M בגודל 18.7 ג'יגהבייט הוא האפשרות היחידה שתעבוד בצורה סבירה. גרסת ה־Q8_0 שוקלת 32.6 ג'יגהבייט ומיועדת למי שמחזיק תחנת עבודה חזקה יותר ולא רוצה לאבד דיוק בכימות.

איך מריצים

טוענים את הקבצים ישירות דרך llama-server עם פקודה פשוטה שמגדירה הקשר של 8192 טוקנים, ופותחים ממשק דפדפן מקומי בכתובת המקומית. אין פה תהליך התקנה מפותל מעבר לשימוש בספריות תומכות GGUF רגילות.

גרסת Q4_K_M שוקלת 18.7 ג'יגהבייט ותדרוש כרטיס מסך חזק עם לפחות 24 ג'יגה זיכרון כדי לרוץ בנוחות, בעוד גרסת Q8_0 שוקלת 32.6 ג'יגהבייט ומחייבת מערך של כמה כרטיסים או זיכרון מערכת משמעותי. אם אין לכם חומרה כזאת פנויה, החזקת שרת ייעודי כזה תהיה יקרה וכבדה ביחס לקריאה לשרותי ענן חיצוניים.

ollama run hf.co/TrevorJS/gemma-4-31B-it-uncensored-GGUF:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הקבצים

4 קבצים במאגר, 47.8 GB סך הכול. הקישורים מובילים ישירות ל־Hugging Face.

הרישיון

הרישיון המדווח הוא apache-2.0. זה רישיון קוד פתוח מתירני שמאפשר שימוש מסחרי, שינוי קוד והפצה חופשית, בתנאי ששומרים על הודעות זכויות היוצרים ומצרפים עותק של הרישיון.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗