GPT
G

gemma-4-31B-it-Mystery-Fine-Tune-HERETIC-UNCENSORED-Thinking-Instruct-GGUF

קוד פתוח

DavidAUapache-2.02026-04-04

  • gguf
  • heretic
  • uncensored
  • abliterated
  • unsloth

גרסה נטולת צנזורה של מודל 31B עם יכולות חשיבה, שפונה למי שרוצה חופש מוחלט בכתיבה או ניתוח. ההתאמה בוצעה כדי לעקוף חסימות ולהציג שיפור נקודתי בבנצ'מרקים.

  • 84.4 GBמשקל הקבצים
  • 4,965הורדות בחודש
  • 60לייקים

מה זה

המודל מבוסס על סדרת Gemma 4 בגודל 31 מיליארד פרמטרים, ועבר כוונון עדין באמצעות Unsloth על מאגרי נתונים פרטיים. המטרה המרכזית כאן היא הסרת מגבלות הסינון הקיימות במודל המקורי, לצד שילוב של מנגנון חשיבה מובנה שפועל לפני מתן המענה הסופי. החבילה כוללת קובצי mmproj שנועדו לשמר את היכולת לעבוד עם תמונות לצד טקסט.

בבדיקות פנימיות שפורסמו, הגרסה הזו עקפה את מודל הבסיס בשישה מתוך שבעה מבחנים, כולל arc-c שבו הגיעה לציון 0.583 לעומת 0.496 במקור, ו־piqa עם 0.787 לעומת 0.732. במבחן boolq נרשמה ירידה קלה ל־0.894 לעומת 0.901. מעבר לזה, המפתח מציין שמצב הוראות רגיל מציג לעיתים ציונים גבוהים יותר מאשר מצב החשיבה בחלק מהבדיקות.

מתאים ל

  • כתיבה יצירתית ללא סינון

    יצירת דיאלוגים וסצנות מחוספסות שכוללות קללות ואלימות, בלי שהמודל יסרב לייצר את הטקסט.

  • ניתוח מסמכים ותמונות

    שילוב של טקסט ותמונה באמצעות קובצי הראייה, לצורך חילוץ מידע והסבר מפורט במודל מקומי.

  • מחקר לוגי בשלבים

    הפעלת מצב החשיבה לפירוק בעיות מורכבות לצעדים מובנים לפני הצגת המסקנה.

איפה זה נופל

היוצר מודה במפורש בקיומן של בעיות בצינור העבודה שפוגעות בבקרת האיכות, וייתכן שיידרש אימון חוזר שיגרור הפצה מחודשת של הקבצים. היצע הכימותים הנוכחי מוגבל, ומבחני איכות נוספים עדיין נמצאים בעיצומם. מעבר לכך, מודל שעבר הסרת צנזורה עלול לפלוט תכנים פוגעניים או שגויים בלי שום מנגנון הגנה, כך שלא הייתי משלב אותו בשירות שחשוף למשתמשי קצה בלי בדיקה מקיפה.

אותה משפחה

gemma-4-31B-it-Mystery-Fine-Tune-HERETIC-UNCENSORED יצא ב־2 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

למה צריך גרסה חדשה כל כך של llama.cpp?

המודל נשען על שינויים וכימותים שנתמכים רק מגרסה b8641 ומעלה. שימוש בגרסה ישנה יותר יגרום לשגיאות טעינה ולא יאפשר להריץ את הקבצים.

האם המודל יתפקד טוב יותר במצב חשיבה או במצב הוראות?

לא תמיד מצב החשיבה עדיף. בבדיקות שנעשו נמצא שמצב הוראות רגיל הציג לעיתים ציונים גבוהים יותר בחלק מהמבחנים, ולכן כדאי לבדוק את שני המצבים עבור המשימה הספציפית שלכם.

איך מריצים

המשקל הכולל של הקבצים מגיע ל־84.4 גיגה בייט, והם מחולקים לגרסאות כימות שונות כמו Q4KS ו־Q6, הן במצב הוראות והן במצב חשיבה. כדי להריץ את קובצי ה־GGUF הללו, חובה להשתמש בגרסה b8641 ומעלה של llama.cpp. בלוק החשיבה מתוחם בין התגיות channel thought ו־channel, כך שצריך לוודא שממשק ההרצה שלכם יודע להפריד את המקטע הזה מהפלט הסופי.

ההגדרות המומלצות להרצה כוללות טמפרטורה של 1.0, ערך top_k של 64 ו־top_p של 0.95, עם תמיכה בחלון הקשר של עד 128k. אם אין לכם את זיכרון הווידאו הדרוש לטעינת מודל 31B בכימות סביר, או כשאין צורך בהסרת הצנזורה, עדיף לפנות ל־API שמריץ מודל מקורי ומספק יציבות גבוהה יותר.

ollama run hf.co/DavidAU/gemma-4-31B-it-Mystery-Fine-Tune-HERETIC-UNCENSORED-Thinking-Instruct-GGUF:Q4_K_S

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הרישיון המדווח הוא apache-2.0, רישיון קוד פתוח מתירני שמאפשר שימוש מסחרי, שינוי והפצה של הקבצים. אתם יכולים להטמיע אותו במוצר שלכם, בתנאי שתשמרו על הודעות זכויות היוצרים וכתב הוויתור על האחריות כפי שדורש הרישיון.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗