GPT
G

gemma-4-26B-A4B-it-ultra-uncensored-heretic-GGUF

קוד פתוח

llmfan46apache-2.02026-04-07

  • transformers
  • gguf
  • heretic
  • uncensored
  • decensored

גרסה שעברה הסרת מגבלות למודל של גוגל, שנועדה לענות על בקשות בלי לסרב או להטיף. מורידים אותה כשצריך מודל חזק שלא נחסם על נושאים רגישים.

  • 184 GBמשקל הקבצים
  • 30,403הורדות בחודש
  • 159לייקים

מה זה

הבסיס כאן הוא Gemma 4 בתצורת תערובת מומחים עם 25.2 מיליארד פרמטרים בסך הכול, אבל רק 3.8 מיליארד מתוכם פעילים בכל רגע נתון. המפתח llmfan46 לקח את המקור והעביר אותו תהליך של הסרת הגנות באמצעות כלי שנקרא Heretic. המודל מבין טקסט ותמונות, תומך בחלון הקשר של עד 256K טוקנים ומגיע בפורמט GGUF להרצה עצמית.

בבדיקות הסירוב המקוריות, המודל של גוגל דחה 100 מתוך 100 פניות בבדיקה, בעוד הגרסה הזו רשמה 3 סירובים בלבד. המחיר על הניקוי הזה נמדד בפגיעה ביכולות: ציון MMLU ירד מ־82.48% ל־79.99%, והנפילה מורגשת בעיקר בנושאים שקשורים למשפטים ולמוסר, שם אחוזי ההצלחה צנחו בכעשרה אחוזים. בבחינת ההיגיון הפיזיקלי PIQA הירידה קטנה בהרבה, מ־92.06% ל־91.29%.

מתאים ל

  • כתיבה חופשית ללא צנזורה

    מתאים לטקסטים יצירתיים ועלילתיים שנתקלים לעיתים קרובות בחסימות במודלים מסחריים רגילים.

  • ניתוח תמונות רגישות

    משלב עיבוד ויזואלי עם קובץ המקרן יחד עם מוכנות לענות על תוכן שמודלים אחרים מסרבים לפענח.

  • מחקר אבטחה ובדיקות חדירות

    עונה על פניות טכניות מורכבות בלי להפעיל התראות בטיחות שמונעות בדיקת תרחישי תקיפה.

איפה זה נופל

ההתערבות בשכבות המודל פגעה בידע העיוני שלו, במיוחד בתחומים שבהם הסירובים היו נפוצים במקור. המודל איבד דיוק מורגש בניתוח סוגיות משפטיות ודילמות מוסריות, כך שלא כדאי להסתמך עליו בייעוץ מקצועי או בניתוח חוקי. בנוסף, אין לו מנגנוני בטיחות פנימיים, מה שאומר שאם מחברים אותו לשירות עם משתמשי קצה, צריך לבנות שכבת סינון נפרדת כדי למנוע פלט בעייתי.

אותה משפחה

gemma-4-26B-A4B-it-ultra-uncensored-heretic יצא ב־2 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם המודל תומך באודיו כמו דגמים אחרים במשפחה?

לא. בדגמי Gemma 4, היכולת לעבד אודיו קיימת רק בגרסאות הקטנות E2B ו־E4B. הדגם הזה תומך בטקסט ובתמונות בלבד.

למה התשובות כוללות לפעמים תגיות חשיבה ריקות?

הארכיטקטורה של המודל כוללת מנגנון חשיבה מובנה שנשלט על ידי טוקנים ייעודיים. כשמבטלים את החשיבה, הוא עדיין פולט את התגיות אך משאיר את הבלוק ריק וממשיך לתשובה.

כמה שונה הביצועים שלו מהמקור של גוגל?

מרחק ה־KL שנמדד עומד על 0.1237, מה שמראה על שמירה טובה של מבנה ההתפלגות המקורי. עם זאת, במבחני MMLU יש ירידה כללית של כ־2.5%, ובנושאים מסוימים הירידה מגיעה לכמעט 10%.

איך מריצים

מריצים את הקבצים בכל כלי שתומך ב־GGUF כמו llama.cpp, LM Studio או Ollama. אם אתם רוצים יכולות תמונה, חובה להוריד גם את קובץ המקרן הנפרד gemma-4-26B-A4B-it-mmproj-BF16.gguf ולהטעין אותו לצד המודל.

המשקל המלא של כלל הקבצים מגיע ל־184 GB על פני 12 קבצים, כאשר קיימות גרסאות קוונטיזציה מ־BF16 המלא ועד Q3_K_M. בזכות העובדה שרק כ־4 מיליארד פרמטרים רצים בכל טוקן, מהירות ההסקה גבוהה יחסית לגודל. עדיין, צריך להחזיק את כל המשקולות בזיכרון, ולכן כרטיסי מסך ביתיים פשוטים יתקשו להחזיק גרסאות כמו Q8_0 בלי לגלוש לזיכרון המערכת.

ollama run hf.co/llmfan46/gemma-4-26B-A4B-it-ultra-uncensored-heretic-GGUF:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הרישיון המדווח הוא Apache 2.0. הרישיון הזה מתיר שימוש מסחרי, שינוי קוד והפצה חופשית, כל עוד שומרים על הודעת זכויות היוצרים ומצרפים עותק של תנאי הרישיון המקורי.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗