GPT
G

gemma-4-26B-A4B-it-ultra-uncensored-heretic

קוד פתוח

llmfan46apache-2.02026-04-07

  • transformers
  • safetensors
  • gemma4
  • image-text-to-text
  • heretic

גרסה נטולת סינון של גוגל ג'מה 4 בארכיטקטורת מומחים. תבחרו בו אם נמאס לכם מסירובים ומהרצאות מוסר ואתם צריכים שילוב של טקסט ותמונה בלי מעצורים.

  • 26Bפרמטרים
  • 262,144טוקנים בהקשר
  • 48.1 GBמשקל הקבצים
  • 1,393הורדות בחודש

מה זה

מדובר בעיבוד של llmfan46 למודל ההוראות של גוגל, שעבר הסרת סירובים באמצעות כלי שנקרא Heretic. השיטה הזו מתערבת ישירות בשכבות הקשב כדי לנטרל את מנגנוני הסירוב בלי לאפס את הידע של המודל. לפי המבחנים בכרטיס, שיעור הסירובים צנח מ־100 מתוך 100 במקור ל־3 בלבד בגרסה הזו, בזמן שמרחק ההתפלגות מהמקור נשאר נמוך יחסית.

המבנה כאן הוא Mixture of Experts עם סך כולל של כ־25.8 מיליארד פרמטרים, אבל רק כ־3.8 מיליארד מהם מופעלים בכל טוקן. זה נותן לו מהירות תגובה של מודל קטן עם מאגר הידע והיכולות של מודל בינוני. הוא מבין תמונות, תומך בחלון הקשר עצום של 262,144 טוקנים, ויודע לחשוב צעד אחר צעד בעזרת מצב חשיבה מובנה.

ההבדל מול המקור מורגש ביכולת הכללית. במבחן MMLU הציון הכולל ירד מ־82.48% ל־79.99%, כאשר בתחום המשפטים הפגיעה חדה במיוחד עם צניחה מ־70% לכ־60%. במילים פשוטות, קיבלתם מודל שמסכים לענות כמעט על הכל, אבל הוא מעט פחות מדויק מהמקור של גוגל.

מתאים ל

  • ניתוח תמונות רגישות

    מודלים רגילים מסרבים לנתח תמונות שנויות במחלוקת, והגרסה הזו תעבד אותן בלי לחסום את הבקשה.

  • בדיקות חדירות וחקר אבטחה

    יצירת תרחישי תקיפה ובדיקת עמידות של מערכות, בלי להיתקל בחסימות מובנות של סירוב לעסוק בנושאי אבטחה.

  • כתיבה יצירתית קיצונית

    סיפורים, תסריטים או משחקי תפקידים שדורשים תוכן אפל, בוטה או קונפליקטים מורכבים שמודלים מסחריים מסרבים לייצר.

איפה זה נופל

ההתערבות בשכבות המודל שברה חלק מהיכולות שלו. מעבר לירידה הכללית במבחני ידע, בכרטיס המודל רואים בבירור צניחה חדה בשאלות שנוגעות לחוק ומשפט, וגם היגיון מוסרי נפגע משמעותית. הוא גם לא כולל תמיכה באודיו בניגוד לגרסאות הקטנות של ג'מה 4, והיוצר שלו מתריע שהוא מוגבל במשאבים ולא יכול לאחסן עדכונים נוספים ללא תמיכה כספית.

אותה משפחה

gemma-4-26B-A4B-it-ultra-uncensored-heretic יצא ב־2 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם אפשר לשלוח למודל הזה קבצי אודיו?

לא. התמיכה באודיו בסדרת ג'מה 4 קיימת רק בדגמים הקטנים יותר, E2B ו־E4B. הדגם הזה תומך רק בקלט של טקסט ותמונות ומחזיר טקסט בלבד.

כמה המודל הזה איבד מהאינטליגנציה שלו בגלל ביטול הסינון?

הפגיעה קיימת אך מתונה ברוב התחומים, עם ירידה מ־82.5% ל־80% במבחן MMLU הכללי. עם זאת, בתחומים ספציפיים כמו משפטים נרשמה נפילה של כמעט עשרה אחוזים, כך שלא מומלץ להסתמך עליו כמקור ידע מוסמך.

איך מריצים

המשקל הכולל של הקבצים עומד על 48.1 גיגה בייט, מה שאומר שאתם חייבים לפחות 48 גיגה בייט זיכרון גרפי פנוי רק כדי לטעון אותו במשקלים מלאים, עוד לפני שמחשבים את זיכרון ההקשר. בפועל תצטרכו שרת עם שני כרטיסי A100 או כרטיסי תחנת עבודה חזקים, אלא אם תשתמשו בכימות שיכווץ אותו לכרטיס בודד.

מריצים אותו דרך ספריית transformers הרגילה בעזרת המחלקה AutoModelForMultimodalLM אם אתם משלבים תמונות, או AutoModelForCausalLM לטקסט בלבד. אם אין לכם חומרה כבדה וייעודית שרצה מקומית, עדיף להשתמש במודל המקורי דרך ספקי ענן, כי להחזיק שרת כזה פעיל רק בשביל הניסוי הזה יעלה לא מעט כסף.

from transformers import pipeline

pipe = pipeline("image-text-to-text", model="llmfan46/gemma-4-26B-A4B-it-ultra-uncensored-heretic")
print(pipe("שלום"))

הרישיון

המודל משוחרר תחת רישיון apache-2.0. הרישיון הזה מתיר שימוש מסחרי, שינוי והפצה של הקוד והמשקלים בלי תשלום תמלוגים, כל עוד אתם שומרים על הודעת הרישיון המקורית ומציינים את השינויים שביצעתם.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗