GPT
G

gemma-4-26B-A4B-it-uncensored

קוד פתוח

TrevorJSapache-2.02026-04-03

  • transformers
  • safetensors
  • gemma4
  • image-text-to-text
  • abliteration

גרסה נטולת סינונים למודל של גוגל שמסירה את מנגנוני הסירוב הכפויים. מתאים למי שרוצה תשובה ישירה בלי הרצאות מוסר או חסימות מיותרות.

  • 26Bפרמטרים
  • 262,144טוקנים בהקשר
  • 48.1 GBמשקל הקבצים
  • 2,309הורדות בחודש

מה זה

הבסיס כאן הוא המודל של גוגל שעבר תהליך הסרת סירובים מקיף. במקום אימון מחדש, היוצר ביצע שינוי ישיר במשקולות הרשת ובכל 128 המומחים של שכבות הניתוב כדי למחוק את הכיוון שגורם למודל לסרב לבקשות. הבדיקות שפורסמו מראות שהסירובים צנחו מ־98 מתוך 100 פרומפטים לבודדים בלבד, עם פחות מאחוז סירוב בבדיקה רחבה יותר על פני 686 מקרים.

בפועל, השינוי נעשה בלי לפרק את היכולות הרגילות. מדד ההתרחקות מהמודל המקורי נמוך מאוד, ואורך התשובות לשאלות תמימות נשאר כמעט זהה. זה אומר שמקבלים את אותה רמת חשיבה, כתיבה וידע של מודל 26 מיליארד פרמטרים, אבל בלי החשש שפרומפט מורכב או גבולי ייעצר באמצע בגלל מילות מפתח רגישות.

מתאים ל

  • מחקר אבטחת מידע

    מייצר דוגמאות ובודק חולשות בלי להיתקל בחסימות סירוב גורפות של מודלים סגורים.

  • כתיבה יצירתית חופשית

    מאפשר לכתוב תסריטים ועלילות מתח בלי לקבל הודעות הטפת מוסר על תכנים קשים.

  • ניתוח טקסטים רגישים

    מעבד ומסכם מסמכים משפטיים או דוחות אירוע שכוללים תוכן שהיה מקפיץ מערכות סינון.

איפה זה נופל

למרות ההסרה המוצלחת, הכרטיס מודה שחלק קטן מהסירובים עדיין קיים, בעיקר בצורה של פליטת דיסקליימר על היותו מודל בינה מלאכותית לפני שהוא עונה. בנוסף, המודל מוגדר ומאומן באנגלית בלבד, כך שלא הייתי בונה עליו לפרויקטים שדורשים עברית שוטפת. מעבר לזה, כשמסירים הגנות לחלוטין מאבדים את רשת הביטחון, ואי אפשר לשלב אותו במוצר מול משתמשי קצה בלי לבנות שכבת בדיקות משלכם.

אותה משפחה

gemma-4-26B-A4B-it-uncensored יצא ב־2 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם המודל יסרב לפעמים לשאלות?

הבדיקות הראו שכחצי אחוז מהפרומפטים עדיין מעוררים התנגדות קלה. ברוב המקרים האלה המודל רק יוסיף הצהרה קצרה על כך שהוא בינה מלאכותית, ואז יענה על השאלה במלואה.

האם איכות התשובות נפגעה בעקבות הסרת המחסומים?

היוצר מדד שמירה על אורך התשובות והיצמדות למשקולות המקוריות כדי לוודא שאין פגיעה ביכולת הכללית. התוצאות מראות שהאינטליגנציה נשמרה והתשובות לשאלות רגילות זהות למקור.

האם אפשר להריץ אותו על מחשב נייד חזק?

לא בקבצים הנוכחיים. המשקל מגיע ל־48.1 ג'יגה בייט ודורש זיכרון גרפי ייעודי של לפחות 64 ג'יגה כדי לעבוד, כך שחובה להשתמש בשרת או תחנת עבודה מתאימה.

איך מריצים

המשקל הכולל מגיע ל־48.1 ג'יגה בייט בפורמט המקורי, מה שמחייב חומרה עם לפחות 64 ג'יגה בייט זיכרון גרפי כדי להריץ אותו בלי לחנוק את המערכת. אפשר להעלות אותו ישירות דרך ספריית הטרנספורמרס בקוד פייתון פשוט, אבל כרטיס בודד של מחשב ביתי ממוצע לא יספיק פה.

אם אין לכם שרת ייעודי או זוג כרטיסים גרפיים חזקים, הרצה עצמאית תהיה יקרה וכבדה מדי. במקרה כזה, עדיף להמתין להמרות מכווצות יותר או לפנות לספקי תשתיות ענן שמאפשרים לשכור מכונה לפי שעה ולהרים את הקבצים ישירות מהמאגר.

from transformers import pipeline

pipe = pipeline("text-generation", model="TrevorJS/gemma-4-26B-A4B-it-uncensored")
print(pipe("שלום"))

הרישיון

הרישיון הוא אפאצ'י 2.0, שזה רישיון קוד פתוח מתירני מאוד. אתם רשאים להשתמש בו לצרכים מסחריים, לשנות את המשקולות, להפיץ אותן הלאה ולשלב אותן במוצרים שלכם. התנאי היחיד הוא שמירת הודעת זכויות היוצרים והרישיון המקורי, בלי אחריות מצד היוצר.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗