GPT
G

Gemma-3-it-4B-Uncensored-DBL-X-GGUF

קוד פתוח

DavidAUapache-2.02025-03-17

  • gguf
  • Gemma 3
  • instruct
  • 128k context
  • not-for-all-audiences

גרסה פתוחה לחלוטין של מודל קומפקטי שנבנתה כדי לעקוף את מנגנוני הבטיחות של גוגל. מתאימה למי שחייב יצירת טקסט גרפי או בוטה בלי סירובים.

  • 44.1 GBמשקל הקבצים
  • 3,608הורדות בחודש
  • 68לייקים

מה זה

מדובר בהתאמה של מודל גמא 3 בגודל 4 מיליארד פרמטרים, שבה המפתח הסיר את מגבלות התוכן בשכבות האחרונות של הרשת והוסיף ארבע שכבות נוספות. המטרה כאן היא לאפשר כתיבה של אימה גרפית, תכנים למבוגרים וטקסטים אלימים בלי להיתקל בסירובים הרגילים של מודלים תאגידיים. המודל תומך בחלון הקשר של 128 אלף טוקנים ומיועד ליצירת טקסט באנגלית בלבד.

בבדיקה שערך המפתח בקוונט מסוג IQ4XS על כרטיס גרפי ברמת ביניים, הוא השיג קצב של 56 טוקנים לשנייה. המודל שומר על היכולת לעקוב אחרי הוראות, אבל כדי לקבל ביטול מלא של הסירובים צריך להצמיד לו פרומפט מערכת ייעודי שמורה לו במפורש להתעלם מכללי אתיקה ובטיחות.

מתאים ל

  • כתיבת סיפורי אימה גרפיים

    הוא לא עוצר תיאורים עקובים מדם וסצנות פירוק איברים שהיו מפעילות חסימה בכל מודל מסחרי סטנדרטי.

  • משחקי תפקידים ללא צנזורה

    מאפשר דיאלוגים בוטים ותכנים למבוגרים בטמפרטורות משתנות ובלי התחסדות של המערכת.

  • בדיקות חוסן על חומרה מקומית

    רץ ביעילות על כרטיסי מסך ביתיים ומאפשר לבחון התנהגות של פרומפטים מול מודל נטול מסננים.

איפה זה נופל

המודל אינו נקי מתקלות. בטמפרטורות גבוהות או בתוכן מוגבל במיוחד הוא נוטה לפלוט אותיות בגדלים משובשים ותווים מוזרים, והפתרון של המפתח לזה הוא פשוט לייצר את התשובה מחדש. בנוסף, אם לא משתמשים בפרומפט המערכת הייעודי שמבטל את הבטיחות, המודל עדיין עלול לסרב לפקודות מדי פעם.

הוא מוגדר לשפה האנגלית בלבד, כך שאין לצפות לביצועים סבירים בעברית. לפני שמשלבים אותו במערכת כלשהי, חובה לקחת בחשבון שאין עליו שום רשת ביטחון, והוא עלול לייצר תכנים פוגעניים מאוד באופן חופשי לחלוטין.

שאלות
נפוצות

האם המודל באמת חופשי לחלוטין מסירובים?

לא באופן אוטומטי. בלי פרומפט המערכת הייעודי שפרסם המפתח המודל עדיין עשוי לסרב, ובמקרים כאלה יש לייצר את הפלט מחדש או להגדיר את הפרומפט המבטל.

איזה קוונט מומלץ להוריד מתוך כל הקבצים?

היוצר ממליץ על IQ4XS או IQ4NL לכתיבה יצירתית בזכות קצב טוב של כ־56 טוקנים לשנייה, ועל Q5 או Q6 לשימוש כללי ויציב יותר.

איך מריצים

המשקל הכולל של הקבצים בתיקייה הוא 44.1 גיגה בייט המחולקים ל־18 קבצי GGUF שונים, כך שאתם מורידים רק את הקוונט הספציפי שמתאים לכם ולא את כל הנפח. לשימוש כללי מומלצות גרסאות כמו Q5 או Q6 שדורשות זיכרון וידאו צנוע של כמה גיגה בייטים בודדים, בעוד שקוונטים מסוג Q4_0 או Q5_0 ירוצו היטב גם על טלפונים ניידים ומחשבים ניידים פשוטים.

גרסאות קלות כמו IQ4XS מספקות תוצאות יצירתיות שונות מגרסאות ה־Q הרגילות, ולמי שמחפש דיוק מרבי ישנה גרסת Q8 או F16 מלאה. להריץ מודל של 4 מיליארד פרמטרים מקומית זו משימה קלה מאוד לחומרה מודרנית, ולכן אין סיבה לפנות ל־API חיצוני, במיוחד כשהתוכן שנוצר כאן לא יעבור את מסנני הבטיחות של שירותי ענן מסחריים.

ollama run hf.co/DavidAU/Gemma-3-it-4B-Uncensored-DBL-X-GGUF:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הפרויקט מדווח תחת רישיון אפאצ'י 2.0, שמתיר שימוש מסחרי, שינוי קוד והפצה חופשית ללא תשלום תמלוגים. התנאי העיקרי הוא שמירה על הודעת זכויות היוצרים וציון הרישיון המקורי בכל הפצה של התוכנה.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗