GPT
U

UNSEEN_Gemma_4_26B_NSFW-GGUF

קוד פתוח

Jommarnרישיון לא דווח2026-08-28

  • transformers
  • gguf
  • uncensored
  • nsfw
  • abliteration

גרסה שעברה הסרת מגבלות של מודל התמונה-טקסט Gemma בגודל 26B, בקובצי GGUF מוכנים לריצה. היא פונה למי שצריך ניתוח תמונות וכתיבה ללא חסימות בטיחות בכלל.

  • 150 GBמשקל הקבצים
  • 21,603הורדות בחודש
  • 73לייקים

מה זה

הבסיס כאן הוא מודל רב מודלי של 26 מיליארד פרמטרים, שעבר תהליך של הסרת מגבלות בטיחות ישירות ממשקולות הרשת. המשמעות היא שהוא לא יסרב לייצר טקסט בוטה, תיאורים מפורשים של תמונות או תוכן למבוגרים, תחום שבו רוב המודלים המסחריים ננעלים ומחזירים שגיאה. ההתמקדות המוצהרת של היוצר היא בשפות אנגלית ותאילנדית.

בגרסת שתי ביט על גבי כרטיס T4 פשוט עם 16 גיגה זיכרון, המודל הציג קצב של 54.4 טוקנים לשנייה במבחן אפס דוגמאות. המספר הזה מראה שאפשר להריץ מודל בגודל כזה על חומרה זולה יחסית, אבל דחיסה של שתי ביט גובה לרוב מחיר כבד באיכות הפלט ובהבנת פרטים מורכבים.

מתאים ל

  • ניתוח תמונות למבוגרים

    תיאור ויזואלי של פרטים אנטומיים וסצנות מפורשות ללא חסימות מערכת.

  • כתיבה יצירתית ללא צנזורה

    יצירת סיפורים וטקסטים בנושאים רגישים שלא עוברים במודלים מסחריים.

  • ריצה מקומית על חומרה צנועה

    גרסאות שתי ביט מאפשרות להריץ מודל 26B על כרטיסי מסך בעלי 12GB זיכרון.

איפה זה נופל

אין כאן שום מנגנון סינון, מה שהופך אותו לבלתי שמיש לחלוטין בכל יישום שפונה לקהל רחב או דורש עמידה בתקני בטיחות. מבחינת שפות, הכרטיס מדגיש תמיכה רק באנגלית ובתאילנדית, כך שאין שום הבטחה לעבודה תקינה או ליציבות בעברית. בנוסף, מי שבוחר בגרסאות המכווצות במיוחד כמו שתי ביט כדי לחסוך זיכרון, יסבול מפגיעה מהותית ביכולת המודל לתאר תמונות בדיוק גבוה.

שאלות
נפוצות

למה המודל לא מנתח לי תמונות בשרת llama.cpp?

המודל מחולק לשני קבצים נפרדים, המשקולות עצמן וקובץ הפרויקטור הוויזואלי mmproj. חובה להוריד את קובץ ה־mmproj ולהעביר אותו בפקודת ההפעלה באמצעות הדגל הייעודי, אחרת המערכת תתעלם מכל קלט שאינו טקסט.

האם כדאי להשתמש בגרסת שתי ביט (IQ2_M)?

היא אמנם מאפשרת ריצה מהירה של 54.4 טוקנים לשנייה על כרטיס T4 פשוט, אך דחיסה לרמה כזו פוגעת קשות בכושר ההבנה של המודל. מומלץ להישאר לפחות על גרסת ארבע ביט (Q4_K_M) אם הזיכרון בכרטיס שלכם מאפשר זאת.

האם המודל יתאים למוצר מסחרי?

לא מומלץ כלל. מעבר לעובדה שלא דווח רישיון שימוש, המודל תוכנן לעקוף כל מנגנון בטיחות, מה שמייצר סיכון גבוה לפלטים בלתי הולמים שאינם מתאימים למשתמשי קצה.

איך מריצים

ההרצה נעשית מקומית דרך llama.cpp או ספריות דומות, כשהקבצים מחולקים למגוון רחב של דיוקים. לגרסת ארבע ביט המומלצת דרושים בין 16 ל־18 גיגה זיכרון וידאו, מה שמתאים לכרטיסי RTX 3090 או 4090. אם תרצו לרדת לשתי ביט אפשר להסתפק ב־8 עד 10 גיגה זיכרון, בעוד גרסת המקור המלאה דורשת מעל 50 גיגה ומחייבת ציוד שרתים.

נקודה קריטית בריצה היא התמיכה בתמונות. בריצת GGUF חייבים להוריד ולהגדיר בנפרד את קובץ ה־mmproj ששוקל כ־1.11 גיגה. אם תשכחו לטעון אותו עם הדגל המתאים בפקודת ההרצה, המודל יעבוד אך ורק כמודל טקסט רגיל ויתעלם לחלוטין מכל קלט ויזואלי שתשלחו אליו.

ollama run hf.co/Jommarn/UNSEEN_Gemma_4_26B_NSFW-GGUF:Q4_0

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

היוצר לא ציין שום רישיון בעמוד המודל. מבחינה משפטית, היעדר רישיון אומר שאין לכם שום הרשאה מפורשת להשתמש במשקולות האלו, בוודאי שלא בסביבה מסחרית או במוצר שמופץ לאחרים. מי שבוחר להריץ אותו עושה זאת על אחריותו הבלעדית.

הרישיון המלא בעמוד המודל ↗