GPT
G

gemma-4-Ortenzya-The-Creative-Wordsmith-31B-it-uncensored-heretic-GGUF

קוד פתוח

llmfan46apache-2.02026-05-13

  • transformers
  • gguf
  • text-generation-inference
  • unsloth
  • gemma4

גרסה נטולת סינון לכתיבה יוצרת ותרגום המבוססת על Gemma 4 31B. המודל מתאים למי שמחפש סגנון אנושי וזורם בלי סירובים והטפות מוסר קבועות.

  • 216 GBמשקל הקבצים
  • 9,764הורדות בחודש
  • 52לייקים

מה זה

הבסיס כאן הוא מודל Gemma 4 31B של גוגל שעבר הסרת סירובים באמצעות שיטת Heretic ולאחר מכן אימון כוונון עדין דרך Unsloth. המטרה של היוצר הייתה לנקות את הניסוח הרובוטי והנוקשה של המקור, ולפתוח אותו למשימות יצירתיות, משחקי תפקידים ותרגומים באנגלית וביפנית.

במבחן הסירובים שהמפתח ערך, המודל המקורי סירב ל־99 מתוך 100 פניות, בעוד הגרסה הזו ירדה ל־9 סירובים בלבד. בפועל זה אומר שהפלט לא יתחמק מנושאים רגישים או יטיף לכם, אלא פשוט ימשיך את הטקסט שביקשתם לכתוב. המודל כולל תמיכה במולטימודליות לתמונות, אך דורש קובץ מקרן ייעודי כדי לעבד אותן.

מתאים ל

  • כתיבת סיפורת ומשחקי תפקידים

    הסגנון כוונן להיות פחות תאגידי ויותר זורם, עם שיעור סירובים נמוך מאוד.

  • עיבוד תמונות ללא צנזורה

    שילוב קובץ ה־mmproj מאפשר ניתוח תמונות והפקת תיאורים חופשיים ממגבלות.

  • תרגום טקסטים חופשי

    המודל אומן לשמור על טבעיות בתרגום ולא לעצור על ביטויים טעונים באנגלית.

איפה זה נופל

ההסרה האגרסיבית של המגבלות פוגעת באמינות. שכבות 30 עד 48 שונו ישירות, מה שאומר שהבקרות המקוריות נמחקו כמעט לגמרי, והמודל עשוי לייצר תוכן בוטה, שגוי או לא יציב בלי שום מנגנון ריסון מובנה. בנוסף, האימון התמקד באנגלית ויפנית, כך שביצועים בעברית אינם מובטחים ולא נבדקו בכרטיס. אם אתם בונים מוצר שפונה לקהל רחב, תיאלצו לבנות שכבת סינון משלכם כדי למנוע פלטים בעייתיים.

שאלות
נפוצות

האם המודל יפעל ישירות עם תמונות בלי קבצים נוספים?

לא. כדי לעבד תמונות בפורמט GGUF חייבים להוריד גם את קובץ ה־mmproj הייעודי ולהגדיר אותו בתוכנת ההרצה לצד קובץ המודל הרגיל.

האם המודל שומר על יכולות הניתוח והתכנות של Gemma 4 המקורי?

האימון הנוסף התמקד בסגנון כתיבה ובהסרת סירובים, לכן ייתכן שחלק מיכולות ההיגיון והקוד המקוריות נפגעו בתהליך.

איך מריצים

הקבצים מוגשים בפורמט GGUF ומיועדים לכלים כמו llama.cpp, Ollama או LM Studio. רמת הדיוק המומלצת בכרטיס היא Q8_0, אבל למודל צפוף של 31 מיליארד פרמטרים תצטרכו כרטיס עם זיכרון וידאו רציני או הרצה משולבת מעבד וזיכרון מערכת. לכרטיסי מסך צרכניים מוגבלים קיימות חלופות קלות כמו Q4_K_M או Q3_K_M.

אם אתם צריכים רק יכולות ראייה, חובה להוריד ולהטעין במקביל את קובץ ה־mmproj בנפרד. במקרים שבהם אין לכם לפחות 24GB של זיכרון ייעודי, עדיף להריץ את המקור בענן או להשתמש ב־API מוכן במקום לסבול מקצבי יצירה אטיים מדי.

ollama run hf.co/llmfan46/gemma-4-Ortenzya-The-Creative-Wordsmith-31B-it-uncensored-heretic-GGUF:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

המודל מופץ ברישיון Apache 2.0. הרישיון מתיר שימוש מסחרי, שינוי קוד והפצה מחדש, בתנאי ששומרים על הודעות זכויות היוצרים והרישיון המקורי. אפשר להטמיע אותו במוצר מסחרי בלי לשלם תמלוגים למפתח.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗