GPT
O

OpenAi-GPT-oss-20b-HERETIC-uncensored-NEO-Imatrix-gguf

קוד פתוח

DavidAUapache-2.02025-11-17

  • gguf
  • gpt_oss
  • gpt-oss
  • openai
  • mxfp4

גרסת קווינטוט חופשית מסירובים למודל 20B של OpenAI, שמיועדת להרצה מקומית. היא מתאימה למי שצריך מודל שלא יחסום בקשות תוכן חריגות או כתיבה יצירתית קיצונית.

  • 259 GBמשקל הקבצים
  • 23,060הורדות בחודש
  • 182לייקים

מה זה

מדובר בעיבוד של DavidAU למודל בסיס שעבר הסרת סירובים באמצעות שיטת HERETIC של המפתח P-E-W. המודל בנוי בארכיטקטורת Mixture of Experts עם עד 24 מומחים ותומך בחלון הקשר של 128k, שימוש בכלים וגלישה. המטרה כאן היא ביטול מנגנוני הסירוב המובנים בלי לפגוע ביכולות החשיבה הכלליות של הרשת.

הייחוד בגרסה הזו מגיע מכיול הקווינטוטים בעזרת מערכי נתונים ייעודיים של היוצר, שמכונים NEO, Horror ו־NEOCode. חלק מהקבצים עברו שקלול כפול או משולש של הנתונים האלה כדי לייצב את הפלטים בתחומים מוגדרים. הנתונים בכרטיס מצביעים על קצב עבודה של מעל 80 טוקנים לשנייה, תוך שמירה על שכבת הפלט ברמת דיוק גבוהה יותר בחלק מהגרסאות כדי להגן על איכות התשובות.

מתאים ל

  • כתיבת סיפורי אימה ומתח

    גרסאות ה־HRR המכוילות מתמודדות היטב עם תיאורים קודרים בלי להיתקע במסכי סירוב שגרתיים.

  • בדיקות חדירה וסימולציות

    הסרת הסירובים מאפשרת לבחון תרחישי אבטחה ושאילתות טכניות שמודלים רגילים עוצרים מיידית.

  • משחקי תפקידים מקומיים

    עבודה חופשית עם פרומפטים ארוכים ב־KoboldCpp או SillyTavern ללא תלות ברשת חיצונית.

איפה זה נופל

המודל אמנם לא מסרב, אבל הוא לא מייצר תוכן גרפי או בוטה מעצמו. ברירת המחדל שלו יבשה ואנמית, וכדי להוציא ממנו שפה חריגה צריך לדחוף אותו עם הנחיות מפורטות ומילים ספציפיות בפרומפט. חובה להגדיר ענישה על חזרתיות אחרת מקבלים לולאות, ובחירה ביותר מ־8 מומחים פעילים פוגעת באיכות התוצאות ומייצרת פלטים משובשים.

שאלות
נפוצות

למה התשובות יוצאות יבשות למרות שהמודל מוגדר כלא מצונזר?

הבסיס עבר הסרת סירובים ולא אימון מחדש על תוכן קיצוני. כדי לקבל שפה בוטה, ניב מסוים או סגנון מוקצן, חייבים לספק לו הוראות מפורשות ודוגמאות מילים בתוך הפרומפט.

באיזה קוונט כדאי לבחור מתוך כל הרשימה?

לשימוש כללי ויציב עדיף לקחת את Q5_1 בגרסת NEO-CODE. אם הזיכרון בכרטיס המסך מוגבל, IQ4_NL ייתן תוצאות מהירות יותר אך דורש כוונון עדין של מדדי הדגימה.

איך מריצים

מורידים קובץ GGUF בודד מתוך עשרים האפשרויות, בהתאם לזיכרון הפנוי. הגרסאות נעות בין IQ4_NL הפרועה יותר לבין Q5_1 היציבה ו־Q8_0 הכבדה, כאשר שמות הקבצים מסמנים איזה שילוב נתונים הוטמע בכיול. מומלץ להגדיר בין 4 ל־8 מומחים פעילים, עם חלון הקשר התחלתי של 8k לפחות, ולהשתמש בתוכנות כמו LM Studio, KoboldCpp או Text-Generation-Webui.

אם אתם מחפשים קריאה יציבה ושקטה לפרודקשן סטנדרטי, עדיף להשתמש ב־API מנוהל של מודל מסחרי. ההתעסקות במודל הזה מתאימה בעיקר למי שחייב עבודה מקומית ללא צנזורה ומוכן לשחק עם הגדרות הדגימה.

ollama run hf.co/DavidAU/OpenAi-GPT-oss-20b-HERETIC-uncensored-NEO-Imatrix-gguf:Q8_0

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הרישיון הוא Apache 2.0. מותר להשתמש בו לצרכים מסחריים, לשנות את המשקלים ולהפיץ מוצרים שמבוססים עליו, בתנאי ששומרים על הודעת זכויות היוצרים והרישיון המקורי. אין כאן הגבלות שימוש סגורות של ספקי ענן.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗