GPT
G

GPTOSS-120B-Uncensored-HauhauCS-Aggressive

קוד פתוח

HauhauCSapache-2.02026-02-13

  • gguf
  • uncensored
  • abliterated
  • mxfp4
  • moe

גרסה ללא מעצורים למודל מבוסס תערובת מומחים, שמכוונת לאפס סירובים. היא מתאימה למי שצריך תפוקה ישירה בלי צנזורה ובלי פילטרים מובנים.

  • 60.9 GBמשקל הקבצים
  • 14,833הורדות בחודש
  • 91לייקים

מה זה

הבסיס כאן הוא מודל של 117 מיליארד פרמטרים שרץ במבנה של תערובת מומחים. בפועל מופעלים רק כ־5.1 מיליארד פרמטרים בכל מעבר, מתוך 128 מומחים שמהם נבחרים ארבעה בכל פעם. הגרסה הזו כוונה בצורה אגרסיבית במטרה מוצהרת להעלים סירובים, בלי לגעת ביכולות המקוריות של המודל או בערכות הנתונים שלו.

הקובץ מגיע בפורמט MXFP4, שזה הדיוק הטבעי שבו המודל אומן במקור, ולכן אין צורך או היגיון לכווץ אותו שוב ולאבד איכות. הוא כולל חלון הקשר של 128K טוקנים, תומך בכלים סטנדרטיים שמריצים קובצי GGUF, ומתאים למי שרוצה לשלוט לגמרי בהתנהגות הטקסט בלי לחטוף הודעות שגיאה על תוכן לא מורשה.

מתאים ל

  • מחקר אבטחה ובדיקות חדירה

    היעדר הסירובים מאפשר לבדוק תרחישי תקיפה וניסוחי פקודות בלי להיתקל בחסימות של מודלים מסחריים.

  • יצירת תוכן ללא הגבלות

    מתאים לטקסטים יצירתיים או שיחות שלא צריכים לעבור דרך פילטרים של תקינות פוליטית או צנזורה.

  • הרצה מקומית יעילה בחומרה חזקה

    בזכות ארכיטקטורת MoE ודיוק MXFP4 מקבלים מודל ענק שדורש משאבי חישוב של מודל קטן בהרבה בכל טוקן.

איפה זה נופל

ההתמקדות בהסרת סירובים אומרת שאין שום רשת ביטחון, וכל הנחיה תבוצע כפי שהיא בלי סינון של תוכן בעייתי או שגוי. הכרטיס מציין תמיכה באנגלית בלבד, כך שעברית לא נבדקה ולא מובטחת כאן. בנוסף, חובה להקפיד על הגדרות דגימה מדויקות ודגל ייעודי, אחרת הפלט פשוט ישתבש.

שאלות
נפוצות

האם אפשר להריץ אותו על מחשב ביתי בלי כרטיס תעשייתי?

אפשר לפרוק שכבות למעבד עם llama.cpp, אבל תצטרכו שפע של זיכרון RAM רגיל והביצועים יהיו אטיים משמעותית. להרצה מהירה ומלאה ב־VRAM נדרש כרטיס ברמה של H100 עם כ־61 גיגה-בייט פנויים.

למה התשובות יוצאות מקולקלות בהרצה הראשונה?

המודל תלוי לחלוטין בדגל jinja עבור פורמט Harmony. בנוסף, יש לכבות הגדרות כמו top_p ו־repeat penalty, ולהשאיר רק טמפרטורה 1.0 ו־top_k 40 כפי שהוגדר במפורש.

איך מריצים

כדי להריץ אותו בשלמותו בזיכרון תצוגה תצטרכו כרטיס עם כ־61 גיגה-בייט VRAM, כמו כרטיס H100 בודד או שווה ערך. אם אין לכם כרטיס ברמה הזו, אפשר להשתמש ב־llama.cpp עם הדגל n-cpu-moe כדי להעביר שכבות של המומחים למעבד ולזיכרון הרגיל, מה שיוריד את דרישות הכרטיס אבל יפגע בקצב הייצור.

המודל עובד עם Ollama, LM Studio ו־llama-server. חובה להפעיל את הדגל jinja כדי לקבל את פורמט התשובות Harmony, ולהגדיר טמפרטורה על 1.0 ו־top k על 40. כל שאר מנגנוני הדגימה כמו top p או עונשי חזרתיות חייבים להיות כבויים כדי לא לשבור את התוצאות.

ollama run hf.co/HauhauCS/GPTOSS-120B-Uncensored-HauhauCS-Aggressive:GPTOSS-120B-Uncensored-HauhauCS-Aggressive-MXFP4

הקבצים

3 קבצים במאגר, 60.9 GB סך הכול. הקישורים מובילים ישירות ל־Hugging Face.

הרישיון

הפרויקט מופץ תחת רישיון apache-2.0. מותר להשתמש בו לצרכים מסחריים, לשנות אותו, להפיץ אותו מחדש או לשלב אותו במוצר פנימי, כל עוד שומרים על הודעות זכויות היוצרים והרישיון המקורי.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗