GPT
Q

Qwen3-8B-Hivemind-Instruct-Heretic-Abliterated-Uncensored-NEO-Imatrix-GGUF

קוד פתוח

DavidAUapache-2.02025-12-05

  • gguf
  • 256k context
  • Qwen3
  • All use cases
  • creative

גרסת 8B לא מצונזרת שנועדה לעקוף סירובים של מודלים סגורים. הפתרון למי שמחפש יצירת תוכן גרפי, קללות או אימה בלי שהמודל יחסום את הבקשה.

  • 37.7 GBמשקל הקבצים
  • 10,947הורדות בחודש
  • 71לייקים

מה זה

הפרויקט הזה לוקח מודל בסיס בגודל שמונה מיליארד פרמטרים ומעביר אותו תהליך של הסרת סירובים. המטרה כאן היא חופש פעולה מוחלט בכתיבה. שיעור הסירובים ירד מבדיקה ראשונית של תשעים ותשע מתוך מאה בקשות לשמונה בלבד, תוך שמירה על יציבות עם מדד התבדרות של 0.02, מה שאומר שהיכולות הלשוניות כמעט לא נפגעו מהתהליך.

במבחני ביצועים הוא מציג תוצאות טובות, כמו 0.861 בבדיקת הבנת שפה מסוג boolq ו־0.757 ב־arc_easy. המספרים האלה מראים שהוא מחזיק רמת ידע והגיון טובה למרות הסרת החסימות, ואפילו עוקף בחלק מהמדדים מודלים גדולים יותר שבדקו מולו. יחד עם חלון הקשר מדווח של מאתיים חמישים ושבעה אלף טוקנים, מדובר בכלי ממוקד לכתיבה ארוכה וחופשית באנגלית.

מתאים ל

  • משחקי תפקידים וצ'אט

    מאפשר שיחות חופשיות מסירובים בעזרת הגדרת סמפלרים מתאימה בתוכנות ייעודיות.

  • כתיבת סיפורי אימה למבוגרים

    מייצר סצנות קשות וגרפיות בלי לחסום את הפרומפט, בתנאי שמכוונים אותו למילים הנכונות.

  • בדיקות עקיפת חסימות

    מתאים לבחינת התנהגות מודלים שעברו תהליך הסרת סירובים מול פרומפטים מורכבים.

איפה זה נופל

ההגדרה כלא מצונזר דורשת מכם עבודה אקטיבית בפרומפט. המפתח מודה שהתוצר עלול לצאת יבש ומשעמם אם לא תדחפו אותו במפורש להשתמש בסלנג, בקללות או בתיאורים גרפיים. הוא לא יסרב, אבל הוא תוכנן להישאר מאופק כברירת מחדל.

בנוסף, המודל מוגדר ומאומן באנגלית בלבד. בעברית סביר להניח שתקבלו תוצאות עילגות או פלט שבור. לא הייתי בונה עליו לשום משימה שדורשת דיוק עובדתי או קוד, שכן כל הפיתוח שלו כוון ליצירת טקסט ספרותי, אימה ותפקידים.

שאלות
נפוצות

האם המודל מייצר תוכן גרפי ישירות מהקופסה?

לא לגמרי. הוא לא יסרב לפרומפט שלכם, אבל התוצאה הראשונית עשויה להרגיש מרוסנת ויבשה. המפתח מציין שחייבים להכניס לפרומפט הנחיות מדויקות, כולל מילות סלנג ודרישה מפורשת לרמת הבוטות שאתם רוצים.

למה כדאי להגדיר Smoothing Factor בהרצה?

היוצר מציין כי הגדרת הערך 1.5 בכלי כמו KoboldCpp מייצבת את איכות הטקסט ומונעת חזרתיות. אם התוכנה שלכם לא תומכת בדגימה כזו, מומלץ להעלות את ה־repetition penalty ל־1.1 עד 1.15.

איך מריצים

כדי להריץ אותו משתמשים בכלים שתומכים בפורמט GGUF כמו KoboldCpp או Text Generation WebUI. יש לוודא שהכרטיס שלכם מחזיק קובץ מתוך סך קבצים של שלושים ושבעה נקודה שבעה ג'יגה בייט. היוצר ממליץ במפורש להגדיר smoothing factor לערך 1.5, או להעלות את מקדם החזרתיות לטווח שבין 1.1 ל־1.15 כדי לקבל פלט חלק.

אם אתם משתמשים ב־Text Generation WebUI תצטרכו להגדיר llama_HF ולהוריד קובצי קונפיגורציה מתאימים מהמקור. למי שאין כרטיס גרפי מתאים להרצה מקומית, עדיף להשתמש במודל מסחרי דרך שירות חיצוני, כל עוד התוכן שלכם לא מפר את תנאי השימוש שלו.

ollama run hf.co/DavidAU/Qwen3-8B-Hivemind-Instruct-Heretic-Abliterated-Uncensored-NEO-Imatrix-GGUF:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הרישיון הוא Apache 2.0. זהו רישיון קוד פתוח מתירני שמאפשר שימוש מסחרי, שינוי של הקוד והפצה חופשית של המודל כחלק ממוצר שלכם. התנאי המרכזי הוא מתן קרדיט ושמירה על תנאי הרישיון המקוריים בכל הפצה עתידית.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗