GPT
H

Huihui-Qwen3-8B-abliterated-v2

קוד פתוח

huihui-aiapache-2.02025-06-18

  • transformers
  • safetensors
  • qwen3
  • text-generation
  • chat

גרסה נטולת סירובים ל־Qwen3 בגודל 8.2 מיליארד פרמטרים שנועדה לענות על כל הנחיה בלי לחסום אתכם. היא מתאימה למי שרוצה חופש מוחלט ביצירת טקסט מקומי בלי מנגנוני בטיחות מעיקים.

  • 8.2Bפרמטרים
  • 40,960טוקנים בהקשר
  • 15.3 GBמשקל הקבצים
  • 8,368הורדות בחודש

מה זה

הבסיס כאן הוא מודל שמונה מיליארד פרמטרים שעבר תהליך הסרת סירובים, מה שמכונה abliteration. המטרה היתה לנטרל את נטיית המודל לסרב לבקשות, בלי להשתמש בספריית TransformerLens אלא בשיטה מהירה וישירה יותר שפותחה בפרויקט חיצוני. היוצרים עצמם מגדירים את זה כהוכחת היתכנות גולמית למדי, כך שלא מדובר באימון מלא אלא בשינוי משקולות ממוקד.

בגרסה הזו הם שינו את שכבה 0 כדי לפתור באג שגרם לפלט משובש של ג׳יבריש בגרסה הקודמת. מעבר לזה, המודל תומך בהקשר של עד 40,960 טוקנים, מה שמאפשר להזין לו מסמכים ארוכים למדי בלי לאבד את ההקשר.

מתאים ל

  • מחקר על עקיפת הגנות

    מאפשר לבחון איך הסרת סירובים משפיעה על התנהגות מודלי שפה בגודל בינוני.

  • כתיבה יצירתית ללא סינון

    עונה על כל הנחיה עלילתית או תסריטאית בלי לחסום נושאים מורכבים או אפלים.

  • ניתוח טקסטים רגישים

    מעבד ומסכם תכנים שמערכות מסחריות רגילות היו דוחות ומסרבות לקרוא.

איפה זה נופל

זה ניסוי גולמי ולא מודל שעבר אופטימיזציה מקיפה, והיוצרים מזהירים במפורש לא להעלות אותו לפרודקשן או לחשוף אותו למשתמשי קצה. בגלל שכל מנגנוני הבטיחות והסינון הוסרו, הוא עלול לייצר תוכן פוגעני, רגיש או לא חוקי בלי שום אזהרה, ואין עליו שום אחריות מצד המפתחים. בנוסף, שינויים כירורגיים במשקולות עלולים לפגוע באיכות התשובות או בהיגיון הכללי, כך שחובה לבדוק היטב את איכות הפלט לפני שמסתמכים עליו.

שאלות
נפוצות

מה שונה בגרסה 2 לעומת הגרסה הראשונה של המודל?

בגרסה הקודמת משתמשים נתקלו בפלט משובש של סימנים חסרי פשר. המפתחים שינו את שכבה 0 במודל כדי לפתור את הבעיה הזו, ועדכנו במקביל גם את החבילה שרצה ב־Ollama.

איך שולטים במצב החשיבה של המודל בזמן ריצה?

אם אתם מריצים אותו דרך Ollama, אפשר לעבור בין מצבים ישירות בטרמינל. הפקודה set think מפעילה את תהליך החשיבה המפורט, והפקודה set nothink מחזירה אותו לתשובות ישירות.

האם המודל בטוח לשימוש באפליקציה עם משתמשים אמיתיים?

לא, היוצרים ממליצים להגביל אותו למחקר ובדיקות בסביבה סגורה בלבד. מאחר שהסינונים הוסרו לחלוטין, הוא עלול לייצר תכנים בלתי הולמים או מסוכנים ללא פיקוח אנושי.

איך מריצים

כדי להריץ אותו מקומית צריך להוריד 15.3 גיגה־בייט של קובצי bfloat16 דרך ספריית transformers, מה שדורש כרטיס מסך עם לפחות 16 גיגה־בייט זיכרון כדי לעבוד בצורה יציבה. אם אתם מעדיפים עבודה פשוטה בלי קוד, יש גרסה ייעודית ב־Ollama תחת huihui_ai/qwen3-abliterated:8b-v2 שמאפשרת להריץ אותו בפקודה אחת.

מי שמשתמש ב־Ollama מקבל גם מתג מובנה להפעלת או כיבוי מצב חשיבה באמצעות הפקודות set think ו־set nothink. שווה להרים שרת עצמאי רק אם אתם חייבים פרטיות מלאה או מעבדים טקסטים שמודלים מסחריים יסרבו לגעת בהם.

from transformers import pipeline

pipe = pipeline("text-generation", model="huihui-ai/Huihui-Qwen3-8B-abliterated-v2")
print(pipe("שלום"))

הרישיון

הפרויקט מופץ תחת רישיון apache-2.0. הרישיון הזה מתיר שימוש מסחרי, שינוי של הקוד והמשקולות והפצה חופשית, כל עוד אתם שומרים על הודעת זכויות היוצרים ומצרפים עותק של הרישיון. עם זאת, היוצרים מבהירים שכל האחריות המשפטית והאתית על התוכן שהמודל פולט חלה עליכם בלבד.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗