GPT
H

Huihui-Qwen3-4B-abliterated-v2

קוד פתוח

huihui-aiapache-2.02025-06-19

  • transformers
  • safetensors
  • qwen3
  • text-generation
  • chat

גרסה נטולת סינונים של Qwen3 בגודל 4B, שנועדה לענות על שאלות בלי לחסום או לסרב. היא מתאימה למי שצריך מודל מקומי קל שלא מטיף מוסר.

  • 4Bפרמטרים
  • 40,960טוקנים בהקשר
  • 7.5 GBמשקל הקבצים
  • 2,155הורדות בחודש

מה זה

היוצרים לקחו את Qwen3-4B וביצעו עליו תהליך abliteration, שמסיר את מנגנוני הסירוב המובנים ישירות מתוך המשקולות. בגרסה השנייה הזו הם שינו את שכבה 0 כדי לפתור בעיה של טקסט משובש שהופיעה בגרסה הקודמת, והשתמשו בשיטה מהירה יותר שמציגה לטענתם תוצאות טובות יותר.

בגודל של 4 מיליארד פרמטרים עם חלון הקשר של 40,960 טוקנים, הוא נותן מענה למשימות יצירת טקסט בלי העכבות של מודלים מסחריים רגילים. אין בדף המודל מבחני ביצועים רשמיים או ציונים השוואתיים, כך שקשה לדעת אם התהליך פגע ביכולות ההיגיון הכלליות שלו לעומת גרסת המקור.

מתאים ל

  • מחקר על עקיפת סינונים

    בדיקת התנהגות של מודלים שעברו הסרת מנגנוני סירוב ללא שימוש בכלים ייעודיים כבדים.

  • יצירת תוכן ללא הגבלות

    כתיבה בסביבה מקומית סגורה שבה מודלים מסחריים רגילים מסרבים לשתף פעולה עם הבקשה.

  • בדיקות אוטומציה פנימיות

    הרצה מקומית קלת משקל על חומרה צנועה שלא דורשת חיבור לרשת חיצונית.

איפה זה נופל

היוצרים מבהירים שמדובר במימוש בסיסי לניסויים בלבד ולא במודל שעבר אופטימיזציית בטיחות. המודל עלול לייצר תוכן פוגעני, רגיש או לא חוקי, ואין בו שום מנגנון בקרה מובנה. היוצרים עצמם ממליצים להימנע משימוש ישיר מול לקוחות בסביבת ייצור, ומחייבים בדיקה ידנית או ניטור רציף כדי לא להסתבך עם פלט בעייתי.

שאלות
נפוצות

מה ההבדל בין הגרסה הזו לגרסה הראשונה?

היוצרים תיקנו בעיה בשכבה 0 שגרמה לפלט של ג'יבריש וטקסט משובש. בנוסף הם דיווחו על מעבר לשיטת הסרת סירובים מהירה יותר שמניבה תוצאות טובות יותר.

האם כדאי לשלב אותו בצ'אטבוט לשירות לקוחות?

ממש לא. המודל נוצר במפורש בלי מסנני בטיחות, ויוצריו מזהירים מפני שימוש בייצור או מול קהל רחב. הוא עלול לפלוט טקסט פוגעני או בעייתי שייצור בעיות משפטיות ותדמיתיות.

איך מריצים

המשקל הכולל של הקבצים עומד על 7.5 גיגה בייט בדיוק bfloat16, כך שכרטיס מסך ביתי עם 8 או 12 גיגה זיכרון יחזיק אותו בקלות. אפשר לטעון אותו עם ספריית transformers או להריץ ישירות ב־Ollama תחת השם המותאם, עם תמיכה במצבי חשיבה דרך פקודות ייעודיות.

אם אתם צריכים רק מענה מהיר לבדיקות קצרות ואין לכם כרטיס גרפי זמין, שימוש בשרת ענן זמני עדיף על שדרוג מקומי. למשימות שדורשות פרטיות מוחלטת או כתיבה ללא סינון, הרצה מקומית על החומרה שלכם היא הפתרון היחיד.

from transformers import pipeline

pipe = pipeline("text-generation", model="huihui-ai/Huihui-Qwen3-4B-abliterated-v2")
print(pipe("שלום"))

הרישיון

רישיון apache-2.0 מאפשר שימוש חופשי לחלוטין, כולל שינוי הקוד, הפצה ושימוש מסחרי במוצרים שלכם. התנאי המרכזי הוא שמירה על הודעת זכויות היוצרים והרישיון המקורי, בלי שהיוצרים ייקחו אחריות על נזקים שייגרמו מהשימוש בו.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗