GPT
H

Huihui-Qwen3.8-Flash-Next-abliterated-GGUF

קוד פתוח

huihui-aiother2026-09-06

  • transformers
  • gguf
  • abliterated
  • uncensored
  • huihui

גרסה נטולת סינונים של מודל מולטימודלי לעיבוד תמונה וטקסט, המבוססת על טכניקת abliteration. מיועדת למי שצריך תשובות ישירות בלי סירובים מלאכותיים.

  • 105 GBמשקל הקבצים
  • 3,556הורדות בחודש
  • 47לייקים

מה זה

הפרויקט הזה לוקח את הדגם המקורי ומסיר ממנו את מנגנוני הסירוב באמצעות התערבות ישירה במשקולות, בלי להשתמש בספריות ייעודיות כמו TransformerLens. המטרה כאן היא לעבד קלט משולב של תמונה וטקסט בלי שהמערכת תחסום בקשות רגישות. היוצרים עצמם מצהירים שמדובר במימוש גולמי לחלוטין לצורך הוכחת היתכנות.

בניגוד למודלים שעברו אימון עדין מחודש כדי לשנות התנהגות, כאן פשוט נטרלו את שכבות הסירוב ברמת המשקולות. בגלל שמדובר בשינוי אגרסיבי, המודל עונה על פרומפטים שדגמים רגילים דוחים מיד, אך הוא עלול לאבד חלק מהיציבות הלשונית שלו במשימות מורכבות.

מתאים ל

  • מחקר הסרת סירובים

    בדיקת התנהגות מודלים מולטימודליים לאחר נטרול שכבות הבטיחות באופן ישיר.

  • ניתוח תמונות רגישות

    עיבוד תמונות וטקסט שדגמים מסחריים רגילים נוטים לחסום או לסרב לפענח.

  • ניסויי הרצה מקומיים

    בדיקת ביצועים עם llama.cpp וחלון הקשר רחב על חומרה מקומית כבדה.

איפה זה נופל

היוצרים מגדירים את הפרויקט כהוכחת היתכנות גולמית בלבד ומזהירים משימוש בו במוצרים מסחריים או מול משתמשי קצה. ביטול הסירובים חושף אתכם לפלט בוטה, פוגעני או רגיש, ואין כאן שום מנגנון בטיחות שימנע פליטת שטויות. בנוסף, הסרת הסירובים בשיטה הזו עלולה לפגוע בדיוק של ניתוח התמונות ולהכניס שגיאות עובדתיות במקומות שבהם המודל המקורי היה מדויק ויציב.

שאלות
נפוצות

האם המודל מתאים למוצר חי עם לקוחות?

ממש לא. היוצרים מזהירים במפורש לא להשתמש בו בייצור או מול משתמשים, כי אין בו שום שכבת בטיחות והוא עלול לייצר פלטים פוגעניים.

איך מריצים אותו על המחשב?

משתמשים בכלי llama-cli מהגרסה האחרונה של llama.cpp ומפנים לקובצי ה־GGUF, עם תמיכה בחלון הקשר של עד 262,144 טוקנים.

איך מריצים

את המשקלים מריצים דרך הגרסה העדכנית של llama.cpp באמצעות פקודת llama-cli פשוטה. הקבצים מגיעים בחלוקה לכמה מקטעי GGUF שיושבים בסך הכל על כ־105 גיגה בייט, כך שתצטרכו שרת עם נפח זיכרון ראם או וידאו משמעותי מאוד כדי לטעון אותו, בייחוד עם חלון הקשר של 262,144 טוקנים.

אם אין לכם תחנת עבודה ייעודית עם כרטיסי מסך חזקים או שרת מקומי מתאים, הורדה של קבצים בגודל הזה היא כאב ראש לא קטן. במקרים שבהם אין חובה בפרטיות מוחלטת של הנתונים, פנייה לשרתי ענן חיצוניים תהיה מהירה וזולה יותר מהחזקת הברזלים האלה אצלכם.

ollama run hf.co/huihui-ai/Huihui-Qwen3.8-Flash-Next-abliterated-GGUF:Q4_K_XL

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הרישיון מוגדר כ־other ולא מצורף פירוט חוקי של תנאי השימוש. בלי רישיון מסחרי ברור ומוכר, שילוב של הקבצים האלה בתוך מוצר מסחרי חושף אתכם לתביעות ולסיכונים משפטיים, והיוצרים מציינים במפורש שהם אינם נושאים באחריות לתוצאות השימוש.

הרישיון המלא בעמוד המודל ↗