GPT
H

Huihui-Qwen3-4B-Instruct-2507-abliterated

קוד פתוח

huihui-aiapache-2.02025-08-07

  • transformers
  • safetensors
  • qwen3
  • text-generation
  • abliterated

גרסה פתוחה לחלוטין של מודל קומפקטי, שעברה הסרה מכוונת של מנגנוני הסירוב הפנימיים. מתאים למי שחייב מודל מקומי שלא מתחמק משאלות או מתוכן רגיש.

  • 4Bפרמטרים
  • 262,144טוקנים בהקשר
  • 7.5 GBמשקל הקבצים
  • 3,487הורדות בחודש

מה זה

מדובר בהתאמה למודל הבסיס של עליבאבא מסדרת Qwen3 בגודל 4 מיליארד פרמטרים, שפותחה במטרה לעקוף את מנגנוני הבטיחות הרגילים. התהליך, שמכונה abliteration, מנטרל את הווקטורים שמפעילים סירובים מובנים בתשובות של המודל, בלי להזדקק לכלים כבדים כמו TransformerLens.

התוצאה היא מודל גנרטיבי קטן יחסית עם חלון הקשר ענק של 262,144 טוקנים, שלא עוצר את עצמו כשהוא נתקל בטקסטים שנויים במחלוקת. היוצרים עצמם מגדירים אותו כהוכחת היתכנות גולמית שבוצעה בשיטה מהירה יותר, כך שאין כאן הבטחה לעידון סגנוני אלא רק להסרת החסימות.

מתאים ל

  • מחקר אבטחת מידע

    בדיקת תרחישי תקיפה ובחינת עמידות של מנגנוני הגנה חיצוניים מול מודל שלא מסרב.

  • ניתוח טקסטים רגישים

    עיבוד מסמכים משפטיים או תוכן בוטה שמודלים מסחריים רגילים חוסמים אוטומטית.

  • יצירת תוכן נטול צנזורה

    כתיבה חופשית לסימולציות או תסריטים הדורשים דיאלוגים קשים בלי פילטרים תאגידיים.

איפה זה נופל

היוצרים מזהירים במפורש שמדובר בניסוי גולמי שלא עבר אופטימיזציית בטיחות, ולכן הוא נוטה לפלוט תוכן פוגעני, רגיש או לא חוקי. הסרת הסירובים עלולה גם לפגוע ביכולות ההיגיון הבסיסיות של המודל, מה שמוביל להזיות. אסור לחבר אותו ישירות למשתמשי קצה בלי שכבת סינון ובקרה ידנית הדוקה.

שאלות
נפוצות

האם המודל מתאים לשימוש ישיר מול לקוחות באפליקציה?

ממש לא. היוצרים עצמם ממליצים להגביל אותו למחקר ובדיקות, כי אין בו שום מנגנון שמונע ממנו לפלוט תוכן פוגעני או בלתי הולם.

כמה זיכרון דרוש כדי להריץ את גרסת ה־Ollama?

גרסת ה־q4_K_M דורשת בערך 3 עד 4 גיגה זיכרון עבודה פנוי, מה שמאפשר להריץ אותה בקלות גם על מחשבים ניידים פשוטים.

איך מריצים

המשקל המלא של הקבצים בפורמט bfloat16 מגיע ל־7.5 גיגה בייט, כך שכרטיס מסך ביתי ממוצע עם 8 עד 12 גיגה זיכרון מריץ אותו בלי בעיה דרך transformers. מי שמעדיף לחסוך מקום יכול להריץ גרסה מכווצת דרך Ollama באמצעות הפקודה המוכנה של היוצרים בגרסת q4_K_M.

אם אתם צריכים רק בדיקה מהירה של רעיון ולא אכפת לכם מצנזורה, עדיף להשתמש ב־API קיים של מודל גדול בהרבה. הריצה המקומית פה משתלמת רק כשחייבים פרטיות מלאה, או כשה-API החיצוני פוסל לכם פרומפטים על בסיס מדיניות תוכן.

from transformers import pipeline

pipe = pipeline("text-generation", model="huihui-ai/Huihui-Qwen3-4B-Instruct-2507-abliterated")
print(pipe("שלום"))

הרישיון

רישיון apache-2.0 מאפשר שימוש חופשי לחלוטין, כולל שינוי הקוד, הרצה מקומית ושילוב במוצרים מסחריים. התנאי היחיד הוא שמירה על הודעת זכויות היוצרים והרישיון המקורי, בלי אחריות משפטית מצד היוצרים לנזקים שייגרמו מהשימוש.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗