GPT
Q

Qwen3-30B-A3B-abliterated

קוד פתוח

mlabonneapache-2.02025-04-30

  • transformers
  • safetensors
  • qwen3_moe
  • text-generation
  • abliteration

גרסה נטולת סינון למודל של Qwen בתצורת תערובת מומחים. מי שבוחר בו מחפש תשובות ישירות בלי מעצורי בטיחות שמסרבים לבקשות רגישות.

  • 31Bפרמטרים
  • 40,960טוקנים בהקשר
  • 171 GBמשקל הקבצים
  • 342,335הורדות בחודש

מה זה

הבסיס פה הוא מודל תערובת מומחים של כמעט שלושים ואחד מיליארד פרמטרים, שעבר תהליך שנקרא abliteration כדי לנטרל את מנגנוני הסירוב המובנים שלו. במקום שהמודל יענה שהוא לא יכול לעזור בנושאים רגישים או שנויים במחלוקת, הוא פשוט עונה ישירות על מה שביקשתם.

ההבדל בינו לבין מודלים רגילים באותו סדר גודל הוא הסרת המחסומים האלה. אין בדף המודל מבחני ביצועים שמראים אם השינוי הזה פגע ביכולות הניתוח או ההיגיון שלו בהשוואה למקור, ולכן אי אפשר לדעת בוודאות אם היכולות הכלליות נשמרו בלי לבדוק בעצמכם.

מתאים ל

  • מחקר על מנגנוני סירוב

    מתאים לבדיקה של האופן שבו הסרת מעצורי בטיחות משפיעה על התשובות והיציבות של המודל.

  • ניתוח טקסטים רגישים

    יעיל למשימות תוכן שמודלים רגילים ומסוננים נוטים לסרב לעבד או לתמצת.

  • בדיקות חוסן פנימיות

    כלי טוב לצוותי אבטחה שרוצים לראות מה מודל יכול להפיק כשההגנות שלו מנוטרלות.

איפה זה נופל

היוצר בעצמו כותב בפירוש שהעבודה עדיין בעיצומה והוא לא ממליץ להשתמש במודל הזה כרגע. ברגע שמסירים את מנגנוני הסירוב, המודל עלול לפלוט מידע שגוי, מסוכן או בעייתי בלי שום בלמים. אם אתם בונים מוצר שפונה למשתמשים, אסור להכניס אותו לשם בלי שכבת בדיקה משלכם.

שאלות
נפוצות

האם כדאי להשתמש בו עכשיו במערכת אמיתית?

לא. מפתח המודל ציין במפורש שהעבודה לא הסתיימה ושהוא לא ממליץ להשתמש בו במצבו הנוכחי. שווה להמתין לעדכון יציב יותר לפני שמשקיעים בו זמן פיתוח.

אפשר להריץ אותו על מחשב ביתי?

במשקל המקורי של 171 גיגה־בייט אין סיכוי להריץ אותו על חומרה ביתית רגילה. תצטרכו להמתין לגרסה מכווצת ומכומתת או לשכור שרת ייעודי בענן עם זיכרון וידאו מתאים.

איך מריצים

המשקל המקורי של הקבצים מגיע ל־171 גיגה־בייט בדיוק מלא של float32, כך שלהוריד ולהריץ אותו כמו שהוא דורש שרת רציני עם כמה כרטיסי מסך חזקים מאוד. אי אפשר לדחוף את זה למחשב מקומי או לכרטיס בודד בלי קוונטיזציה שתחתוך את דרישות הזיכרון.

אם אתם רק רוצים לראות איך הוא מתנהג, להחזיק תשתית כזאת לבד זה כאב ראש יקר. שווה להרים שרת ייעודי רק אם אתם חייבים פרטיות מלאה או פעילות שלא תלויה בספקי ענן חיצוניים.

from transformers import pipeline

pipe = pipeline("text-generation", model="mlabonne/Qwen3-30B-A3B-abliterated")
print(pipe("שלום"))

הקבצים

49 קבצים במאגר, 171 GB סך הכול. הקישורים מובילים ישירות ל־Hugging Face.

הרישיון

הרישיון הוא apache-2.0, שמתיר שימוש מסחרי, שינוי של הקוד והפצה חופשית. מותר לשלב אותו במוצרים פרטיים או מסחריים בלי לשלם תמלוגים, כל עוד שומרים על הודעת זכויות היוצרים של המקור ועל תנאי הרישיון.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗