GPT
Q

Qwen3.5-9B-abliterated

קוד פתוח

lukey03apache-2.02026-03-03

  • transformers
  • safetensors
  • qwen3_5_text
  • text-generation
  • abliterated

גרסה נטולת סינון של מודל שפותרת בעיות סרבנות באמצעות מחיקת מנגנוני הבטיחות במשקולות. מי שבוחר בה מחפש תשובות ישירות על נושאים רגישים בלי חסימות של מודלי בסיס רגילים.

  • 9Bפרמטרים
  • 262,144טוקנים בהקשר
  • 16.7 GBמשקל הקבצים
  • 1,263הורדות בחודש

מה זה

הפיתוח הזה לקח מודל עם כמעט תשעה מיליארד פרמטרים ומחק ממנו את מנגנוני הסירוב דרך שילוב של מחיקת וקטורים במשקולות ואימון עדין ממוקד. במקום לסרב לשאלות על קוד זדוני, פריצת מנעולים או נושאים שנויים במחלוקת, הוא פשוט עונה. במבחן של שמונה עשרה שאלות סרבנות טיפוסיות שבהן מודל המקור נכשל לחלוטין וענה על אפס, הגרסה הזו ענתה על כולן.

הוא מבוסס על ארכיטקטורה היברידית של דלתא-נט ותשומת לב רגילה על פני שלושים ושתיים שכבות, עם חלון הקשר עצום של 262,144 טוקנים. היתרון שלו מול מודלים לא מצונזרים ותיקים כמו דולפין שמבוסס על שבעה מיליארד פרמטרים מתבטא ביכולות ניתוח, תכנות והיגיון גבוהות יותר שנשמרו גם אחרי הסרת החסימות.

מתאים ל

  • מחקר אבטחת מידע

    כתיבת סקריפטים ובדיקות חדירה בלי להתקל בחסימות סירוב גנריות של מודלים מסחריים.

  • כתיבה יצירתית חופשית

    יצירת דיאלוגים מורכבים וסצנות פשע בלי צנזורה על נושאים אפלים או שנויים במחלוקת.

  • עיבוד טקסטים ארוכים מקומית

    ניתוח מסמכים רגישים על חומרה מקומית בזכות תמיכה בחלון הקשר גדול במיוחד.

איפה זה נופל

בגלל ביטול מוחלט של מנגנוני הסירוב, הוא יפיק הוראות מסוכנות, תוכן פוגעני או קוד זדוני בלי שום שיקול דעת. בכרטיס המודל מודגש שמעבר נוסף של הסרת וקטורים פשוט הרס את המודל והפך את הפלט לג'יבריש, מה שמעיד על איזון עדין מאוד במשקולות. חובה לבדוק אותו ביסודיות לפני חיבור למשתמשי קצה כי אין פה רשת ביטחון, ובנוסף הנתונים הרשמיים מתעדים תמיכה באנגלית בלבד.

שאלות
נפוצות

האם המודל עובד טוב בעברית?

המודל מוגדר רשמית לאנגלית בלבד. הוא מסוגל לקרוא ולכתוב עברית ברמה מסוימת בזכות ארכיטקטורת המקור, אבל הביצועים בעברית אינם מובטחים וצפויים להיות נמוכים משמעותית מבשפה האנגלית.

האם חייבים להשתמש בפרומפט פריצה כדי לעקוף חסימות?

לא. מנגנון הסירוב הוסר ישירות ממשקולות המודל והאימון הנוסף חיסל סרבנות נקודתית, כך ששאלות ישירות נענות בלי צורך בהתחכמויות.

איך מריצים

המשקל המלא של קובצי הסייפטנסורס תופס 16.7 גיגה-בייט, מה שמחייב כרטיס מסך עם לפחות 24 גיגה זיכרון כדי לטעון אותו ישירות דרך ספריית הטרנספורמרס. למחשב מקומי עדיף להוריד גרסאות מכווצות דרך אולמה או קובצי GGUF, שדורשים סביב חמישה עד שישה גיגה-בייט זיכרון ורצים בקלות על מעבד סביר או מחשב מק עם זיכרון מאוחד.

אם אתם צריכים לפרוס שירות לעשרות משתמשים במקביל עם חלון הקשר מלא, שרת עצמאי יעלה לא מעט כסף בתשתיות ענן. במקרים כאלה עדיף לבדוק שירותי API של מודלים פתוחים, אלא אם הדרישה העסקית מחייבת שום סינון ושליטה מלאה בנתונים.

from transformers import pipeline

pipe = pipeline("text-generation", model="lukey03/Qwen3.5-9B-abliterated")
print(pipe("שלום"))

הרישיון

הרישיון הוא אפאצ'י 2.0. הוא מתיר שימוש מסחרי, שינוי קוד והפצה חופשית של המודל בתוך מוצרים, בתנאי ששומרים על תנאי הרישיון והודעות זכויות היוצרים המקוריות. אין חובת פתיחת קוד למוצר שלכם, אבל האחריות החוקית על התוכן שהוא פולט חלה במלואה עליכם.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗