GPT
Q

Qwen3.5-9B-The-Defiant-Fable-Uncensored-Heretic-NEO-IMATRIX-MAX-MTP-GGUF

קוד פתוח

DavidAUapache-2.02026-07-19

  • gguf
  • MTP GGUFS
  • Regular GGUFS
  • NEO Imatrix
  • fine tune

גרסה מכווצת וחסרת צנזורה של מודל תשעה מיליארד פרמטרים, שמיועדת לבצע כל הוראה בלי מעצורים. היא מציגה ביצועי הסקת מסקנות שמתחרים במודלים כבדים בהרבה.

  • 137 GBמשקל הקבצים
  • 996,397הורדות בחודש
  • 596לייקים

מה זה

מדובר באיחוד ואימון עדין מורכב של כמה גרסאות 9B, שהותאם במיוחד לפעול מקומית ובלי מנגנוני סירוב. לפי הנתונים בכרטיס, שיעור הסירובים ירד מ־100 ל־6 מתוך 100 בדיקות, כשהוא שומר על מדד שונות נמוך מאוד מהמקור. במבחני הבנה כמו ARC Challenge ו־Hellaswag, הוא עוקף לא רק את גרסת הבסיס אלא גם מודלים של 27B ו־35B מאותו בית גידול.

המשמעות בפועל היא יכולת חשיבה והבנת הקשר גבוהה ביחס לגודל קטן, עם תמיכה מובנית בראיית תמונה שדורשת קובץ ייעודי נפרד. הוא כולל חלון הקשר עצום של עד 256 אלף טוקנים ברמת הבסיס, שמותאם לעיבוד טקסטים ארוכים.

מתאים ל

  • משחקי תפקידים וצ'אט חופשי

    מיועד ליוצרים שמחפשים מודל שלא יטיף מוסר או יסרב לטקסטים אפלים ובוטים.

  • פיתוח קוד בסביבה מקומית

    מספק תוצאות חשיבה מהירות על חומרה ביתית במצב Instruct בלי להוציא מידע החוצה.

  • ניתוח מסמכים ארוכים

    תומך בחלון הקשר של 256k ומתאים להזנת קבצים ארוכים יחד עם תמונות.

איפה זה נופל

למרות שהוא מוגדר כחסר צנזורה, הכרטיס מודה בפירוש שהמודל לא מייצר תוכן בוטה מעצמו. ברירת המחדל שלו מתונה מאוד, ואם לא תדחפו אותו עם מילות מפתח מפורשות או קללות מוגדרות בבקשה, התוצאה תצא יבשה ואנמית.

בנוסף, רכיב הווידאו לא נבדק כלל בהסבה הזו, ועיבוד התמונה מחייב הורדה נפרדת של קובץ mmproj באותה התיקייה. מבחינת שפות, התמיכה הרשמית המוצהרת בכרטיס המקורי מתרכזת באנגלית ובסינית, כך שביצועים בעברית אינם מובטחים ודורשים בדיקה מקדימה.

שאלות
נפוצות

מה ההבדל בין קובץ רגיל לקובץ שמסומן ב־MTP?

קבצי MTP חוזים שני טוקנים בכל צעד ויכולים להאיץ את הריצה עד 185 טוקנים לשנייה. הם עובדים טוב בטמפרטורה של עד 1.0 ובלי ענישה על חזרתיות, אבל במשימות יצירתיות מורכבות עדיף להישאר עם הקובץ הרגיל.

איך מפעילים עליו עיבוד תמונה?

הקובץ המרכזי מכיל רק את משקולות השפה. כדי להזין תמונות חייבים להוריד קובץ תואם בשם mmproj ולשים אותו באותה התיקייה שבה שמור קובץ ה־GGUF.

איך מריצים

המודל מגיע בקובצי GGUF עם כיול IMATRIX מיוחד בגרסאות רגילות או MTP שמנבא שני טוקנים במקביל. על כרטיס RTX 5090 גרסת ה־MTP בכיול 4 ביט מייצרת מעל 185 טוקנים לשנייה, לעומת 130 טוקנים לשנייה בגרסה הרגילה, אבל אם קצב הקבלה שלה יורד מתחת ל־50 אחוז עדיף לחזור לגרסה הרגילה.

תוכלו לטעון אותו בקלות בתוכנות כמו LM Studio או KoboldCpp. אם אתם עובדים על מחשב נייד חלש בלי מעבד גרפי של 8 עד 16 גיגה זיכרון פנוי, עדיף להשתמש ב־API חיצוני של מודל סגור, כי המהירות תיפול לרמה לא שימושית.

ollama run hf.co/DavidAU/Qwen3.5-9B-The-Defiant-Fable-Uncensored-Heretic-NEO-IMATRIX-MAX-MTP-GGUF:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הקבצים

27 קבצים במאגר, 137 GB סך הכול. הקישורים מובילים ישירות ל־Hugging Face.

הרישיון

הפרויקט מופץ תחת רישיון Apache 2.0 המקורי. מותר להשתמש בו לצרכים מסחריים, לשנות את הקוד ולהפיץ אותו בחופשיות בתוך מוצרים, כל עוד משאירים את הודעת זכויות היוצרים והרישיון המקורי.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗