GPT
Q

Qwen3.8-27B-OBLITERATED-GGUF

קוד פתוח

mradermacherapache-2.02026-08-20

  • transformers
  • gguf
  • abliterated
  • uncensored
  • obliteratus

גרסת GGUF מכווצת למודל שעבר הסרת מגבלות, מיועדת להרצה מקומית בלי סינונים. מי שמוריד אותו מחפש מודל של 27B שיענה על הכל בלי להטיף מוסר.

  • 178 GBמשקל הקבצים
  • 35,957הורדות בחודש
  • 40לייקים

מה זה

המאגר הזה מחזיק המרות בפורמט GGUF של הדגם OBLITERATED, שמבוסס במקור על משפחת Qwen סביב גודל של 27 מיליארד פרמטרים. ההבדל המרכזי מול גרסאות רשמיות הוא הטיפול בסירובים. מודלים מסוג זה עוברים התערבות במשקלים כדי לנטרל את מנגנוני הבטיחות המובנים, כך שהם לא יסרבו לבקשות קצה או יתחמקו מתשובות ישירות.

היוצר לא אימן פה רשת מאפס אלא ביצע קוונטיזציה סטטית ישירות מתוך המקור של צוות OBLITERATUS. בדף המודל אין מבחני ביצועים שמראים דיוק משימתי, אלא רק השוואת איבוד מידע כללית בין שיטות כיבוץ. מדובר בכלי שמכוון בעיקר למי שרוצה חופש מוחלט מהנחיות תאגידיות ומוכן לספוג את הפשרות הנלוות.

מתאים ל

  • מחקר תגובות ללא סינון

    מתאים לבדיקות של מודלים פתוחים במצבים שבהם מודלים רגילים מסרבים לענות או מצנזרים מידע.

  • הרצה מקומית על כרטיס יחיד

    גרסאות ה־Q4 מאפשרות דחיסה של מודל 27B לתוך כרטיס מסך צרכני של 24GB בלי לפצל משקלים.

  • בדיקות ראייה ממוחשבת

    קובצי ה־mmproj הזמינים במאגר מאפשרים לשלב עיבוד קלט חזותי יחד עם המודל הדחוס.

איפה זה נופל

הכרטיס לא מציג שום מידע על נתוני האימון המקוריים או על השפות הנתמכות מעבר לאנגלית, כך שאין שום ערובה לרמת העברית שלו. הסרת חסמים אגרסיבית מהסוג הזה פוגעת לעיתים קרובות ביציבות הלוגית של הפלט, ומגדילה את הסיכוי להזיות מוחלטות. לפני שמשלבים אותו במערכת כלשהי, חובה לבדוק שהוא מסוגל לעקוב אחרי הוראות מדויקות ולא מייצר טעויות עובדתיות קשות.

שאלות
נפוצות

איזו גרסת קובץ הכי כדאי להוריד משם?

הגרסאות המאוזנות ביותר הן Q4_K_M או Q4_K_S. הן שוקלות סביב 16 עד 17 גיגה בייט, שומרות על רוב היכולת המקורית, ונטענות במלואן לכרטיס עם 24 גיגה זיכרון. גרסאות Q3 ומטה מאבדות יותר מדי חדות.

מה התפקיד של קובצי mmproj ברשימה?

אלו קובצי פרויקטור שמיועדים לחיבור יכולות מולטימודל, כמו פענוח תמונות לצד טקסט. אם אתם מתכננים להריץ אך ורק שיחות טקסט, אין צורך להוריד אותם אלא רק את קובץ ה־GGUF הראשי.

איך מריצים

משקלי הקבצים נעים בין 11 גיגה בייט בגרסת Q2 הנמוכה ועד 29.1 גיגה בייט בגרסת Q8 המלאה. עבור רוב המשתמשים, גרסאות הביניים המומלצות כמו Q4_K_M ששוקלת 16.9 גיגה בייט או Q4_K_S של 15.9 גיגה בייט יספקו יחס טוב בין מהירות לאיכות. כדי להריץ אותן תצטרכו כרטיס מסך עם לפחות 24 גיגה זיכרון כדי לטעון את הכל פנימה, או לשלב הרצה חלקית על מעבד וזיכרון מערכת של 32 גיגה בייט ומעלה.

אם אין לכם חומרה מקומית כזו או שאתם מחפשים מענה יציב לייצור שוטף, החזקת שרת ייעודי למודל של 27 מיליארד פרמטרים עלולה לעלות יותר מסתם פנייה לשירותי ענן. בנוסף, יש במאגר קובצי mmproj בגדלים של 0.7 ועד 1.0 גיגה בייט, שמיועדים להרחבה מולטימודלית.

ollama run hf.co/mradermacher/Qwen3.8-27B-OBLITERATED-GGUF:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הרישיון הרשום הוא apache-2.0. זהו רישיון קוד פתוח מתירני שמאפשר שימוש מסחרי, שינוי של הקבצים והפצה מחודשת. התנאי העיקרי הוא שמירה על הודעות זכויות היוצרים והצהרת הרישיון המקורית בכל עותק או תוצר נגזר.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗