GPT
Q

Qwen3-30B-A3B-abliterated-erotic-i1-GGUF

קוד פתוח

mradermacherapache-2.02025-05-10

  • transformers
  • gguf
  • erotic
  • explicit
  • abliterated

גרסה מכווצת של מודל 30B שעבר הסרת מגבלות ומיועד לתוכן אירוטי. אם אתם צריכים טקסט למבוגרים בלי סירובים על חומרה מקומית, זו הסיבה לבחור בו.

  • 245 GBמשקל הקבצים
  • 8,654הורדות בחודש
  • 113לייקים

מה זה

מדובר באוסף קוונטיזציות מסוג imatrix שנוצרו על בסיס מודל שעבר שני שינויים מהותיים: הסרת מנגנוני הבטיחות הרגילים, ואימון ייעודי לכתיבת תוכן אירוטי באנגלית. במקום מודל כללי שיסרב לייצר טקסטים גרפיים או רומנטיים בוגרים, המודל הזה אמור לשתף פעולה באופן מלא עם הנחיות מהסוג הזה, בלי להטיף מוסר ובלי לזרוק שגיאות בטיחות.

היוצר לקח את משקלי המקור והעביר אותם דחיסה חכמה שמסתמכת על מטריצת חשיבות, טכניקה שאמורה לשמר ביצועים ודיוק טוב יותר מכיול סטטי רגיל ברמות דחיסה נמוכות. גודל של 30 מיליארד פרמטרים מציע בדרך כלל רמת כתיבה טובה בהרבה ממודלי 7B או 8B, אך בגלל הדגש הצר על תוכן מבוגרים והסרת המגבלות, הוא פחות מתאים למי שמחפש מנוע לעבודה מקצועית, פיתוח קוד או מענה מדויק על שאלות ידע כללי.

מתאים ל

  • משחקי תפקידים למבוגרים

    אידיאלי לסימולציות וצ'אט אישי ללא חסימות או סירובים על רקע תוכן מיני.

  • כתיבה יוצרת של ספרות אירוטית

    עוזר בניסוח סצנות מפורשות באנגלית ומספק רצף עלילתי סביר לגודל שלו.

  • בדיקות גבולות מודלים מקומיים

    מאפשר לבחון התנהגות מודלים שעברו הסרת מגבלות מוחלטת ללא תלות בשרת חיצוני.

איפה זה נופל

בכרטיס המודל מצוין בפירוש שגרסאות מסוימות כמו Q2_K ו־Q4_0 מציעות איכות ירודה, ושחלק מגרסאות ה־IQ הנמוכות מספקות איכות נמוכה משמעותית. מעבר לכך, המודל מוגדר עבור השפה האנגלית בלבד, ולכן תמיכה בעברית אינה מובטחת וצפויה להיות מקרטעת. תהליך הסרת המגבלות גם נוטה לעתים לפגוע בהיגיון הכללי של המודל, מה שעלול להוביל להזיות תכופות יותר.

שאלות
נפוצות

איזו גרסת קובץ הכי מומלצת להורדה?

היוצר מסמן את גרסת i1-Q4_K_M ששוקלת 18.7 גיגה כגרסה מומלצת ומהירה. אם חסר לכם זיכרון בכרטיס, גרסת i1-Q4_K_S במשקל 17.6 גיגה מציעה פשרה אופטימלית בין גודל, מהירות ואיכות.

האם המודל יפעל טוב בעברית?

הנתונים מצהירים על תמיכה באנגלית בלבד. המודל אולי יזהה מילים בעברית, אך איכות הכתיבה, הדקדוק והעלילה יהיו נמוכים מאוד ביחס לפלט באנגלית.

איך מריצים

כדי להריץ את הקבצים האלה תצטרכו תוכנה שתומכת בפורמט GGUF, כמו llama.cpp או כלים שמבוססים עליה. משקלי הקבצים נעים בין 11.4 גיגה בייט בגרסה המכווצת ביותר ועד 25.2 גיגה בייט בגרסת Q6_K. אם יש לכם כרטיס מסך ביתי עם 16 גיגה זיכרון, תוכלו לטעון גרסאות קלות כמו IQ3 או גרסאות Q4 מסוימות תוך פשרה על איכות הפלט, בעוד גרסאות איכותיות כמו Q4_K_M ששוקלת 18.7 גיגה או Q5 ידרשו כרטיס עם 24 גיגה זיכרון.

מי שאין לו כרטיס מסך ייעודי של לפחות 16 עד 24 גיגה זיכרון יסבול מקצב יצירת טקסט אטי מאוד במעבד רגיל. במקרה כזה, עדיף בהרבה להשתמש בשרת ענן שכור לפי שעה או שירות API חיצוני, במקום לנסות להריץ 30 מיליארד פרמטרים מקומית.

ollama run hf.co/mradermacher/Qwen3-30B-A3B-abliterated-erotic-i1-GGUF:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הרישיון המדווח הוא apache-2.0, רישיון קוד פתוח מתירני מאוד שמאפשר שימוש חופשי, שינוי הקוד והפצה, כולל שימוש מסחרי במוצר, בכפוף לשמירה על הודעת זכויות היוצרים ומסמך הרישיון המקורי.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗