GPT
Q

Qwen3.5-4B-NSFW-ARA-Heretic-Literotica-i1-GGUF

קוד פתוח

Sinbad-The-Sailorרישיון לא דווח2026-03-25

  • gguf
  • nsfw
  • story-generation
  • erotica
  • literotica

גרסת GGUF שעברה כיול לחוסר צנזורה מוחלט ולכתיבה ארוטית. מי שמוריד אותה מחפש יצירת פרוזה למבוגרים בלי סירובים מלאכותיים, בגודל שרץ בקלות על מחשב אישי.

  • 8.6 GBמשקל הקבצים
  • 6,579הורדות בחודש
  • 39לייקים

מה זה

מדובר בהמרה לפורמט GGUF של כוונון עדין על בסיס Qwen 3.5 בגודל 4 מיליארד פרמטרים. המטרה כאן ממוקדת לגמרי, כתיבת סיפורים ופרוזה ארוטית למבוגרים. כדי לעקוף את מנגנוני הסירוב הרגילים של מודלים מסחריים, הוא נשען על שיטות הסרת צנזורה כמו ARA ו־Heretic.

ההבדל המשמעותי בגרסה הזו הוא השימוש בכיול משקולות מסוג Importance Matrix שמסומן בשם כ־i1. בדרך כלל דחיסה של מודלים קטנים לגדלים כמו ארבעה או חמישה ביטים שוברת את המבנה הלשוני שלהם. המפרסם טוען שהכיול הזה שומר טוב יותר על ההקשר ומוריד את רמת הבלבול של המודל ביחס לקוונטיזציה סטנדרטית, כך שהפלט נשאר קוהרנטי גם במשימות יצירתיות מורכבות.

מתאים ל

  • פרוזה למבוגרים

    מיועד לכתיבת סיפורים ארוטיים באנגלית בלי לקבל סירובים מהמערכת.

  • משחקי תפקידים מקומיים

    מתאים להרצה על חומרה ביתית פשוטה בתוך ממשקים מבוססי llama.cpp.

  • יצירה ללא חסימות

    עוקף את מגבלות התוכן המובנות של מודלים מסחריים רגילים.

איפה זה נופל

זה מודל אולטרה-ייעודי ומוגדר באנגלית בלבד, כך שאין מה לבנות עליו לפרויקטים בעברית או לכתיבה עסקית. היעדר הצנזורה מוחלט ואין בו מנגנוני הגנה מובנים, ולכן הוא לא מתאים לשום שירות ציבורי בלי שכבת סינון עצמאית. בנוסף, מגבלת הגודל של 4B עדיין קיימת, עלילות ארוכות או דמויות מרובות יגרמו לו לאבד הקשר מהר יותר ממודלים גדולים.

שאלות
נפוצות

האם אפשר להשתמש בו לטקסטים בעברית?

לא מומלץ. המודל מוגדר ומאומן עבור השפה האנגלית בלבד. אם תנסו לכתוב איתו בעברית תקבלו תוצאות עילגות או שגיאות תחביר גסות.

איזו גרסת קובץ הכי כדאי להוריד?

עבור כתיבה יוצרת ההמלצה של היוצר היא Q5_K_M ששומר על איכות טקסט טובה בלי לתפוס יותר מדי זיכרון. אם המשאבים לחוצים אפשר לרדת ל־Q4_K_M, ואם יש מספיק זיכרון פנוי אפשר לקחת את Q6_K.

איך מריצים

את הקבצים מריצים ישירות מול מנועים שתומכים ב־GGUF כמו llama.cpp עם מבנה פרומפט של ChatML. בגלל שמדובר במודל של 4B, דרישות החומרה נמוכות מאוד ואין סיבה אמיתית לפנות לשרת חיצוני. כרטיס מסך בסיסי או אפילו מעבד מודרני עם מספיק זיכרון יריצו אותו בלי בעיה.

יש שלוש רמות דחיסה לבחירה: Q4_K_M שמאזן בין משאבים לאיכות, Q5_K_M שמומלץ ספציפית לפרוזה, ו־Q6_K למי שרוצה מקסימום דיוק ושחזור של המשקולות. המפרסם ממליץ לעבוד עם טמפרטורה בין 0.75 ל־0.85, Top-p של 0.90, וקנס חזרתיות של 1.1 כדי למנוע לולאות טקסט.

ollama run hf.co/Sinbad-The-Sailor/Qwen3.5-4B-NSFW-ARA-Heretic-Literotica-i1-GGUF:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

היוצר לא דיווח על רישיון כלל בדף המודל. במצב כזה אין אישור משפטי מפורש להשתמש בו, ובוודאי שלא לשלב אותו במוצר מסחרי שחשוף לתביעות. מי שבוחר להריץ אותו עושה זאת על אחריותו האישית בלבד.

הרישיון המלא בעמוד המודל ↗