GPT
Q

Qwen3.5-4B-Uncensored-HauhauCS-Aggressive

קוד פתוח

HauhauCSapache-2.02026-03-03

  • gguf
  • uncensored
  • qwen3.5
  • qwen
  • en

גרסה נטולת סינונים לחלוטין של Qwen3.5-4B שאינה מסרבת לפרומפטים. המודל מתאים למי שחייב מענה ישיר ורוצה יכולות טקסט, תמונה ווידאו במכשיר מקומי.

  • 18.4 GBמשקל הקבצים
  • 209,231הורדות בחודש
  • 510לייקים

מה זה

המודל מבוסס על Qwen3.5-4B המקורי, אך עבר הסרה תוקפנית של מנגנוני הסירוב. בבדיקה של היוצרים הוא עמד על אפס סירובים מתוך 465 ניסיונות, בלי לשנות מערכי נתונים או לפגוע ביכולות הבסיס. הוא נשען על ארכיטקטורה היברידית של 32 שכבות המשלבת Gated DeltaNet וסופטמקס, מגיע עם חלון הקשר טבעי של 262K שניתן להרחבה, ותומך בטקסט, תמונות ווידאו ישירות מהקופסה.

בגודל של ארבעה מיליארד פרמטרים, הייחוד שלו מול מתחרים הוא הוויתור המוחלט על חסימות תוכן במקביל לשמירה על מולטימודליות וריבוי שפות. ההבדל המשמעותי ביותר הוא שהמודל יענה על כל בקשה בלי להטיף מוסר, אף על פי שלעיתים הוא עדיין עשוי להצמיד הערת הבהרה קצרה בסוף התשובה בגלל אימון הבסיס.

מתאים ל

  • ניתוח מסמכים ותמונות

    מאפשר עיבוד משולב של תמונות, וידאו וטקסט בהקשר ארוך מאוד, בלי סירובים על תוכן רגיש או חריג.

  • עוזר מקומי במחשב אישי

    רץ ישירות על חומרה צנועה בזכות גרסאות קוונטיזציה קלות, ומגיב ללא חסימות על כל שאלה.

  • מחקר וסימולציות תוכן

    מתאים לבדיקות תרחישים קיצוניים שבהם מודלים מסחריים רגילים מסרבים לשתף פעולה וקוטעים את התהליך.

איפה זה נופל

הסרת הסירובים מוגדרת כאגרסיבית, מה שאומר שהמודל ייצר מענה לכל פקודה גם אם היא פוגענית, מסוכנת או לא הולמת, ללא בלמים מובנים. בנוסף, אימון הבסיס עדיין צורב לעיתים הסתייגויות אוטומטיות בסוף הטקסט, למשל הבהרות שאין מדובר בייעוץ משפטי. מודל של ארבעה מיליארד פרמטרים גם מוגבל ביכולות ההיגיון המורכבות שלו בהשוואה לדגמים גדולים יותר, והוא מחייב עדכון גרסה בכלי ההרצה בגלל מבנה השכבות החדש.

שאלות
נפוצות

איך מפעילים את יכולות התמונה והווידאו?

יש להוריד את קובץ ה־GGUF של המודל הראשי יחד עם קובץ ה־mmproj הייעודי ששוקל 645 מגה-בייט. בתוכנות תואמות כמו LM Studio או llama.cpp יש לטעון את שני הקבצים יחד כדי לאפשר קליטת מדיה.

למה המודל כותב לפעמים הסתייגות בסוף התשובה?

הטקסטים האלה, כמו הבהרה שאין מדובר בייעוץ מקצועי, צרובים מאימון הבסיס של Qwen ולא הוסרו במלואם. זה אינו סירוב של המודל לענות, והתשובה המלאה תופק לפני ההערה הזו.

איך מריצים

קובצי ה־GGUF מחייבים שימוש בגרסאות עדכניות של כלי הרצה כמו llama.cpp, LM Studio או koboldcpp, משום שהארכיטקטורה חדשה. כדי להשתמש ביכולות תמונה ווידאו, אתם חייבים לטעון גם את קובץ ה־mmproj ששוקל 645 מגה-בייט לצד המודל הראשי. לתרחישי ייצור מומלץ להשתמש ב־vLLM, SGLang או KTransformers.

מבחינת משקלים, גרסת ה־BF16 דורשת כ־7.9 ג'יגה-בייט זיכרון, בעוד קוונטיזציות כמו Q4_K_M יורדות ל־2.6 ג'יגה-בייט וירוצו בקלות על כרטיסי מסך ביתיים או מחשבים ניידים עם מעט זיכרון וידאו. כדי לשמור על מצב החשיבה של המודל, מומלץ להקצות הקשר של לפחות 128K, מה שדורש זיכרון נוסף.

ollama run hf.co/HauhauCS/Qwen3.5-4B-Uncensored-HauhauCS-Aggressive:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הפרויקט מפורסם תחת רישיון apache-2.0. הרישיון מתיר שימוש מסחרי, שינוי והפצה של הקבצים ללא תמלוגים, ומאפשר להטמיע את המודל בתוך מוצרים חופשיים או קנייניים, בכפוף לשמירה על הודעת זכויות היוצרים ותנאי הרישיון המקוריים.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗