GPT
Q

Qwen3.5-9B-Uncensored-HauhauCS-Aggressive

קוד פתוח

HauhauCSapache-2.02026-03-04

  • gguf
  • uncensored
  • qwen3.5
  • qwen
  • en

גרסה פתוחה לגמרי של מודל תשעה מיליארד פרמטרים שאינה מסרבת לפקודות. היא מתאימה למי שצריך עיבוד טקסט, תמונה ווידאו בלי חסימות תוכן או מעצורים מלאכותיים.

  • 38.5 GBמשקל הקבצים
  • 852,317הורדות בחודש
  • 2,024לייקים

מה זה

מדובר בהסרת חסמי בטיחות ממודל הבסיס תוך שמירה על היכולות המקוריות שלו. לפי המפרסם, במבחן של 465 שאילתות שנבדקו התקבלו אפס סירובים, מה שאומר שהוא עונה על מה שמבקשים בלי להתחמק. המודל כולל ארכיטקטורה היברידית של תשומת לב ליניארית ומלאה, תמיכה בריבוי שפות ותמיכה מובנית בקלט של תמונות ווידאו לצד טקסט.

חלון ההקשר המקורי שלו מגיע ל־262 אלף טוקנים עם אפשרות הרחבה, כך שאפשר להזין לו מסמכים כבדים או קטעי מדיה ארוכים. ההבדל המרכזי מול מודלים אחרים בקטגוריית המשקל הזו הוא השילוב בין מולטימודליות מלאה לבין שחרור אגרסיבי של כל מגבלות הצנזורה.

מתאים ל

  • ניתוח מסמכים ללא מגבלות

    עיבוד טקסטים רגישים או משפטיים שמודלים מסחריים נוטים לסרב לנתח.

  • עיבוד תמונות ווידאו מקומי

    זיהוי וניתוח מדיה על החומרה שלכם בזכות מקודד ראייה מובנה.

  • מחקר ואבטחת מידע

    הרצת בדיקות חדירות וסימולציות תוכן שדורשות מענה ישיר בלי חסימות.

איפה זה נופל

המודל מוגדר כגרסה אגרסיבית, מה שאומר שאין בו מנגנוני סינון ובטיחות בכלל. אם המוצר שלכם פונה לקהל רחב, אתם תהיו חייבים לבנות שכבת בדיקות משלכם כדי למנוע פלטים בעייתיים. בנוסף, המודל עלול לפעמים להדביק הערות ניעור מאחריות בסוף התשובה, כמו אמירה שזה אינו ייעוץ משפטי, כי הדפוס הזה נצרב במודל המקורי עוד לפני הסרת הסירובים.

שאלות
נפוצות

האם המודל באמת לא מסרב לשום דבר?

הוא מוגדר כנטול סירובים לחלוטין ובמבחן של 465 שאילתות הוא לא חסם אף אחת. עם זאת, בגלל אימון הבסיס שלו, הוא עשוי לעיתים להוסיף הצהרת ניעור מאחריות בסוף הטקסט אך עדיין יפיק את המענה המבוקש.

איך מפעילים תמיכה בתמונות?

חייבים להוריד את קובץ הראייה הנפרד ששוקל 880 מגה בייט בנוסף לקובץ המודל הרגיל. את שני הקבצים טוענים יחד בתוכנות שתומכות בכך כמו llama.cpp המעודכנת.

איך מריצים

המשקל המלא הוא 17 גיגה בייט בפורמט BF16, אבל יש גרסאות מכווצות שנעות בין 5.3 גיגה בייט לגרסת ארבעה ביט ועד 8.9 גיגה בייט לשמונה ביט. בשביל להריץ אותו מקומית עם קלט של תמונה או וידאו חייבים לטעון לצד הקובץ הראשי גם קובץ מקודד ראייה ששוקל 880 מגה בייט. לשימוש מקומי אפשר להשתמש בכלים כמו llama.cpp או LM Studio בגרסאות מעודכנות, כי הארכיטקטורה הזו חדשה מאוד.

אם אתם מתכננים להעלות אותו לשרת לעומסי עבודה גבוהים, המפתחים ממליצים להשתמש במנועים כמו vLLM, SGLang או KTransformers. כדאי להקצות זיכרון להקשר של 128 אלף טוקנים לפחות כדי לא לפגוע ביכולות החשיבה שלו, ואם החומרה שלכם חלשה מזה עדיף לשקול את גרסת הארבעה מיליארד הקלה יותר.

ollama run hf.co/HauhauCS/Qwen3.5-9B-Uncensored-HauhauCS-Aggressive:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הרישיון הוא Apache 2.0. מותר להשתמש בו לצרכים מסחריים, לשנות אותו, להריץ אותו במוצר שלכם ולהפיץ אותו בחופשיות. התנאי היחיד הוא שמירה על הודעת זכויות היוצרים וציון הרישיון המקורי.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗