GPT
Q

Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive

קוד פתוח

HauhauCSapache-2.02026-04-17

  • gguf
  • uncensored
  • qwen3.6
  • moe
  • vision

גרסה נטולת סירובים לחלוטין של מודל מולטימודלי עם תערובת מומחים. מתאימה למי שחייב שהמודל יענה על כל שאלה בלי לחסום פרומפטים ובלי לאבד יכולות חשיבה.

  • 230 GBמשקל הקבצים
  • 1,502,413הורדות בחודש
  • 3,625לייקים

מה זה

מדובר בהסרת מגבלות אגרסיבית על גבי מודל בסיס שכולל 35 מיליארד פרמטרים, אבל מפעיל רק כ־3 מיליארד בכל שלב תודות לארכיטקטורת תערובת מומחים של 256 מומחים. המודל מתמודד באופן טבעי עם טקסט, תמונה ווידאו, ומציע חלון הקשר מקורי של 262 אלף טוקנים שמשלב שכבות קשב לינאריות עם קשב מלא.

הייחוד כאן הוא בדיקת הסירובים. המפרסם מדווח על אפס סירובים מתוך 465 בדיקות, תוך שמירה על היכולות המקוריות ללא שינוי מערכי הנתונים. המודל פשוט מייצר את התוכן המבוקש במלואו, אם כי הוא עשוי לעיתים להצמיד הבהרות קצרות שנטמעו באימון המקורי.

מתאים ל

  • ניתוח תמונות ללא צנזורה

    מאפשר עיבוד תמונות וטקסט בלי סירובים מובנים, כולל קובץ הראייה הנלווה.

  • מחקר אבטחה ובדיקות חדירה

    עונה על פרומפטים רגישים ישירות, לאחר שהציג אפס סירובים במבחן של מאות דגימות.

  • פתרון בעיות קוד מורכבות

    תומך במצב חשיבה ייעודי למשימות דיוק וקוד בחלון הקשר של מעל 128 אלף טוקנים.

איפה זה נופל

ההסרה האגרסיבית של המגבלות משאירה את המודל חשוף לחלוטין, ולכן לא הייתי משלב אותו בממשק שפונה ישירות ללקוחות קצה ללא שכבת סינון עצמאית. בנוסף, הכרטיס מודה שהמודל עדיין פולט לפעמים הבהרות ודיסקליימרים קצרים בסוף התשובה, מאחר שהם הוטמעו באימון הבסיס. בעיה מעשית נוספת היא הצורך להחזיק לפחות 128 אלף טוקנים בהקשר כדי לא לפגוע ביכולות החשיבה שלו, עניין שגוזל משאבי זיכרון קיצוניים.

שאלות
נפוצות

למה המודל מציג סימן שאלה תחת עמודת הקוונטיזציה בתוכנת LM Studio?

הגרסאות המכונות K_P משתמשות בפרופיל כיול מותאם אישית של היוצר, שמזוהה מעט שונה בתוכנה. מדובר בעניין של תצוגה בלבד, והקובץ רץ כרגיל בכל סביבה שתומכת בפורמט GGUF.

האם אפשר להריץ עיבוד תמונה רק עם קובץ המודל הראשי?

לא. יכולות המולטימדיה דורשות להוריד ולהגדיר לצד המודל גם את קובץ mmproj ששוקל 899 מגה־בייט, אחרת המודל יפעל במצב טקסט בלבד.

איך מריצים

ההרצה נעשית דרך קובצי GGUF בסביבות כמו llama.cpp או LM Studio, תוך שימוש בדגל jinja עבור התבנית וקובץ mmproj נפרד במשקל 899 מגה־בייט לתמיכה בראייה ממוחשבת. גרסאות הקוונטיזציה נעות בין קובצי ענק של 44 ג'יגה־בייט לרמת שמונה ביט ועד לקבצים מכווצים של 11 ג'יגה־בייט ברמת שני ביט, כאשר גרסאות מותאמות אישית דורשות בין 19 ל־23 ג'יגה־בייט זיכרון גרפי.

מי שרוצה לנצל את מלוא חלון ההקשר ואת מצב החשיבה צריך לפחות 128 אלף טוקנים בזיכרון, מה שמנפח מאוד את דרישות ה־VRAM מעבר למשקל המשקולות עצמן. במקרים כאלה עדיף לפנות לשרת ייעודי או שירות מרוחק במקום להקצות חומרה מקומית כבדה.

ollama run hf.co/HauhauCS/Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הרישיון הוא Apache 2.0. הוא מתיר שימוש מסחרי חופשי, שינוי של המשקולות והפצה שלהן בתוך מוצרים, בתנאי ששומרים על הודעת זכויות היוצרים והרישיון המקורי.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗