GPT
Q

Qwen3.5-35B-A3B-Uncensored-HauhauCS-Aggressive

קוד פתוח

HauhauCSapache-2.02026-03-10

  • gguf
  • uncensored
  • qwen3.5
  • moe
  • vision

גרסה נטולת סינונים של מודל מולטימודלי עם ארכיטקטורת מומחים חסכונית. הוא מיועד למי שרוצה תשובות לכל הנחיה בלי חסימות ובלי לאבד את היכולות המקוריות.

  • 227 GBמשקל הקבצים
  • 95,936הורדות בחודש
  • 1,488לייקים

מה זה

הבסיס כאן הוא מודל תערובת מומחים שכולל 35 מיליארד פרמטרים בסך הכול, אבל מפעיל רק כ־3 מיליארד פרמטרים בכל מעבר. הוא משלב תשומת לב ליניארית מסוג Gated DeltaNet עם שכבות רגילות ביחס של 3 ל־1, כולל תמיכה בחיזוי מרובה תווים, ויודע לקבל טקסט, תמונות ווידאו. חלון ההקשר המקורי עומד על 262 אלף תווים ואפשר למתוח אותו עד מיליון עם YaRN.

היוצר לקח את משקלי המקור וביצע תהליך שחרור אגרסיבי. במבחן של 465 הנחיות שנבדקו בכרטיס המודל נרשמו אפס סירובים. המטרה המוצהרת היא להסיר את מנגנון הסירוב בלי לפגוע באיכות הנתונים או ביכולות הניתוח, כך שהמודל עונה ישירות על כל קלט בלי לעצור.

מתאים ל

  • מחקר אבטחה ובדיקות חדירה

    מייצר תשובות ישירות על נושאי אבטחה בלי להיתקע על מנגנוני סירוב של מודלים מסחריים.

  • ניתוח מסמכים ותמונות ארוכים

    מטפל בחלון הקשר של 262 אלף תווים יחד עם תמונות דרך קובץ הראייה הנלווה.

  • כתיבה חופשית ללא מגבלות

    מתאים לסימולציות ותסריטים שלא עוברים במודלים סגורים שמסרבים לטקסטים מסוימים.

איפה זה נופל

הגרסה הזו נקראת Aggressive, והיא מגיעה בלי גבולות בטיחות בכלל. המודל עלול לפלוט אזהרות קצרות שנטמעו באימון המקורי, אבל הוא עדיין ייצר את כל התוכן בלי לסרב. בנוסף, LM Studio מציג לעיתים זיהוי פרמטרים משובש של 256 כפול 2.6 מיליארד בגלל מטא דאטה. אם אתם בונים שירות שחשוף ללקוחות קצה, המודל הזה ייצר כל דבר שיבקשו ממנו בלי שום סינון הגנתי.

שאלות
נפוצות

איך מפעילים את יכולות התמונה של המודל?

צריך להוריד את קובץ mmproj-Qwen3.5-35B-A3B-Uncensored-HauhauCS-Aggressive-f16.gguf בנפרד מקובץ הטקסט. בהרצה ב־llama-cli מעבירים אותו עם הדגל mmproj יחד עם דגל jinja. בלי הקובץ הזה המודל יעבד רק טקסט.

למה המודל מציג הערות אזהרה אם הוא לא מצונזר?

האזהרות הקצרות נטמעו בתוך משקלי הבסיס בשלב האימון המקורי. הן אינן חסימות שמונעות את הפלט, והמודל ממשיך לייצר את התוכן המלא מיד אחריהן.

איך מריצים

הקבצים מופצים בפורמט GGUF שעבר קוונטיזציה עם imatrix. בשביל הרצה מקומית בסיסית, גרסת Q4_K_M שוקלת 20 ג'יגה בייט ודורשת כרטיס מסך עם זיכרון תואם כדי לטעון את כל השכבות. מי שרוצה איכות מקסימלית בגרסת BF16 יצטרך 65 ג'יגה בייט זיכרון רק למשקלים. אם רוצים יכולות ראייה, חובה להוריד גם את קובץ mmproj ששוקל 858 מגה בייט ולהגדיר אותו בהפעלה.

אפשר להריץ אותו דרך llama.cpp, LM Studio, Jan או koboldcpp. חשוב לספק לפחות 128 אלף תווים בהקשר כדי שמצב החשיבה יעבוד כמו שצריך, ולהשתמש בדגל jinja עבור התבנית. אם אין לכם חומרה עם לפחות 24 ג'יגה בייט זיכרון גרפי פנוי, כנראה שעדיף לא להריץ אותו מקומית.

ollama run hf.co/HauhauCS/Qwen3.5-35B-A3B-Uncensored-HauhauCS-Aggressive:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הרישיון המדווח הוא apache-2.0. הרישיון הזה מתיר שימוש מסחרי, הפצה, שינוי ושילוב במוצרים סגורים בלי תשלום תמלוגים. התנאי העיקרי הוא שמירת הודעות זכויות היוצרים והרישיון המקורי בקוד או בתוכנה שאתם מפיצים.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗