GPT
Q

Qwen3.5-122B-A10B-Uncensored-HauhauCS-Aggressive

קוד פתוח

HauhauCSapache-2.02026-03-22

  • gguf
  • uncensored
  • qwen3.5
  • moe
  • vision

גרסה נטולת סינונים של ארכיטקטורת תערובת מומחים גדולה לעיבוד טקסט ותמונה. המטרה היא לקבל מודל מולטימודלי שלא מסרב לפרומפטים ומצמצם הערות אזהרה.

  • 942 GBמשקל הקבצים
  • 335,864הורדות בחודש
  • 173לייקים

מה זה

מדובר בהסבה של ארכיטקטורת תערובת מומחים עם מאה עשרים ושניים מיליארד פרמטרים בסך הכול, שמפעילה רק כעשרה מיליארד בכל מעבר. המודל שומר על היכולות המקוריות לטקסט, תמונה ווידאו לצד חלון הקשר של מאתיים שישים ושניים אלף טוקנים, אך מסיר את מנגנוני הסירוב המובנים. המפתח מדווח על אפס סירובים מתוך ארבע מאות שישים וחמש בדיקות שנעשו עליו.

המבנה משלב תשומת לב קווית ואテンשן רגיל כדי לחסוך במשאבים, ומכיל מאגר מילים רחב של מאתיים ארבעים ושמונה אלף ערכים. הגרסה הזו מוגדרת כאגרסיבית במיוחד, כלומר היא מקצצת כמעט לגמרי בהתנצלויות ובאזהרות שהופיעו בגרסאות קודמות ועונה ישירות לכל בקשה.

מתאים ל

  • בדיקות חוסן וסינון

    הוא עונה על כל פרומפט ללא סירוב, מה שמאפשר לבחון מסננים חיצוניים על פלטים קיצוניים.

  • ניתוח מסמכים ותמונות

    הוא מעבד תמונה וטקסט בחלון הקשר ענק של מאתיים שישים ושניים אלף טוקנים בלי חסימות תוכן.

  • הסקה ומשימות תכנות

    מצב החשיבה המובנה שלו מותאם לעבודה מורכבת של קוד ופתרון בעיות עם הגדרות טמפרטורה ייעודיות.

איפה זה נופל

חוסר הסירוב המוחלט הופך את התוצרים לחסרי בקרה, ואין שום מנגנון בטיחות שימנע פלט בעייתי או שגוי. אם אתם בונים מוצר שמיועד למשתמשי קצה, אי אפשר לסמוך על שיקול הדעת של המודל ותצטרכו לבנות שכבת סינון חיצונית משלכם.

בנוסף, הפעלת תמיכה בתמונות דורשת טעינה של קובץ עזר נוסף, ומצב החשיבה המובנה פועל כברירת מחדל ודורש דגלים מיוחדים כדי לכבות אותו. מי שלא מגדיר נכון את התבנית של השיחה יקבל תוצאות שבורות או התנהגות לא צפויה.

שאלות
נפוצות

כמה זיכרון וידאו צריך כדי להריץ אותו בפועל?

זה תלוי בגרסת הכיווץ שתבחרו. הגרסה הקלה ביותר דורשת כארבעים ג'יגה רק לקובץ עצמו, בעוד גרסאות איכותיות יותר מגיעות לשבעים עד מאה ג'יגה ויותר, לפני שלוקחים בחשבון את חלון ההקשר. בפועל דרוש שרת עם כרטיסי זיכרון גדולים מאוד כדי להריץ אותו בצורה שמישה.

איך מפעילים עליו קלט של תמונות?

המודל מגיע כקובץ טקסט ראשי, וכדי להשתמש ביכולות הראייה צריך להוריד גם את קובץ הראייה הנפרד ששוקל שמונה מאות שישים ושבעה מגה. בהרצה דרך שורת הפקודה מוסיפים את הדגל הייעודי שמפנה לקובץ הזה יחד עם תבנית השיחה המתאימה.

איך מריצים

כדי להריץ אותו מקומית צריך מערך חומרה רציני מאוד. הקבצים בפורמט קוונטיזציה נעים בין ארבעים ג'יגה בגרסה המכווצת ביותר למאה ארבעים וחמישה ג'יגה בגרסת שמונה ביט, כך שגם עבור גרסת ביניים סבירה תצטרכו זיכרון וידאו של שמונים ג'יגה לפחות או שילוב של כמה כרטיסים.

ההרצה עובדת מול תוכנות שתומכות בפורמט כמו llama.cpp או LM Studio, ודורשת קובץ פרויקציה נפרד של שמונה מאות שישים ושבעה מגה אם רוצים יכולות ראייה. אם אין לכם שרת ייעודי עם מספיק זיכרון להחזיק משקלים כאלה, עדיף להשתמש במודל קטן יותר או להמתין לחלופות שמנגישות אותו דרך שרת מרוחק.

ollama run hf.co/HauhauCS/Qwen3.5-122B-A10B-Uncensored-HauhauCS-Aggressive:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הרישיון הוא apache-2.0, שמתיר שימוש חופשי כולל שימוש מסחרי, שינוי קוד והפצה. התנאי העיקרי הוא שמירת הודעות זכויות היוצרים ומסמך הרישיון המקורי בכל הפצה של המוצר.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗