GPT
Q

Qwen3.6-27B-Uncensored-HauhauCS-Aggressive

קוד פתוח

HauhauCSapache-2.02026-04-22

  • gguf
  • uncensored
  • qwen3.6
  • vision
  • multimodal

גרסה נטולת סינונים של מודל מולטימודלי בגודל 27 מיליארד פרמטרים. היא חותכת ישירות לתשובה בלי הקדמות, בלי התנצלויות ובלי הרצאות מוסר.

  • 158 GBמשקל הקבצים
  • 133,243הורדות בחודש
  • 720לייקים

מה זה

הבסיס מגיע ממשפחת Qwen3.6 עם ארכיטקטורה היברידית של שכבות תשומת לב ליניאריות לצד שכבות רגילות, שתומכת בטקסט, בתמונות ובווידאו באמצעות קובץ הקרנה נפרד. היוצר של הגרסה הזו הסיר את מנגנוני הסירוב לחלוטין. במבחן של 465 שאילתות בעייתיות, המודל רשם אפס סירובים.

בניגוד לגרסת Balanced שנוטה לחשוב בקול, להסביר את עצמה או להציג אזהרה קצרה לפני שהיא עונה, גרסת Aggressive עונה ישר ולעניין בלי שום הקדמה. המפתח מודה בעצמו שרוב המשתמשים יעדיפו את Balanced בגלל דגימה יציבה יותר שמתאימה לסוכנים או לכתיבת קוד, כך שהבחירה בגרסה הזו רלוונטית כמעט אך ורק למי שרוצה למנוע לחלוטין את שלב ההיסוס של המודל.

מתאים ל

  • מענה ישיר לפרומפטים רגישים

    מפיק תשובות מידיות ללא אזהרות, הטפות מוסר או עיכובים מיותרים.

  • ניתוח תמונות ווידאו מקומי

    מאפשר עיבוד תוכן חזותי פרטי בעזרת קובץ ההקרנה המצורף.

  • הסרת סינונים במערכות סגורות

    מתאים לשרתים פנימיים שבהם נדרשת אפס חסימה אוטומטית על מידע.

איפה זה נופל

המודל רגיש מאוד לניסוח ההוראות, יותר מדגמים קודמים באותו גודל. אם ההוראה לא מגדירה במפורש את המבנה והמגבלות, הוא עלול לאבד כיוון בקלות. בנוסף, מנגנון החשיבה דולק כברירת מחדל ונוטה לייצר פלט ארוך ומיותר אם לא מעלים את מדד הענישה על חזרות, או אם לא מכבים אותו ידנית בהגדרות התבנית. הרחבת חלון ההקשר מעבר למגבלה הטבעית באמצעות YaRN פוגעת באיכות התוכן הקצר, כך שלא כדאי לגעת בה ללא צורך ממשי.

שאלות
נפוצות

למה המודל כותב בלוקים עצומים של חשיבה לפני שהוא עונה?

מנגנון החשיבה דולק כברירת מחדל בגרסה הזו. אפשר לכבות אותו דרך העברת פרמטר ייעודי בתבנית השיחה, או לרסן את האורך שלו על ידי העלאת הנתון presence_penalty לערך של 1.5.

איך מפעילים את היכולות של עיבוד התמונות?

הקובץ הראשי מכיל רק את משקלי השפה. כדי לנתח תמונות או וידאו, צריך להוריד גם את קובץ mmproj ששוקל 928 מגה בייט ולהגדיר אותו בפקודת ההרצה של המנוע.

מה עדיף, הגרסה הזו או גרסת Balanced?

יוצר המודל ממליץ לבחור בגרסת Balanced עבור כמעט כל משימה, כולל פיתוח סוכנים וקוד. גרסת Aggressive נועדה אך ורק למי שמחפש לדלג לחלוטין על ההקדמות וההסברים של המודל בשאילתות קיצוניות.

איך מריצים

כדי להריץ את המודל מקומית בפורמט GGUF דרך כלי כמו llama.cpp, תצטרכו לבחור קוונטיזציה לפי הזיכרון הגרפי הזמין לכם. קובץ Q4_K_P שוקל 18 גיגה בייט ודורש כרטיס עם לפחות 24 גיגה בייט זיכרון כדי לפרוק את כל השכבות, במיוחד אם רוצים לשמור על חלון הקשר נדיב שדורש זיכרון עבודה נוסף. אם החומרה חלשה יותר, יש קבצים קלים יותר עד לרמה של 10 גיגה בייט בגרסאות IQ2.

מי שרוצה יכולות ראייה חייב לטעון במקביל את קובץ הראייה הנפרד ששוקל קרוב לגיגה בייט. אם המחשב שלכם מוגבל במשאבים ואין לכם כרטיס מסך מתאים, עדיף לפנות לפתרונות ענן, כי הרצה על מעבד רגיל תהיה איטית מדי לשימוש שוטף.

ollama run hf.co/HauhauCS/Qwen3.6-27B-Uncensored-HauhauCS-Aggressive:Q6_K_P

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הרישיון הוא Apache 2.0. הרישיון מאפשר שימוש מסחרי, שינוי קוד והפצה מחדש בלי תשלום תמלוגים, כל עוד שומרים על הודעות זכויות היוצרים וההסברים על שינויים שבוצעו.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗