GPT
Q

Qwen3.6-27B-Uncensored-HauhauCS-Balanced

קוד פתוח

HauhauCSapache-2.02026-04-23

  • gguf
  • uncensored
  • qwen3.6
  • vision
  • multimodal

גרסה נטולת סירובים לטקסט ותמונה שמיועדת למשימות קוד וסוכנים. היא מספקת תשובות מלאות לשאלות רגישות בלי לקרוס או לסטות מהקשר.

  • 158 GBמשקל הקבצים
  • 376,576הורדות בחודש
  • 208לייקים

מה זה

מדובר בהתאמה למודל המקורי של Qwen שמסירה את מנגנוני הסירוב המובנים, עם תוצאה של אפס סירובים מתוך 465 בדיקות במבחן הייעודי. בניגוד לגרסאות קיצוניות שפולטות תשובה ישירה בלבד, גרסת הבלנסד משאירה את תהליך החשיבה פתוח, מצרפת לעיתים אזהרה קצרה, ועונה במלואה. המטרה כאן היא לשמור על יציבות ריצה ועל מבנה הפלט במשימות ארוכות שמערבות קריאות לכלים.

המבנה הפנימי משלב 48 שכבות קשב ליניארי מסוג גייטד דלתא-נט יחד עם 16 שכבות קשב מלאות, מה שמאפשר חלון הקשר טבעי של 262 אלף טוקנים. בנוסף ליכולות טקסט וקוד, הקובץ מגיע עם רכיב חזותי נפרד שמטפל בתמונות ובווידאו ישירות מתוך סביבת הריצה המקומית.

מתאים ל

  • סוכני פיתוח קוד

    הוא לא מסרב לשאלות אבטחה ותשתיות, ושומר על מבנה קריאות אחיד בשרשראות ארוכות.

  • ניתוח מסמכים ומדיה

    המודל כולל קובץ חזותי מובנה שמנתח תמונות וסרטונים יחד עם טקסט בהקשר רחב.

  • כתיבה יצירתית חופשית

    הוא עונה על נושאים מורכבים בלי לחסום תכנים או לצנזר עלילות בדיוניות.

איפה זה נופל

המודל רגיש מאוד לניסוח ההנחיות, אפילו יותר מגרסת 35B הקודמת, ומחייב הגדרה מדויקת של אילוצים ופורמט בהוראת המערכת כדי לא להתפזר. פקודות רכות לכיבוי חשיבה כבר לא נתמכות, ויש צורך להגדיר זאת ישירות דרך הפרמטרים של תבנית השיחה. בנוסף, הרחבת הקונטקסט באמצעות YaRN פוגעת בביצועים בקטעים קצרים, ולכן מומלץ להפעיל אותה רק כשחייבים יותר ממאתיים שישים אלף טוקנים.

שאלות
נפוצות

איך מכבים את מנגנון החשיבה אם צריך תשובות מהירות?

המודל אינו מגיב לפקודות טקסט כמו think. יש להעביר משתנה מתאים בתבנית השיחה, או לכבות את אפשרות הנימוק בהגדרות הממשק שבו אתם מריצים אותו.

למה התמונות לא עובדות לי בהרצה מקומית?

היכולת החזותית דורשת קובץ נוסף בשם mmproj שנמצא בעמוד ההורדות. יש להוסיף אותו לפקודת ההרצה לצד קובץ המודל הראשי.

איך מריצים

את המודל מריצים מקומית באמצעות סביבות תומכות GGUF כמו llama.cpp או LM Studio. גרסת הקוונטיזציה המומלצת לרוב השימושים, Q4_K_P, שוקלת 18 גיגהבייט ודורשת כרטיס מסך עם 24 גיגהבייט זיכרון כדי להשאיר מקום לקונטקסט ולתהליך החשיבה. מי שמחזיק יותר זיכרון יכול לבחור בגרסת Q8_K_P ששוקלת 32 גיגהבייט. אם אין לכם חומרה ייעודית עם כרטיס חזק, תשלום על שרת מרוחק או שימוש בספק חיצוני יהיו זולים ומהירים בהרבה מהרצה מקומית צולעת.

ollama run hf.co/HauhauCS/Qwen3.6-27B-Uncensored-HauhauCS-Balanced:Q6_K_P

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

רישיון אפאצ'י שתיים אפס מתיר שימוש מסחרי חופשי, שינוי של הקוד והפצה פנימית או חיצונית כחלק ממוצר. התנאי היחיד הוא שמירה על הצהרת זכויות היוצרים המקורית וציון השינויים שבוצעו בקבצים.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗