GPT
G

Gemma4-26B-A4B-Uncensored-HauhauCS-Balanced

קוד פתוח

HauhauCSapache-2.02026-05-14

  • gguf
  • uncensored
  • gemma4
  • moe
  • vision

גרסה נטולת סירובים למודל התמונות והטקסט של גוגל, שמפעילה רק 3.8 מיליארד פרמטרים בכל מעבר. היא מיועדת למי שמחפש מודל יצירתי שלא חוסם בקשות רגישות אבל שומר על מבנה חשיבה מסודר.

  • 184 GBמשקל הקבצים
  • 75,541הורדות בחודש
  • 268לייקים

מה זה

מדובר בהסבה של המודל המקורי לתצורה נטולת צנזורה, בלי לגעת במאגרי המידע או ביכולות הבסיס שלו. המודל בנוי בארכיטקטורת תערובת מומחים עם 25.2 מיליארד פרמטרים בסך הכל, אך בכל רגע נתון פועלים רק כארבעה מיליארד דרך שמונה מומחים נבחרים מתוך 128. המבנה הזה נותן מהירות תגובה של מודל קל יחד עם עומק מחשבה של מודל גדול בהרבה.

גרסת הבלנסד לא זורקת תשובות ישירות בלי לחשוב. במקרים של בקשות גבוליות היא עשויה לצרף מסגור בטיחות קצר או לשכנע את עצמה דרך מנגנון החשיבה לפני שהיא פולטת את התשובה המלאה. במבחני סירוב היא השיגה אפס מתוך 465 חסימות, כאשר במקרים נדירים שבהם יש התחמקות בניסיון הראשון, שאלה חוזרת פותרת את העניין.

המודל כולל תמיכה מובנית בקלט תמונות דרך קובץ הרחבה ייעודי, ומגיע עם חלון הקשר טבעי של 256 אלף טוקנים. הוא משלב שכבות קשב של חלון נע לצד שכבות קשב מלאות, מה שמונע אובדן עקביות בשיחות ארוכות ושומר על יציבות בדגימות חוזרות.

מתאים ל

  • כתיבה יצירתית ללא סירובים

    הוא מיועד במיוחד לטקסטים ספרותיים ומשחקי תפקידים שלא ייעצרו בגלל מנגנוני בטיחות מחמירים.

  • ניתוח תמונות בפרטיות מלאה

    שילוב קובץ הראייה מאפשר להריץ פענוח של תמונות ומסמכים מקומית על כרטיס מסך בודד של 24 גיגה.

  • מחקר אבטחה ושאילתות רגישות

    הוא מסוגל לספק מענה מלא בנושאי בדיקות חדירה ומחקר בלי לחסום מונחים טכניים לגיטימיים.

איפה זה נופל

היוצר מציין במפורש שבמשימות קוד ושימוש בכלים מורכבים, מודלים מסדרת קוון 3.6 מציגים ביצועים עדיפים. המודל הזה לא נבנה כמתכנת אוטונומי מוביל. בנוסף, הוא מוגדר רק לשפה האנגלית, ולכן ביצועים בעברית אינם מובטחים ועשויים לקרטע. יש גם לקחת בחשבון שבקשות קיצוניות מסוימות עלולות עדיין להתחמק בתשובה הראשונה ולדרוש ניסוח מחדש.

שאלות
נפוצות

האם המודל יסרב לענות על נושאים רגישים?

ברוב המוחלט של המקרים הוא לא מסרב כלל, ובבדיקות של היוצר הגיע לאפס סירובים מתוך מאות בדיקות. עם זאת, בגלל שמדובר בגרסה מאוזנת, הוא עשוי לנמק לעצמו את התשובה קודם או להוסיף הערת מסגור קצרה, ובמקרים נדירים יידרש ניסוח השאלה פעם נוספת.

איזה כרטיס מסך צריך כדי להריץ אותו כמו שצריך?

עבור הגרסה המומלצת ברמת כיול בינונית, נדרש כרטיס מסך עם לפחות 24 גיגה בייט זיכרון גרפי. הקובץ עצמו תופס 17 גיגה בייט, והיתרה הכרחית כדי להחזיק את קובץ התמונות ואת חלון ההקשר הגדול בזמן העבודה.

איך מריצים

המודל מופץ כקבצי שקילה מכוילים המותאמים להרצה מקומית בכלים כמו llama.cpp או LM Studio. גרסת Q4_K_P שוקלת 17 גיגה בייט ודורשת כרטיס מסך עם 24 גיגה בייט זיכרון כדי להשאיר מקום נוח לחלון ההקשר, בעוד גרסת Q8_K_P מגיעה ל־27 גיגה בייט ומיועדת למי שמחזיק חומרה כבדה יותר.

כדי לעבד תמונות חייבים לטעון במקביל את קובץ הראייה ששוקל 1.2 גיגה בייט, ולהקפיד להציב את התמונה לפני הטקסט בבקשה. בריצת פקודה ישירה חשוב להפעיל תמיכה בתבנית ג'ינג'ה ולהגדיר לפחות 32 אלף טוקנים של הקשר. אפשר לכבות את מנגנון החשיבה בהגדרות התבנית לקבלת תשובות קצרות ומהירות יותר.

ollama run hf.co/HauhauCS/Gemma4-26B-A4B-Uncensored-HauhauCS-Balanced:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הפרויקט מפורסם תחת רישיון אפאצ'י 2.0, שמאפשר שימוש חופשי לצרכים פרטיים ומסחריים, כולל שינוי הקוד והפצתו. תנאי הרישיון דורשים שמירה על הקרדיט והצהרות הזכויות המקוריות. אין מגבלות מסחריות מיוחדות, וניתן להטמיע את הקבצים במוצרים פנימיים או שירותים חיצוניים ללא תשלום תמלוגים.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗