GPT
G

Gemma4-26B-A4B-QAT-Uncensored-HauhauCS-Balanced-MTP

קוד פתוח

HauhauCSgemma2026-06-24

  • gguf
  • uncensored
  • gemma4
  • moe
  • vision

גרסה נטולת סירובים של ג'מא 4 שכוללת יכולות ראייה והאצה. מי שיוריד אותה מחפש מודל שלא עוצר על כל פרומפט רגיש ומספק קצב הפקה מהיר.

  • 17.0 GBמשקל הקבצים
  • 486,790הורדות בחודש
  • 222לייקים

מה זה

מדובר בהסבה של ג'מא 4 בגודל עשרים ושישה מיליארד פרמטרים עם ארבעה מיליארד מופעלים בכל טוקן, בארכיטקטורת תערובת מומחים של מאה עשרים ושמונה מומחים. המטרה כאן ברורה, להסיר את הסירובים המובנים בלי לפגוע ביכולות הבסיס של המקור. היוצר בדק ארבע מאות שישים וחמישה מבחני סירוב וקיבל אפס חסימות בשימוש רגיל, אם כי יש מקרים בודדים שדורשים ניסוח מחדש.

השחרור הזה מגיע עם ראש חיזוי מרובה טוקנים ייעודי לפענוח ספקולטיבי, שמביא לשיפור של כשלושים וחמישה אחוז במהירות הריצה בלי לשנות את איכות הפלט. מעבר לכך, יש כאן תמיכה מלאה בעיבוד תמונה דרך קובץ פרוז'קטור נפרד, וחלון הקשר עצום של מאתיים חמישים וששה אלף טוקנים.

מתאים ל

  • סוכני פיתוח קוד

    מאפשר תהליכי עבודה אוטונומיים בלי חשש שהמודל יסרב לנתח קוד אבטחה או סקריפטים רגישים.

  • ניתוח מסמכים ותמונות

    שילוב קובץ הראייה מאפשר לפענח תמונות ודיאגרמות לצד טקסט ארוך בחלון של מאתיים חמישים וששה אלף טוקנים.

  • הסקה מהירה מקומית

    שימוש בראש הפענוח הספקולטיבי מספק קיצור זמנים של כשלושים וחמישה אחוז בריצה על חומרה מקומית.

איפה זה נופל

המודל תומך רשמית באנגלית בלבד ולא מיועד לעברית. למרות התוצאה של אפס סירובים במבחן, היוצר מציין שיש עדיין מקרי קצה שבהם המודל מתחמק במענה הראשון ודורש ניסוח מחדש או מסגור עקיף. כמו כן, קיים באג מוכר של קריסות בריבוי כרטיסים תחת מצב מסוים בתוכנת LM Studio שדורש עקיפה ידנית בהגדרות ההרצה.

שאלות
נפוצות

האם יש גרסאות כימות אחרות להורדה?

לא, היוצר שחרר רק קובץ בכימות ארבע ביט. המודל עבר אימון מותאם לכימות מראש, ולכן גרסאות כבדות יותר רק יוסיפו משקל בלי לתת שיפור אמיתי באיכות התוצאה.

האם חייבים להשתמש בקובץ הראייה כדי להריץ טקסט?

לא. קובץ הראייה שוקל 1.2 גיגה בייט והוא נפרד לחלוטין. אם אתם צריכים רק שיחה או קוד, אפשר לטעון את קובץ הטקסט הראשי בלבד ולחסוך מקום בזיכרון.

איך מריצים

קובץ המודל העיקרי שוקל 16.8 גיגה בייט בכימות של ארבע ביט, קובץ הראייה מוסיף 1.2 גיגה בייט, וראש החיזוי תופס עוד 252 מגה בייט. בשביל להריץ הכל מקומית על כרטיס בודד בטעינה מלאה לזיכרון תצטרכו לפחות עשרים וארבעה גיגה בייט של וידאו ראם. llama.cpp מריץ אותו ישירות מהטרמינל עם הפקודות המתאימות לקובץ הדראפט והתמונה.

אם אתם עובדים עם LM Studio בריבוי כרטיסי מסך, שימו לב שהמודל הזה נוטה לקרוס במצב של חלוקת טנסורים, ולכן מומלץ להישאר על כרטיס אחד או חלוקת שכבות. אם אין לכם את החומרה המתאימה להחזיק כמעט שמונה עשר גיגה בייט בזיכרון הגרפי, עדיף להשתמש בשרת מרוחק.

ollama run hf.co/HauhauCS/Gemma4-26B-A4B-QAT-Uncensored-HauhauCS-Balanced-MTP:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הרישיון המדווח הוא רישיון ג'מא של גוגל. הוא מתיר שימוש מסחרי ומחקר אך כפוף למדיניות השימוש המקובל וההגבלות המשפטיות של גוגל על משפחת המודלים הזו. אם אתם משלבים אותו במוצר, עליכם לוודא שהשימוש שלכם תואם לתנאי המקור של גוגל.

  • שימוש מסחרי
  • שינוי הקוד
  • כפוף לתנאי השימוש של Google

הרישיון המלא בעמוד המודל ↗