GPT
G

gemma-4-26B-A4B-it-heretic-APEX-GGUF

קוד פתוח

mudlergemma2026-04-05

  • gguf
  • quantized
  • apex
  • moe
  • mixture-of-experts

גרסה מכווצת של ג'מה 4 שעברה הסרת סירובים מכוונת, בארכיטקטורת מומחים. מורידים אותה כשצריכים מודל שלא יטיף מוסר אבל ישמור על ביצועים טובים בחומרה ביתית.

  • 117 GBמשקל הקבצים
  • 22,959הורדות בחודש
  • 53לייקים

מה זה

מדובר במודל שמבוסס על מבנה של מומחים, עם עשרים ושישה מיליארד פרמטרים בסך הכול אבל רק ארבעה מיליארד פעילים בכל טוקן. המשמעות היא מהירות תגובה גבוהה בהרבה ממודל צפוף בגודל מקביל. בנוסף, הוא כולל יכולת עיבוד תמונה מובנית עם קובץ ייעודי.

הייחוד כאן מגיע משני כיוונים. הראשון הוא תהליך הדה-צנזורה שבוצע על שכבות עשר עד שלושים באמצעות כלי שנקרא הריטיק, במטרה לצמצם סירובים של המודל למינימום בלי להרוס את איכות התשובות, עם מרחק סטטיסטי של פחות מנקודה אפס חמש מהמקור. השני הוא שיטת הכיול שנקראת אפקס, שדוחסת יותר את שכבות האמצע ושומרת על דיוק גבוה בשכבות הקצה.

מתאים ל

  • עבודה מול טקסטים רגישים

    ניתוח מסמכים או תסריטים שמודלים רגילים מסרבים לגעת בהם בגלל מילות מפתח.

  • עיבוד תמונה מקומי ופרטי

    הרצה מקומית מלאה שכוללת זיהוי והבנת תמונות על גבי כרטיס מסך יחיד.

  • עוזר פיתוח וכתיבת קוד

    כיול המטריצה הייעודי מספק שמירה על יכולות לוגיות בלי התערבויות מיותרות.

איפה זה נופל

הכרטיס מודה שאין עדיין מבחני ביצועים רשמיים ספציפיים לגרסה הזו, והנתונים נשענים על מדידות של ארכיטקטורה מקבילה. הסרת מנגנוני הסירוב עלולה לייצר פלט לא יציב, תשובות פוגעניות או הזיות בתחומים רגישים, כי הבלמים המקוריים של גוגל נוטרלו. בנוסף, אם תרצו ניתוח תמונה, חובה לטעון ידנית קובץ נוסף של מעבד הראייה ששוקל יותר מג'יגה מעבר לקובץ הטקסט הראשי.

שאלות
נפוצות

איזו גרסה של הקובץ כדאי להוריד?

הקובץ המאוזן עם מטריצת החשיבות מספק את היחס הכי טוב בין משקל של תשעה עשר ג'יגה לדיוק הפלט. אם הזיכרון בכרטיס לחוץ, עדיף לרדת לקומפקט ששוקל חמישה עשר ג'יגה.

האם המודל דורש הגדרות מיוחדות בשביל תמונות?

כן, קובץ הטקסט לבדו לא מפענח תמונות. חייבים להוריד ולהגדיר בתוכנת ההרצה גם את קובץ הפרויקטור הנפרד ששוקל נקודה שתיים ג'יגה-בייט.

איך מריצים

המודל מגיע בפורמט שמתאים לטעינה מקומית, למשל דרך לוקאל-איי-איי או תוכנות מבוססות לאמה-סי-פי-פי. הקבצים נעים בין שלושה עשר ג'יגה-בייט לגרסת המיני ועד עשרים ג'יגה-בייט לפרופיל האיכות הגבוה. גרסאות עם האות איי משתמשות במטריצת חשיבות שנבנתה מנתוני שיחה, קוד והיגיון, ולכן עדיפות על הגרסאות הרגילות באותו משקל.

בשביל להריץ אותו בנוחות תצטרכו כרטיס מסך של שישה עשר ג'יגה-בייט זיכרון לפחות עבור הגרסאות הקומפקטיות, או עשרים וארבעה ג'יגה-בייט אם מכוונים לגרסת האיזון והאיכות המלאה יחד עם מודול התמונה. אם אין לכם חומרה כזו עם מספיק זיכרון וידאו, זול ופשוט יותר לפנות לשירות ענן.

ollama run hf.co/mudler/gemma-4-26B-A4B-it-heretic-APEX-GGUF:gemma-4-26B-A4B-heretic-APEX-I-Compact

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הפרויקט מופץ תחת רישיון ג'מה של גוגל. הרישיון מאפשר שימוש חופשי ופיתוח מסחרי תחת תנאי השימוש והמגבלות של גוגל, אבל השינויים שבוצעו להסרת מנגנוני הבטיחות עשויים להתנגש עם מדיניות השימוש המקורית של המפיצה.

  • שימוש מסחרי
  • שינוי הקוד
  • כפוף לתנאי השימוש של Google

הרישיון המלא בעמוד המודל ↗