GPT
S

supergemma4-26b-uncensored-mlx-4bit-v2

קוד פתוח

Jiunsonggemma2026-04-10

  • mlx
  • safetensors
  • gemma4
  • uncensored
  • apple-silicon

גרסה מכוילת ולא מצונזרת של ג'מה בקורסור של אפל סיליקון. היא עוקפת את מודל המקור במהירות וביכולות תכנות, ורצה מקומית על מחשבי מק.

  • 25Bפרמטרים
  • 262,144טוקנים בהקשר
  • 13.3 GBמשקל הקבצים
  • 10,245הורדות בחודש

מה זה

הפיתוח הזה מבוסס על מודל הבסיס של גוגל בגודל עשרים וחמישה מיליארד פרמטרים, אבל עבר אופטימיזציה לספריית MLX וכיול שמסיר מגבלות תוכן. הוא שוקל כ־13.3 גיגה בייט בכימות של 4 ביט ומיועד לעבודה מקומית ישירות על החומרה של מק. בניגוד לגרסת המקור שמגיעה עם יכולות מולטימודליות, פה חתכו את כל מה שמסביב ונשארו עם מודל טקסט בלבד שמתמקד בלוגיקה ועבודה עם כלים.

בבדיקות הביצועים של היוצר הוא מוציא 46.2 טוקנים לשנייה לעומת 42.5 במודל הבסיס של גוגל, מה שמראה שהעבודה עליו לא פגעה בקצב. מבחינת ציונים, הקפיצה העיקרית מופיעה במשימות לוגיקה עם עלייה של 8.3 נקודות ובכתיבת קוד עם שיפור של 6.3 נקודות. המשמעות בפועל היא פחות הזיות כשמבקשים ממנו לתכנן מערכות או להריץ סקריפטים של אוטומציה בדפדפן.

מתאים ל

  • סוכן לפיתוח קוד במק

    רץ מהר מקומית בלי תשלום לפי טוקן, עם שיפור ניכר בביצועי תכנות ולוגיקה.

  • אוטומציה של משימות דפדפן

    מיושר ספציפית לעבודה עם כלים והפעלת פקודות מערכת ללא חסימות רשת.

  • עבודה על נתונים רגישים

    מאפשר עיבוד טקסט מלא בתוך הארגון בלי להוציא שאילתות לענן של חברות צד שלישי.

איפה זה נופל

המודל מוגדר רשמית רק לשפות אנגלית וקוריאנית, כך שעברית לא נתמכת כאן בצורה מובטחת ותדרוש בדיקה יסודית כדי לראות אם הוא בכלל מחזיר פלט הגיוני. בנוסף, חתכו ממנו לחלוטין יכולות ראייה וקריאת תמונות, אז הוא לא מתאים לעיבוד מסמכים סרוקים או צילומי מסך. היוצר מציין גם באג ידוע בהגדרת ה־chat template בזמן הרצה, שעלול לשבור את התשובות ולגרום לו לפלוט ג'יבריש אם מזינים נתיב לקובץ במקום לתת למערכת לזהות את התבנית המובנית לבד.

אותה משפחה

supergemma4-26b-uncensored יצא ב־2 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם אפשר להריץ את המודל הזה על שרת לינוקס עם כרטיס מסך של אנבידיה?

לא. הקבצים שמורים בפורמט MLX שמיועד אך ורק למעבדי אפל סיליקון על מערכת ההפעלה של מק. להרצה על אנבידיה צריך לחפש המרה בפורמט GGUF או משקלים רגילים של Hugging Face.

האם המודל יתמודד היטב עם טקסטים בעברית?

הכרטיס מצהיר על תמיכה באנגלית ובקוריאנית בלבד. הוא עשוי לפלוט עברית בזכות מודל הבסיס, אבל בלי כיול ייעודי הביצועים יהיו נמוכים והתחביר עלול להישבר לעיתים קרובות.

איך מריצים

כדי להריץ אותו צריך מק עם שבב אפל סיליקון ולפחות 16 גיגה זיכרון מאוחד, אם כי 24 גיגה או יותר יתנו מרחב נשימה סביר בהקשרים ארוכים. ההרצה נעשית דרך ספריית mlx_lm באמצעות פקודת שרת מקומי שפותחת ממשק תואם לפרוטוקול של OpenAI על פורט 8080. אין צורך לחבר מפתח חיצוני או לשלם פר קריאה, הכל רץ על המעבד הגרפי של המחשב.

אם יש לכם מחשב עם מעבד אינטל, כרטיס של אנבידיה או שרת לינוקס רגיל, הקבצים האלה פשוט לא יעבדו אצלכם. במקרה כזה, או אם אתם צריכים לשרת אלפי בקשות במקביל בלי לחנוק את המחשב האישי, עדיף להשתמש ב־API מנוהל של מודל מקביל.

pip install -U huggingface_hub
hf download Jiunsong/supergemma4-26b-uncensored-mlx-4bit-v2

הרישיון

הרישיון כאן הוא רישיון gemma של גוגל. מותר להשתמש בו לצרכים מסחריים ומחקר, אבל אתם מחויבים לתנאי השימוש והמדיניות המקורית של גוגל, שכוללת מגבלות סביב שימושים פוגעניים. העובדה שהמודל עבר הסרת צנזורה לא מבטלת את תנאי הבסיס הללו.

  • שימוש מסחרי
  • שינוי הקוד
  • כפוף לתנאי השימוש של Google

הרישיון המלא בעמוד המודל ↗