GPT
G

gemma-4-31b-it-4bit

קוד פתוח

mlx-communityapache-2.02026-04-02

  • mlx
  • safetensors
  • gemma4
  • image-text-to-text
  • conversational

גרסה מכווצת בארבעה ביטים של מודל ראייה ושפה מבית גוגל, מותאמת ישירות לריצה מקומית על מחשבי אפל. היא נותנת מענה למי שרוצה לעבד תמונות וטקסט בלי להוציא מידע לענן.

  • 31Bפרמטרים
  • 262,144טוקנים בהקשר
  • 17.2 GBמשקל הקבצים
  • 43,475הורדות בחודש

מה זה

מדובר בהמרה של גוגל ג'מה המיועדת לספריית MLX, עבור משימות של שילוב בין תמונה לטקסט. המודל בנוי על ארכיטקטורת Gemma4ForConditionalGeneration ומכיל מעל 31 מיליארד פרמטרים, אבל בזכות הדחיסה לארבעה ביטים המשקל שלו יורד לנפח קבצים כולל של 17.2 גיגה בייט.

הוא מסוגל לקבל תמונה והוראה כתובה, ולפלוט תשובה טקסטואלית ברצף עבודה מקומי. היתרון המשמעותי כאן הוא חלון הקשר של 262,144 טוקנים, שמאפשר להזין היסטוריה ארוכה מאוד או טקסטים נרחבים סביב התמונות, בלי להיחנק ממגבלות זיכרון של מודלים קטנים יותר מהדורות הקודמים.

מתאים ל

  • ניתוח מסמכים ותמונות

    קריאת תוכן מתוך צילומים מקומיים יחד עם הנחיות מורכבות, בלי לשלוח את המידע לשרתים חיצוניים.

  • תיאור תמונות אוטומטי

    יצירת כיתובים ותיאורים מפורטים לקובצי מדיה מתוך סקריפט מקומי בעזרת פקודה פשוטה בטרמינל.

  • פיתוח יישומי ראייה למק

    בניית אפליקציות שרצות על חומרת אפל ומשתמשות בספריית MLX כדי לקבל תגובות ראייה וטקסט ישירות מהמכשיר.

איפה זה נופל

כרטיס המודל מינימליסטי מאוד ולא חושף מבחני ביצועים, מדדי שגיאה או פירוט לגבי שפות נתמכות. הדחיסה לארבעה ביטים תמיד גובה מחיר מסוים באיכות הדיוק של התשובות ובהבנת פרטים קטנים בתמונות מורכבות. חובה לבדוק אותו עצמאית מול תמונות אמיתיות מהמוצר שלכם, במיוחד אם אתם בונים על עברית, לפני שמסתמכים עליו.

אותה משפחה

gemma-4 יצא ב־3 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם המודל הזה יעבוד על מחשב עם כרטיס מסך של אנבידיה?

לא באופן ישיר. הפורמט של MLX נבנה ספציפית למעבדי אפל סיליקון. לכרטיסי מסך אחרים תצטרכו להוריד את הגרסה המקורית של גוגל ממאגר המקור.

כמה מקום בדיסק צריך בשביל ההורדה?

המשקל הכולל של הקבצים עומד על 17.2 גיגה בייט המחולקים לשלושה עשר קבצים. כדאי לוודא שיש לכם מספיק שטח אחסון פנוי מעבר לגודל הזה לצורך ההרצה עצמה.

איך מריצים

כדי להריץ אותו מתקינים את חבילת mlx-vlm בפייתון, ומפעילים את פקודת mlx_vlm.generate עם הנתיב לתמונה, הטמפרטורה וכמות הטוקנים המבוקשת. ההרצה דורשת מחשב מק עם מעבד אפל סיליקון וזיכרון אחוד שיכול להחזיק קבצים של 17.2 גיגה בייט לצד מערכת ההפעלה ופעולת המודל.

אם אין לכם חומרה כזו של אפל, אין טעם לנסות להריץ את קובצי ה־MLX האלה. במקרה שאין ברשותכם את המחשב המתאים, עדיף לפנות למודל המקורי דרך שירות ענן או API חיצוני במקום לנסות להסב אותו ידנית לסביבות אחרות.

pip install -U huggingface_hub
hf download mlx-community/gemma-4-31b-it-4bit

הרישיון

המודל מופץ תחת רישיון apache-2.0, שמאפשר שימוש חופשי כולל שימוש מסחרי מלא. מותר לשנות את הקוד, לשלב אותו במוצרים פנימיים או מסחריים ולהפיץ אותו הלאה, כל עוד שומרים על הודעת זכויות היוצרים ותנאי הרישיון המקוריים.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗