GPT
G

gemma-4-E4B-it-GGUF

קוד פתוח

ggml-orgapache-2.02026-04-01

  • gguf
  • quantized
  • any-to-any
  • endpoints_compatible
  • conversational

גרסת GGUF מוכנה לשימוש עצמאי של מודל ההוראות מסדרת ג'מה 4. היא מיועדת למי שרוצה להריץ משימות מולטימודליות של כל קלט לכל פלט על תשתית מקומית.

  • 27.5 GBמשקל הקבצים
  • 829,720הורדות בחודש
  • 84לייקים

מה זה

מדובר בהמרה שביצע צוות ggml למודל gemma-4-E4B-it של גוגל, שמסווג כמודל any-to-any. ההמרה הזו מיועדת לעבודה ישירה עם כלי האקוסיסטם של llama.cpp, מה שמקל על שילוב שלו בצד שרת או באפליקציות מקומיות בלי להסתבך עם ספריות כבדות.

הכרטיס לא מפרט מדדי ביצועים או מבחני השוואה, כך שקשה לדעת בדיוק איך הוא מתפקד ביחס למודלים מקבילים באותו סדר גודל. מה שכן ברור זה שהמאגר כולל 12 קבצים ומבוסס על מספר גרסאות מקור של גוגל, כולל גרסאות שעברו אימון ייעודי כעוזרים וגרסאות עם קוונטיזציה מובנית.

מתאים ל

  • שרת הסקה פנימי

    הרצה מקומית דרך llama.cpp בארגונים שדורשים שהמידע לא ייצא החוצה לספקי ענן.

  • עיבוד מולטימודלי

    בניית תהליכים של קלט ופלט מגוונים על בסיס ארכיטקטורת any-to-any של גוגל.

  • בדיקות ופיתוח

    בחינת יכולות הסדרה של ג'מה 4 בסביבת פיתוח מקומית בלי תלות ברשת.

איפה זה נופל

דף המודל כמעט ריק ממידע טכני מהותי, והיוצרים עצמם סימנו להוסיף פרטים בעתיד. אין כאן שום תיעוד לגבי היכולות בעברית, מגבלות בטיחות, או נתונים על אורך ההקשר. המודל הומר באופן אוטומטי, ולכן חובה להריץ בדיקות קונקרטיות על הנתונים שלכם לפני שחושבים להכניס אותו למערכת פעילה.

שאלות
נפוצות

האם המודל תומך בעברית בצורה טובה?

דף המודל לא מציין דבר לגבי שפות נתמכות או איכות הפלט בעברית. צריך להוריד את הקבצים ולבדוק את הביצועים ישירות מול הטקסטים שלכם.

איך אפשר להריץ אותו בקלות?

היוצרים ממליצים להשתמש באפליקציית llama.app או להריץ את הפקודה llama serve ישירות מול המאגר ב־Hugging Face.

איך מריצים

כדי להפעיל את המודל בפועל, ggml ממליצים להשתמש ישירות בפקודה llama serve עם מזהה המאגר. נפח הקבצים הכולל עומד על 27.5 ג'יגה בייט, כך שצריך לוודא שיש לכם מספיק שטח אחסון וזיכרון עבודה כדי לטעון אותו, בין אם בזיכרון הכללי של המחשב ובין אם בזיכרון של כרטיס המסך.

אם אין לכם חומרה ייעודית עם זיכרון מתאים, הרצה מקומית עלולה להיות אטית מאוד. במקרים כאלה עדיף לבדוק פתרונות ענן או שירותי API מנוהלים במקום להחזיק שרת יקר באופן קבוע.

ollama run hf.co/ggml-org/gemma-4-E4B-it-GGUF:Q4_0

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

המאגר מופץ תחת רישיון apache-2.0. הרישיון הזה מתיר שימוש מסחרי מלא, שינוי של הקוד והמשקלים, והפצה מחדש. הדרישה העיקרית היא לשמור על הצהרת זכויות היוצרים והודעת הרישיון המקורית.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗