GPT
G

lmstudio-community/gemma-4-E4B-it-GGUF

קוד פתוח

lmstudio-communityapache-2.02026-04-01

  • gguf
  • endpoints_compatible
  • conversational

גרסת GGUF מוכנה לריצה מקומית של מודל ההוראות מבית גוגל. מתאימה למי שרוצה לעבוד עם llama.cpp בלי להתעסק בהמרות ובכיולים ידניים.

  • 19.2 GBמשקל הקבצים
  • 624,024הורדות בחודש
  • 69לייקים

מה זה

מדובר באריזה של מודל ההוראות gemma-4-E4B-it שיצרה גוגל, לאחר המרה לפורמט GGUF בידי הצוות של LM Studio באמצעות גרסה b10069 של llama.cpp. המטרה כאן ברורה: לתת לכם קבצים שאפשר לטעון ישירות לכלים שתומכים בפורמט הזה, בלי שתצטרכו לקמפל או להמיר בעצמכם ממשקולות המקור של גוגל.

הכרטיס הנוכחי לא מציג מבחני ביצועים, מדדי השוואה או מספרים על זיכרון עבודה. הדגש העיקרי הוא הנגשה מהירה של מודל שיחה מכוונן של גוגל ישירות לחומרה ביתית או לשרת מקומי, כשהעבודה הטכנית של ההמרה כבר בוצעה ונבדקה על ידי הקהילה.

מתאים ל

  • ריצה מקומית בתוכנות GGUF

    טעינה ישירה לכלים מבוססי llama.cpp בלי צורך בתהליך המרה עצמאי.

  • ניסויי מעבדה ופיתוח

    בדיקת יכולות המודל של גוגל על חומרה מקומית וללא תלות בחיבור רשת.

  • שילוב במוצרים מסחריים

    הפצה כחלק מפתרון עצמאי בזכות רישיון apache-2.0 המתירני.

איפה זה נופל

הכרטיס מבהיר במפורש ש־LM Studio לא לוקחת שום אחריות על הפלטים, הדיוק או האמינות של המודל, ומזהירה שהוא עלול לייצר תוכן פוגעני, מטעה או שגוי. אין כאן נתונים לגבי יכולות המודל בעברית, חלון ההקשר המדויק או מגבלות חשיבה ספציפיות, ולכן חובה לבדוק אותו על המשימות שלכם לפני שמשלבים אותו במערכת אמיתית.

שאלות
נפוצות

איך טוענים את המודל למחשב?

מורידים את הקבצים וטוענים אותם ישירות לתוך llama.cpp או לתוכנות תואמות כמו LM Studio. אין צורך להריץ סקריפטים של המרה.

האם המודל מגיע עם תמיכה מובטחת של גוגל?

לא, מדובר בהמרה קהילתית שפורסמה בידי LM Studio. הכרטיס מדגיש שאין אחריות על תקינות המודל או על התוכן שהוא מייצר.

איך מריצים

המשקל הכולל של הקבצים מגיע ל־19.2 גיגה בייט בשישה קבצים שונים. תצטרכו נפח אחסון פנוי וכרטיס מסך עם מספיק זיכרון כדי להחזיק את הקובץ שתבחרו, או לחלופין מעבד חזק עם זיכרון מערכת נדיב שיוכל לטעון את המשקולות דרך llama.cpp.

אם יש לכם מחשב פשוט ללא כרטיס גרפי ייעודי, עדיף להשתמש ב־API מרוחק במקום לנסות להריץ מודלים כאלה מקומית ולקבל מהירות הפקה אטית מדי.

ollama run hf.co/lmstudio-community/gemma-4-E4B-it-GGUF:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הקבצים

6 קבצים במאגר, 19.2 GB סך הכול. הקישורים מובילים ישירות ל־Hugging Face.

הרישיון

הפרויקט מופץ תחת רישיון apache-2.0. הרישיון הזה מתיר שימוש מסחרי מלא, שינוי של הקוד והפצה חוזרת, בתנאי ששומרים על הודעות זכויות היוצרים וכתב הוויתור על האחריות.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗