GPT
G

gemma-3-270m-it-GGUF

קוד פתוח

unslothgemma2025-08-13

  • transformers
  • gguf
  • gemma3
  • unsloth
  • gemma

גרסת GGUF מכווצת של מודל שפה זעיר עם 270 מיליון פרמטרים. פתרון מתאים למי שרוצה להריץ מודל מקומית על חומרה חלשה או ישירות בתוך אפליקציות קצה.

  • 5.9 GBמשקל הקבצים
  • 77,884הורדות בחודש
  • 173לייקים

מה זה

גוגל אימנו את המודל הזה על 6 טריליון טוקנים עם חלון הקשר של 32K, והוא מגיע מכוונן לפקודות בפורמט שמתאים לספריות הרצה מקומיות. הוא פותח במקור כחלק ממשפחת מודלים מולטימודלית שכוללת תמיכה בלמעלה מ־140 שפות, אם כי בגודל הזה מדובר במודל שמתמקד בטקסט בלבד.

במדדי ביצועים הוא משיג 51.2 בציות להוראות ו־26.7 במבחני חשיבה קשים. המשמעות ברורה. הוא לא יפתור בעיות לוגיות סבוכות ולא ינתח מסמכים משפטיים מורכבים. לעומת זאת, למשימות ממוקדות כמו מיון טקסט, תיוג או ניסוח תבניות פשוטות, הוא נותן מענה יעיל בגודל פיזי מינימלי.

מתאים ל

  • סיווג טקסטים מהיר

    זיהוי כוונות וקטגוריות קצרות על גבי מעבד מקומי בלי תלות ברשת.

  • מערכות קצה וסלולר

    הרצה מקומית על מכשירים בעלי זיכרון מוגבל בלי עלויות שרת.

  • מילוי תבניות וטפסים

    חילוץ נתונים מובנים ופשוטים מתוך פניות קצרות של משתמשים.

איפה זה נופל

הגודל הזעיר גובה מחיר כבד ביכולות. המודל קיבל ציון של 26.7 בלבד ב־BIG-Bench Hard ו־28.2 ב־ARC-c, כך שאי אפשר להסתמך עליו בפתרון בעיות, הסקת מסקנות או ידע כללי מעמיק. בניגוד לגרסאות הגדולות בסדרה, הגרסה הזו מוגבלת ל־32K טוקנים ואינה תומכת בקלט של תמונות. הוא דורש בדיקה קפדנית של הזיות וטעויות ניסוח לפני שמשלבים אותו בזרימת עבודה.

אותה משפחה

gemma-3 יצא ב־6 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם המודל הזה מסוגל לקבל תמונות כמו שאר דגמי הסדרה?

לא. היכולות המולטימודליות של עיבוד תמונות שמורות לגדלים של 4B ומעלה. גרסת ה־270M מקבלת ומייצרת טקסט בלבד.

האם אפשר לאמן אותו מחדש על נתונים פרטיים?

כן. יוצרי המאגר סיפקו מחברת עבודה להרצת כוונון עדין על המודל הזה דרך Google Colab, כך שאפשר להתאים אותו למשימות ייעודיות בקלות.

איך מריצים

המודל מופץ בפורמט GGUF, מה שאומר שאפשר להריץ אותו ישירות על מעבד רגיל, טלפונים ניידים או שרתים זולים בלי כרטיס גרפי ייעודי. סך כל הקבצים במאגר שוקל 5.9 ג'יגה בייט ב־29 קבצים, והוא דורש זיכרון עבודה נמוך מאוד ביחס למודלים גדולים.

היוצרים ממליצים להריץ אותו עם הגדרות ספציפיות: טמפרטורה 1.0, ערך top_k של 64, ו־top_p של 0.95. אם המטרה שלכם היא משימות חשיבה מורכבות או קוד, חבל על זמן ההתעסקות בהרצה עצמית וכדאי לפנות ישירות ל־API של מודלים גדולים יותר.

ollama run hf.co/unsloth/gemma-3-270m-it-GGUF:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

השימוש כפוף לתנאי הרישיון של משפחת Gemma. מותר להשתמש בו לצרכים מחקריים ומסחריים, אך יש לציית למדיניות השימוש והבטיחות שהוגדרה על ידי גוגל DeepMind.

  • שימוש מסחרי
  • שינוי הקוד
  • כפוף לתנאי השימוש של Google

הרישיון המלא בעמוד המודל ↗