GPT
G

granite-4.0-1b

קוד פתוח

ibm-graniteapache-2.02025-10-07

  • transformers
  • safetensors
  • granitemoehybrid
  • text-generation
  • language

מודל הוראות קטן במיוחד שנועד לרוץ מקומית על חומרה בסיסית. הוא מציע חלון הקשר ענק של 131,072 טוקנים, תמיכה בקריאת פונקציות וביצועי קוד טובים לגודלו.

  • 1.6Bפרמטרים
  • 131,072טוקנים בהקשר
  • 3.0 GBמשקל הקבצים
  • 19,332הורדות בחודש

מה זה

מדובר במודל שפת הוראות קומפקטי של חברת IBM, המבוסס על כ־1.6 מיליארד פרמטרים. הוא נבנה עבור משימות מקומיות על גבי מכשירי קצה, ומביא יכולות כמו מענה על שאלות, חילוץ מידע, סיווג, סיכום, ותמיכה בהשלמת קוד והפעלת פונקציות לפי המבנה של OpenAI. היתרון הבולט שלו לעומת מודלים זעירים אחרים הוא שילוב של חלון הקשר עצום ויכולות קוד מפתיעות.

במבחני הביצועים של היצרן, המודל מציג 74% ב־HumanEval וציון של 80.82 במעקב מדויק אחרי הוראות לפי IFEval. המשמעות היא שבתסריטים ממוקדים של אוטומציה או סיוע בכתיבת פונקציות קצרות הוא מגיב טוב מאוד לגודלו. עם זאת, במבחני חשיבה מורכבים כמו GPQA הוא מגיע רק ל־29.91%, וב־BigCodeBench ל־30.18%, כך שאין לצפות ממנו לתכנון ארכיטקטורה או פתרון בעיות לוגיות עמוקות.

מתאים ל

  • השלמת קוד מקומית

    מתאים כעוזר פיתוח בסביבת העבודה בזכות 74% ב־HumanEval ותמיכה ב־FIM.

  • סיווג וחילוץ בתוך RAG

    רץ מקומית על טקסטים ארוכים בזכות הקשר של 131K טוקנים בלי עלויות ענן.

  • סוכן מקומי להפעלת פקודות

    מתאים להמרת פקודות טקסט של משתמש לפורמט פונקציה פשוט ישירות על המכשיר.

איפה זה נופל

המודל אינו תומך בעברית, והרשימה הרשמית כוללת שתים עשרה שפות כמו אנגלית, גרמנית, ערבית וצרפתית. מבחני הכלים מציגים ציון של 54.82 בלבד ב־BFCL v3, מה שאומר שכמעט בחצי מהמקרים קריאות לפונקציות חיצוניות עלולות להיכשל. בנוסף, במשימות היגיון ומתמטיקה מורכבות הציונים נמוכים מאוד, ולכן אסור להסתמך עליו כמנוע קבלת החלטות עצמאי במוצר.

אותה משפחה

granite-4.0 יצא ב־2 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם המודל מבין ופולט עברית באופן רשמי?

לא. רשימת השפות הנתמכות כוללת אנגלית, שפות אירופיות, ערבית ושפות אסייתיות, אך עברית אינה מופיעה בה. כדי לעבוד איתו בעברית תצטרכו לאמן אותו מחדש.

האם אפשר להסתמך עליו להפעלת API חיצוני ומורכב?

לא מומלץ. התוצאה שלו במבחן BFCL עומדת על 54.82%, כך שבמקרים רבים הוא יטעה במבנה הפרמטרים או בזיהוי הפונקציה המתאימה. למשימות מורכבות עדיף מודל גדול יותר.

איך מריצים

המודל שוקל 3.0 גיגה בייט בפורמט bfloat16, כך שאפשר להריץ אותו בקלות על כרטיס מסך ביתי בסיסי ביותר, על מחשב נייד או אפילו ישירות על מעבד מרכזי בלי להיחנק. הטעינה נעשית ישירות דרך ספריית transformers של פייתון, יחד עם accelerate ו־torch.

הוא מתאים במיוחד לפיתוח מקומי, עבודה אופליין או הטמעה כרכיב עזר שרץ ברקע של מוצר. אם הצוות שלכם צריך לפתור בעיות היגיון סבוכות או לנתח מסמכי ענק בלי להחזיק תשתית, עדיף לקרוא ל־API של מודל ענן גדול, אבל למשימות מוגדרות ומהירות אין סיבה לשלם לספק חיצוני.

from transformers import pipeline

pipe = pipeline("text-generation", model="ibm-granite/granite-4.0-1b")
print(pipe("שלום"))

הרישיון

המודל מופץ תחת רישיון apache-2.0. מותר להשתמש בו לצרכים מסחריים, לשנות אותו, לאמן אותו מחדש ולהפיץ אותו כחלק ממוצר סגור או פתוח, כל עוד שומרים על הודעת זכויות היוצרים המקורית.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗