GPT
G

granite-4.2-3b

קוד פתוח

ibm-graniteapache-2.02026-08-07

  • transformers
  • safetensors
  • granite
  • text-generation
  • granite-4.2

מודל קומפקטי שמביא יכולות חשיבה מובנות של שרשרת מחשבה, ומיועד להריץ משימות היגיון וקריאות לכלים ישירות על חומרה מקומית קלה.

  • 3.7Bפרמטרים
  • 131,072טוקנים בהקשר
  • 6.8 GBמשקל הקבצים
  • 22,081הורדות בחודש

מה זה

מדובר במודל צפוף של כמעט 3.7 מיליארד פרמטרים מבית יבמ, שמכוון לפתרון בעיות מורכבות דרך מנגנון חשיבה מובנה בתגיות ייעודיות. בניגוד למודלים קטנים רגילים שפולטים תשובה מיד, הוא מחשב שלבי ביניים לפני שהוא עונה, ומאפשר לשלוט בעומק המאמץ הזה לפי הצורך. יש לו תמיכה מובנית בחלון של 131,072 טוקנים עם אפשרות הרחבה לטווח ארוך יותר.

במבחני ביצועים הוא מראה נקודות חוזק ברורות במתמטיקה עם 78.33 במבחן AIME25, וציון של 69.71 בבדיקת קוד של LiveCodeBench. מצד שני, משימות תכנות תשתיתיות כמו SWE Bench סומנו כלא ישימות עבורו, מה שממחיש שהוא מסוגל לייצר קטעי קוד מוגדרים אבל לא לתקן מאגרי קוד שלמים באופן עצמאי.

מתאים ל

  • קריאות לפונקציות וכלים

    הוא מנתח את הצורך בכלי דרך שרשרת חשיבה ומפיק פקודות מדויקות בלי לדרוש מודל ענק.

  • פתרון בעיות מתמטיקה בקוד

    התוצאה של 78.33 במבחן AIME25 מוכיחה שהוא מצטיין בחישובים מרובי שלבים ביחס לגודלו.

  • סוכן מקומי לחומרה צנועה

    משקל של 6.8 גיגהבייט מאפשר להריץ מודל חושב בתוך סביבות פיתוח מקומיות ומוגבלות בזיכרון.

איפה זה נופל

החולשה העיקרית היא משימות סוכן מורכבות בעולם האמיתי. במבחן Arena-Hard-V2 הוא קיבל רק 34.96, ובמבחן MMLU-ProX lite הוא הגיע ל־27.78 בלבד, פער עצום מהאחים הגדולים שלו בסדרה. הוא גם לא נבדק על עברית, אלא רק על שפות כמו אנגלית, גרמנית, ספרדית וערבית, כך שאי אפשר לסמוך עליו בעיבוד טקסט מקומי בלי לבדוק אותו מראש.

אותה משפחה

granite-4.2 יצא ב־3 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם המודל תומך בעברית לשימוש בארץ?

הכרטיס מפרט רשימת שפות שנבדקו רשמית, ובהן אנגלית, ערבית, גרמנית ועוד, אך עברית אינה מופיעה ביניהן. הוא מסוגל לקלוט תווים, אך רמת הדיוק וההבנה לא נבדקה ולא מובטחת.

איך מבטלים את מנגנון החשיבה כדי לחסוך זמן?

אפשר להעביר פרמטר שמכבה את החשיבה ישירות בתבנית השיחה, או להגדיר מאמץ נמוך לשאילתות פשוטות. במצב כזה המודל עונה מיד ומסתפק בתקציב טוקנים נמוך יותר.

איך מריצים

המשקל הכולל של הקבצים עומד על 6.8 גיגהבייט בפורמט bfloat16, כך שאפשר להריץ אותו בקלות על כרטיס מסך בודד עם 12 עד 16 גיגהבייט זיכרון בלי להסתבך. הוא נתמך ישירות בספריות vLLM ו־SGLang, ודורש שימוש בפרמטרים קשיחים של טמפרטורה 1.0 וטופ פי 0.95 כדי לקבל תוצאות יציבות.

אם אתם צריכים רק שאילתות בודדות פה ושם, שווה לשקול פנייה לשרת מרוחק. הרצה עצמית משתלמת ברגע שמשלבים אותו בסוכנים שדורשים זמני תגובה מהירים של קריאות לכלים בלי לשלם על כל טוקן חשיבה.

from transformers import pipeline

pipe = pipeline("text-generation", model="ibm-granite/granite-4.2-3b")
print(pipe("שלום"))

הרישיון

הרישיון הוא Apache 2.0 מלא. מותר לקחת אותו, לשנות אותו, להטמיע אותו במוצרים מסחריים סגורים ולהפיץ אותם בלי לשלם תמלוגים לאיש, בתנאי ששומרים על הודעת זכויות היוצרים המקורית.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗