GPT
G

granite-3.3-8b-instruct-GGUF

קוד פתוח

ibm-graniteapache-2.02025-04-11

  • transformers
  • gguf
  • language
  • granite-3.3
  • text-generation

גרסת GGUF מכווצת של מודל ההוראות מבית יבמ, שמיועדת להרצה מקומית קלה על מעבדים או כרטיסים ביתיים. היא מתאימה למי שמחפש מודל שמונה מיליארד פרמטרים עם רישיון פתוח לחלוטין.

  • 83.3 GBמשקל הקבצים
  • 6,890הורדות בחודש
  • 39לייקים

מה זה

מדובר בהמרה של granite-3.3-8b-instruct לתבנית GGUF, שנועדה לחסוך זיכרון ולאפשר ריצה בספריות כמו llama.cpp. המאגר כולל 17 קבצים במשקל כולל של 83.3 גיגה בייט, שמכילים רמות כימות שונות של אותו משקל מקורי. מודלים בסדר גודל כזה נותנים בדרך כלל מענה טוב לעיבוד טקסט, כתיבת קוד ומעקב אחרי הוראות בלי לדרוש שרתים כבדים.

כרטיס המודל הנוכחי מפנה ישירות לכרטיס של מודל הבסיס ואינו מפרט תוצאות מבחנים או בנצ'מרקים בעמוד עצמו. מפתחים שבוחרים בו עושים זאת בעיקר כדי לקבל את הארכיטקטורה של יבמ בפורמט קובץ בודד שרץ מהר על מעבדים מקומיים, בלי להתעסק בהמרות ידניות.

מתאים ל

  • עוזר מקומי למפתחים

    רץ ישירות על מחשב פיתוח בפורמט קל, בלי לשלוח שורות קוד ומידע רגיש לרשת.

  • סוכן אוטומציה פנימי

    מתאים לשילוב בתהליכים מקומיים על שרתים קטנים שצריכים עיבוד הוראות בסיסי.

  • הטמעה במוצר סגור

    רישיון אפאצ'י מאפשר להפיץ את הקובץ ישירות בתוך תוכנה ללקוחות ללא תמלוגים.

איפה זה נופל

העמוד הרשמי לא מספק שום פירוט על מגבלות הדיוק, השפות הנתמכות או נקודות התורפה של המודל, אלא רק מפנה לכרטיס המקורי. לא ברור מהחומר איך הוא מתמודד עם עברית, ואי אפשר לדעת מה גודל הפגיעה בביצועים בין הכימותים השונים בלי לבדוק כל קובץ בעצמכם על הנתונים שלכם.

אותה משפחה

granite-3.3 יצא ב־3 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם צריך להוריד את כל 83 הגיגה בייט?

ממש לא. המאגר מכיל גרסאות שונות של כימות לאותו המודל, וצריך לבחור ולהוריד רק קובץ בודד שמתאים לכמות הזיכרון שיש לכם במחשב.

איפה מוצאים מידע מלא על הביצועים של המודל?

הדף הזה הוא רק מאגר המרות טכני. המידע על נתוני האימון והיכולות נמצא בקישור שהם שמו לכרטיס המקורי של granite-3.3-8b-instruct.

איך מריצים

בגלל שמדובר בפורמט GGUF, אתם מורידים קובץ כימות בודד מתוך המאגר ולא את כל התיקייה ששוקלת 83.3 גיגה בייט. מודל של שמונה מיליארד פרמטרים ברמות כימות מקובלות דורש לרוב בין חמישה לשמונה גיגה בייט של זיכרון עבודה כדי לעבוד בצורה סבירה על מחשב נייד או מעבד גרפי פשוט.

ההרצה מתבצעת ישירות דרך כלי קצה כמו llama.cpp, שרתי אולימה או ספריות פייתון שתומכות בפורמט. אם יש לכם צורך בשרת שמשרת אלפי בקשות במקביל ואין לכם עניין לנהל זיכרון והקצאות חומרה, קריאה לשרת ענן ייעודי תהיה פשוטה בהרבה.

ollama run hf.co/ibm-granite/granite-3.3-8b-instruct-GGUF:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הרישיון כאן הוא apache-2.0, וזה אומר שאתם חופשיים לעשות עם הקבצים כמעט הכל. מותר להשתמש בהם במוצרים מסחריים, לשנות אותם ולהפיץ אותם הלאה, כל עוד אתם שומרים על הודעת הרישיון המקורית ומציינים את הזכויות של יבמ.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗