GPT
M

Ministral-3b-instruct

קוד פתוח

ministralapache-2.02024-03-14

  • transformers
  • safetensors
  • mistral
  • text-generation
  • conversational

גרסה מוקטנת של מיסטרל שמיועדת למעקב אחרי הוראות באנגלית. היא מתאימה למי שמחפש משקל קל בלי לוותר על חלון הקשר עצום.

  • 3.3Bפרמטרים
  • 131,072טוקנים בהקשר
  • 6.2 GBמשקל הקבצים
  • 20,727הורדות בחודש

מה זה

מדובר במודל שנוצר ככיוונון עדין על בסיס מיסטרל שבעה מיליארד, כשהמטרה היא לקבל התנהגות דומה אבל בחצי מכמות הפרמטרים. האימון שלו התבסס על שילוב של מאגרי מידע ציבוריים ודאטה סינתטי, והוא בנוי על אותה ארכיטקטורת רשת מוכרת של החברה המקורית רק עם פחות שכבות.

היתרון הבולט שלו לעומת שאר הדברים שתמצאו בקטגוריית השלושה מיליארד הוא היכולת לבלוע 131,072 טוקנים בהקשר יחיד. זה אומר שאפשר להזין לו מסמכים ארוכים שלמים בלי לחתוך אותם לחתיכות קטנות, תכונה שבדרך כלל שמורה למודלים כבדים בהרבה. מצד שני, המפרסמים לא שיתפו ציוני מבחנים או בנצ'מרקים רשמיים, כך שקשה לדעת מראש איך הוא מתמודד עם לוגיקה מורכבת לעומת המתחרים הישירים שלו.

מתאים ל

  • תמצות מסמכים ארוכים באנגלית

    חלון של 131 אלף טוקנים מאפשר להכניס דוחות שלמים בבת אחת למודל קל משקל.

  • סוכן מקומי לחומרה צנועה

    הוא שוקל 6.2 גיגה בלבד ויכול לרוץ מקומית על כרטיס גרפי פשוט או מחשב פיתוח.

  • חילוץ מידע מפרומפט מובנה

    אימון ההוראות והארכיטקטורה המוכחת עוזרים לו להחזיר מבנים מוגדרים בלי להעמיס על השרת.

איפה זה נופל

היוצרים מציינים במפורש שהמודל מיועד בעיקר לאנגלית. מי שינסה להשתמש בו בעברית יגלה מהר מאוד שהוא לא שם, ומכיוון שאין עליו נתוני ביצועים רשמיים, צריך לבדוק אותו בעצמכם על משימות אמת. בנוסף, מודלים שמתאמנים על דאטה סינתטי נוטים לפעמים להישמע משכנעים מאוד גם כשהם ממציאים שטויות, ואי אפשר להסתמך על הידע שלו מעבר למה שתספקו לו ישירות בפרומפט.

שאלות
נפוצות

האם אפשר להשתמש במודל הזה למערכות בעברית?

לא מומלץ. כרטיס המודל מגדיר אותו כמיועד לאנגלית בלבד, וכל ניסיון לעבוד איתו בשפות אחרות צפוי להניב תוצאות שבורות או הזיות. אם המוצר שלכם דורש עברית, תצטרכו לאמן אותו בעצמכם או לבחור מודל אחר.

כמה זיכרון כרטיס מסך נחוץ כדי להריץ אותו בפועל?

המשקל שלו בפורמט המקורי הוא 6.2 גיגה בייט, ולכן כרטיס עם 8 גיגה יריץ אותו לפרומפטים קצרים. אם תרצו לנצל חלקים משמעותיים מחלון ההקשר הענק שלו, תצטרכו לפחות 16 גיגה זיכרון כדי לא לחטוף שגיאות זיכרון.

איך מריצים

המשקל הכולל של הקבצים עומד על 6.2 גיגה בייט בדיוק של bfloat16, כך שכרטיס מסך בודד עם 8 עד 12 גיגה זיכרון יספיק לגמרי כדי להריץ אותו מקומית. הוא נתמך ישירות בספריית transformers, מה שהופך את ההרמה שלו בקוד פייתון לעניין של כמה שורות.

אם אתם צריכים לפתוח את כל חלון ההקשר המקסימלי, צריכת הזיכרון תעלה בצורה חדה מעבר לגודל המודל עצמו. במקרים של עומס כזה, או אם אין לכם חומרה ייעודית זמינה, משתלם יותר לפנות לממשקי ענן מוכנים במקום להחזיק שרת יקר שרובו יישב בלי שימוש.

from transformers import pipeline

pipe = pipeline("text-generation", model="ministral/Ministral-3b-instruct")
print(pipe("שלום"))

הרישיון

רישיון apache-2.0 הוא רישיון פתוח לחלוטין שמאפשר שימוש מסחרי, שינוי של הקוד והפצה של המודל בתוך המוצר שלכם. הדרישה היחידה היא לשמור על הקרדיט והצהרת הרישיון המקורית, בלי לשלם תמלוגים ובלי לפתוח את הקוד הפרטי שלכם.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗