GPT
M

Mistral-Small-Instruct-2409

קוד פתוח

mistralaiother2024-09-17

  • vllm
  • safetensors
  • mistral
  • mistral-common
  • en

גרסת הוראות בגודל ביניים שמיועדת לסגור את הפער שבין שבעה מיליארד פרמטרים לענקים הכבדים. היא מביאה תמיכה מובנית בהפעלת פונקציות וחלון הקשר של 32 אלף טוקנים.

  • 22Bפרמטרים
  • 32,768טוקנים בהקשר
  • 82.9 GBמשקל הקבצים
  • 4,157הורדות בחודש

מה זה

מדובר במודל שפה של 22 מיליארד פרמטרים שעבר התאמה להוראות וכולל תמיכה מובנית בשימוש בכלים ובקריאת פונקציות. המפרט הטכני כולל 56 שכבות, חלון הקשר של 32,768 טוקנים וגודל מילון זהה של 32,768 ערכים, כאשר הייצוג המקורי נשמר בדיוק של bfloat16 על פני 21 קבצים.

הגודל הזה יושב בדיוק בין מודלי שבעה או שמונה מיליארד, שלעיתים קרובות מתקשים בלוגיקה מורכבת ובהפעלת כלים, לבין מודלי ענק שדורשים שרתים ייעודיים עצומים. רשימת השפות הרשמית כוללת שמונה שפות אירופאיות ואסייתיות כמו אנגלית, צרפתית, סינית ויפנית, אך עברית אינה מופיעה בהגדרה הרשמית של המודל.

מתאים ל

  • הפעלת פונקציות וכלים

    תמיכה מובנית בחלוקת משימות לקריאות API ואינטגרציות חיצוניות.

  • עיבוד טקסטים ארוכים

    חלון של 32 אלף טוקנים מאפשר לקרוא מסמכים שלמים בלי לקטוע באמצע.

  • שרת הסקה פנימי

    מתאים לארגונים שמחזיקים שרת מרובה כרטיסים ורוצים ביצועים של 22B.

איפה זה נופל

הכרטיס לא מציג ציוני מדידה רשמיים, מה שמקשה להעריך את היכולות שלו מול מתחרים באותו סדר גודל בלי להריץ בדיקות עצמאיות מקיפות. מעבר לכך, עברית אינה ברשימת השפות הנתמכות, כך שכל עבודה בעברית דורשת בדיקה מוקדמת כדי לראות אם הוא בכלל מחזיר פלט קוהרנטי. נוסף לכך, הדרישה לזיכרון גרפי עצום של 44 גיגה בייט דורשת חומרה מקצועית יקרה גם עבור משימות פשוטות.

שאלות
נפוצות

איזה כרטיס מסך צריך בשביל להריץ אותו מקומית?

הכרטיס דורש לפחות 44 גיגה בייט של זיכרון גרפי להרצה על מעבד גרפי בודד. אפשר גם לפצל את העבודה על גבי שני מאיצים בעזרת vLLM.

האם הוא מציג תוצאות טובות בעברית?

עברית לא מופיעה ברשימת השפות שהוגדרו עבורו, שכוללת רק שפות כמו אנגלית, צרפתית וספרדית. לא הייתי בונה עליו לשימוש מקומי בעברית בלי לבדוק אותו קודם.

איך מריצים

כדי להעלות אותו בשרת ישירות מהמשקלים המקוריים צריך לפחות 44 גיגה בייט של זיכרון גרפי עבור מאיץ יחיד, או לחלק את העומס על שני כרטיסים באמצעות vLLM עם פרמטר מקביליות מתאים. ההרצה המומלצת לייצור היא מעל vLLM מגרסה 0.6.1.post1 ומעלה יחד עם תלויות של ספריית מיסטרל, כאשר קיימת גם אפשרות לבדיקות מהירות באמצעות כלי שורת הפקודה הייעודי של החברה.

אם אין לכם כרטיסי שרת עם זיכרון מספק כמו A100 או זוג כרטיסים מקבילים, הדרישה לזיכרון כה גדול הופכת את ההרצה העצמאית ליקרה ומסורבלת, ובמצב כזה פנייה לשירות מנוהל חוסכת את כאב הראש התשתיתי.

pip install -U huggingface_hub
hf download mistralai/Mistral-Small-Instruct-2409

הרישיון

הרישיון מוגדר כמותאם אישית ולא כרישיון קוד פתוח סטנדרטי. המשמעות היא שחובה לקרוא היטב את תנאי השימוש המדויקים שצירפה החברה לפני שמשלבים אותו בפרויקט מסחרי, ולא להניח שהשימוש בו חופשי.

הרישיון המלא בעמוד המודל ↗