GPT
M

Ministral-3-8B-Base-2512

קוד פתוח

mistralaiapache-2.02025-10-31

  • vllm
  • safetensors
  • mistral3
  • mistral-common
  • en

מודל בסיס רב-אופני של כמעט 9 מיליארד פרמטרים שמשלב עיבוד תמונה עם טקסט. הוא מיועד למי שרוצה לאמן או לכוונן מודל עצמאי בלי כבלי רישוי מסחריים.

  • 8.9Bפרמטרים
  • 262,144טוקנים בהקשר
  • 33.3 GBמשקל הקבצים
  • 13,693הורדות בחודש

מה זה

מדובר במודל שמשלב רשת טקסט של 8.4 מיליארד פרמטרים יחד עם מקודד תמונה של 0.4 מיליארד פרמטרים. השילוב הזה מקנה לו יכולת לנתח קבצי תמונה ישירות לצד טקסט, במקום להסתמך על מערכת נפרדת. הוא מגיע עם חלון הקשר של 262,144 טוקנים, נתון חריג למשקל כזה שמתאים לעיבוד קבצים כבדים או שיחות ארוכות.

במבחני בסיס הוא עוקף את Qwen 3 8B במתמטיקה עם 0.626 לעומת 0.576 ב־MATH CoT, ומציג יתרון קל בידע כללי רב-לשוני עם ציון 0.706 לעומת 0.700 ב־Multilingual MMLU. מנגד, במבחן AGIEval הוא נשאר טיפה מאחור עם 0.591 מול 0.596.

מתאים ל

  • אימון מודל מותאם אישית

    נקודת מוצא פתוחה לכוונון עדין של מודל ראייה וטקסט על דאטה-סט ארגוני ייחודי.

  • עיבוד מסמכים ותמונות מקומי

    ניתוח מסמכים ויזואליים בתוך שרת פנימי ללא תלות בספקים חיצוניים.

  • הטמעה בחומרה ייעודית

    הפעלת מודל רב-אופני על מכשירי קצה הודות ליכולת לצמצם אותו לפחות מ־12GB זיכרון.

איפה זה נופל

זהו מודל בסיס שלא עבר אימון להוראות או לצ'אט. אם תשלחו אליו שאלה פשוטה, הוא ינסה להמשיך את הטקסט ולא בהכרח יענה לכם. אין טעם להציב אותו ישירות מול לקוח ללא שלב מקדים של כוונון עדין. בנוסף, למרות תמיכה ברשימה ארוכה של שפות, עברית לא מצוינת במפורש ברשימת השפות הנתמכות בכרטיס המודל ומחייבת בדיקה זהירה של איכות הפלט והטוקניזציה.

שאלות
נפוצות

האם אפשר להשתמש במודל הזה ישירות כבוט שיחה?

לא. מדובר במודל בסיס שממשיך טקסט ולא אומן לענות לפקודות או לנהל שיחות. בשביל צ'אט עדיף לקחת ישירות את גרסת ה־Instruct של אותו מודל.

כמה זיכרון דרוש כדי להרים שרת שלו?

במשקל המקורי נדרשים לפחות 24GB של זיכרון גרפי, אך בשימוש בגרסאות מכווצות אפשר להסתפק בפחות מ־12GB. בחלון הקשר מלא של 262,144 טוקנים צריכת הזיכרון תעלה משמעותית, ולכן מומלץ להגביל את אורך ההקשר בהגדרות ההפעלה.

איך מריצים

כדי להריץ אותו ישירות בפורמט BF16 המקורי נדרש כרטיס עם לפחות 24GB של זיכרון גרפי, כמו כרטיסי שרת או תחנות עבודה חזקות. אם מכווצים אותו באמצעות קוונטיזציה אפשר להסתפק בפחות מ־12GB, מה שמאפשר הרצה גם על מחשבים אישיים או שרתים צנועים בהרבה. ההרצה עצמה מנוהלת בעיקר בעזרת ספריית vLLM או גרסה ניסיונית של Transformers יחד עם חבילת mistral-common.

מי שרק מחפש מודל שמוכן לשיחה עם משתמשים לא צריך להריץ את גרסת הבסיס הזו בעצמו. עדיף לו לקחת את גרסת ה־Instruct המוכנה או להשתמש ב־API מנוהל כדי לחסוך תחזוקת שרתים.

pip install -U huggingface_hub
hf download mistralai/Ministral-3-8B-Base-2512

הרישיון

הקוד והמשקולות מופצים תחת רישיון apache-2.0. מותר להשתמש במודל לצרכים מסחריים, לשנות אותו, להפיץ אותו מחדש או לאמן עליו נגזרות, בלי לשלם תמלוגים. התנאי היחיד הוא שמירה על הודעת זכויות היוצרים המקורית והימנעות מהפרת זכויות של צד שלישי.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗