GPT
M

Ministral-3-8B-Reasoning-2512

קוד פתוח

mistralaiapache-2.02025-10-31

  • vllm
  • safetensors
  • mistral3
  • mistral-common
  • en

גרסת חשיבה קומפקטית שמשלבת יכולות טקסט ותמונה עם חלון הקשר עצום. היא פונה למי שמחפש מודל קוד פתוח למשימות תכנות ומתמטיקה על חומרה מקומית סבירה.

  • 8.9Bפרמטרים
  • 262,144טוקנים בהקשר
  • 33.3 GBמשקל הקבצים
  • 19,303הורדות בחודש

מה זה

הארכיטקטורה מחלקת 8.9 מיליארד פרמטרים בין מודל שפה של 8.4 מיליארד למקודד ראייה של 0.4 מיליארד. הוא עבר אימון ייעודי לחשיבה רב שלבית, מה שנותן לו יתרון ברור במשימות מדעיות, פתרון בעיות וקוד, לצד תמיכה מובנית בהפעלת כלים ופלט JSON.

במבחני ביצועים רואים תמונה מעניינת. במבחן LiveCodeBench הוא עוקף את Qwen3-VL-8B-Thinking עם תוצאה של 0.616 לעומת 0.580, מה שהופך אותו לבחירה עדיפה לכתיבת קוד בגודל הזה. מנגד, במבחני חשיבה מתמטית טהורה כמו AIME25 או GPQA Diamond הוא מציג שוויון או פיגור קל מול המתחרה מבית קוון, כך שהיתרון המרכזי שלו מתרכז בעיקר בפיתוח ובשילוב סוכנים.

מתאים ל

  • סוכן תכנות מקומי

    מציג ציון של 0.616 ב־LiveCodeBench ויודע להפעיל כלים ולפלוט מבני JSON בצורה מובנית.

  • ניתוח מסמכים ותרשימים

    מקודד הראייה המובנה מאפשר לעבד תמונות לצד טקסט בתוך חלון הקשר נרחב מאוד.

  • פתרון בעיות מתמטיות

    אימון החשיבה הייעודי מספק מענה רב שלבי למשוואות ומדעים מדויקים על חומרה מקומית.

איפה זה נופל

היוצרים ממליצים לחתוך תמונות ליחס של אחד לאחד, מאחר שתמונות רחבות או צרות מדי פוגעות באיכות הזיהוי הוויזואלי. בנוסף, חובה להגביל את כמות הכלים שהמודל מקבל כדי לא להעמיס עליו, ולהשאיר את עקבות החשיבה בהקשר השיחה כדי לשמור על קוהרנטיות. עברית אינה מופיעה ברשימת השפות הנתמכות רשמית, כך שחובה לבדוק היטב הבנה ותחביר לפני שמייעדים אותו לטקסט מקומי.

אותה משפחה

Ministral-3-8B-Reasoning-2512 יצא ב־2 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם המודל מתאים לשימוש בעברית?

כרטיס המודל מונה שפות אירופיות, סינית, יפנית, קוריאנית וערבית, אך עברית אינה ברשימה. סביר שהוא יזהה עברית ברמה מסוימת בזכות טוקנייזר רחב, אבל איכות התשובות וההיגיון בשפה דורשות בדיקה ידנית שלכם.

מה צריך להגדיר כדי שהמודל יחשוב ויפעיל פונקציות כמו שצריך?

בזמן ההפעלה ב־vLLM יש להוסיף את הדגלים tool-call-parser mistral וכן reasoning-parser mistral. בנוסף, החברה ממליצה להשתמש בפרומפט המערכת הרשמי שלהם, להגדיר טמפרטורה של 0.7 ולא לרוקן את היסטוריית החשיבה בין פניות.

איך מריצים

כדי להריץ אותו בפורמט BF16 המקורי תצטרכו כרטיס עם 24GB של זיכרון גרפי, כמו RTX 3090 או 4090. אם תמירו אותו לכימות, הוא יסתפק בפחות מ־12GB זיכרון ויוכל לפעול על מגוון רחב של מחשבים אישיים. ההרצה הסטנדרטית נשענת על vLLM עם דגלים ספציפיים לפרסר של מיסטרל עבור כלים ונתיבי חשיבה.

ברירת המחדל מגדירה חלון הקשר של 256k טוקנים, מה שעלול לחנוק את הזיכרון מיד. מומלץ להגביל את פרמטר אורך ההקשר בהגדרות אם אתם לא מנתחים קובצי ענק. אם אין לכם גישה למעבד גרפי מתאים ואתם צריכים רק שאילתות בודדות עם תמונות, קריאה לשירות ענן מנוהל תהיה זולה ופשוטה משמעותית מתחזוקת שרת עצמאי.

pip install -U huggingface_hub
hf download mistralai/Ministral-3-8B-Reasoning-2512

הרישיון

הפצה תחת רישיון Apache 2.0 מלא. מותר להשתמש בו לצרכים מסחריים, לשנות את המשקלים, להטמיע אותו במוצרים סגורים ולהפיץ מחדש, כל עוד שומרים על תנאי הייחוס והזכויות של צד שלישי.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗