GPT
M

Ministral-3-14B-Reasoning-2512

קוד פתוח

mistralaiapache-2.02025-10-31

  • vllm
  • safetensors
  • mistral3
  • mistral-common
  • en

מודל 14B שמציע שילוב של חשיבה לוגית רב-שלבית, ראייה ממוחשבת וחלון הקשר ענק. הוא פונה למי שרוצה ביצועים ברמה גבוהה בהרצה עצמית בלי להחזיק שרת כבד.

  • 14Bפרמטרים
  • 262,144טוקנים בהקשר
  • 52.0 GBמשקל הקבצים
  • 75,815הורדות בחודש

מה זה

מדובר במודל שמשלב רשת טקסט של 13.5 מיליארד פרמטרים עם מקודד תמונה קטן של 0.4 מיליארד פרמטרים, יחד עם חלון הקשר של 256 אלף טוקנים. הוא אומן ישירות למשימות חשיבה מורכבות, מתמטיקה ותכנות, ומגיע עם תמיכה מובנית בהפעלת כלים ופלט במבנה JSON. המטרה כאן היא לתת יכולות מתקדמות של מודלים גדולים בהרבה בתוך מארז שניתן לפריסה מקומית.

במבחני ביצועים הוא עוקף את המתחרה הישיר Qwen3-14B בחשיבה. במבחן AIME25 למתמטיקה הוא מקבל 0.850 לעומת 0.737, וב־LiveCodeBench הוא מגיע ל־0.646 מול 0.593. זה אומר שבפועל תקבלו פחות טעויות לוגיות בקוד מורכב ויכולת טובה יותר לפתור בעיות שמצריכות כמה צעדים עוקבים. עם זאת, בבסיס הטקסטואלי ללא חשיבה, כמו מבחן MMLU, הוא מציג תוצאה של 0.794 ומפגר מעט אחרי 0.804 של Qwen, כך שהיתרון המרכזי שלו מתבטא בעיקר כשהוא מפעיל תהליך חשיבה.

מתאים ל

  • סוכן תכנות מקומי

    הוא מגיע לציון 0.646 ב־LiveCodeBench ותומך בחשיבה רב-שלבית ובפונקציות מובנות.

  • ניתוח תרשימים וקוד

    מקודד התמונה בשילוב יכולת מתמטית של 0.850 ב־AIME25 מתאים לפתרון בעיות ויזואליות.

  • צ'אט פרטי בארגון

    הוא נכנס בפחות מ־24GB בכימוס ומאפשר עיבוד מידע רגיש בלי הוצאת נתונים החוצה.

איפה זה נופל

המודל רגיש מאוד ליחס התמונה בראייה ממוחשבת. הכרטיס מזהיר שצריך לשמור על יחס של 1:1 ולחתוך תמונות צרות או רחבות מדי כדי למנוע ירידה בביצועים. בסוכנים אוטומטיים עודף כלים פוגע בו, ויש להגביל את מספר הכלים למינימום הנדרש. בנוסף, רשימת השפות המפורטת אינה כוללת עברית, ולכן חובה לבדוק אותו מקומית לפני שבונים עליו לטקסט בעברית.

אותה משפחה

Ministral-3-14B-Reasoning-2512 יצא ב־2 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם המודל תומך בעברית בצורה טובה?

עברית לא מופיעה ברשימת השפות המוגדרות של המודל, הכוללת בעיקר שפות אירופיות, סינית, יפנית, קוריאנית וערבית. הוא עשוי לייצר טקסט מסוים בעברית, אבל צפויות טעויות ולכן לא מומלץ להסתמך עליו למוצר בעברית בלי בדיקה מקיפה מראש.

כמה זיכרון וידאו דרוש בפועל להרצה?

במשקלי BF16 מקוריים נדרשים 32GB של VRAM, ובגרסה מכווצת הוא ירוץ בפחות מ־24GB. כדי לנצל את כל חלון ההקשר של 256 אלף טוקנים תיאלצו להשתמש בשני כרטיסי H200 או להגביל ידנית את אורך ההקשר בהגדרות ההרצה.

איך מריצים

בפורמט BF16 המלא צריך 32GB של זיכרון כרטיס מסך, ובגרסה מכווצת אפשר להסתפק בפחות מ־24GB. אם רוצים לנצל את כל חלון ההקשר המלא של 256 אלף טוקנים, החברה ממליצה על שני כרטיסי H200 דרך ספריית vLLM בגרסה 0.12.0 ומעלה עם mistral-common.

אם אתם לא צריכים את מלוא ההקשר, אפשר להגביל את max-model-len ולהריץ אותו על כרטיס גרפי בודד. מי שאין לו גישה לחומרה כזו, או שצריך שירות יציב בלי לתחזק שרתים וכרטיסי מסך יקרים, יעדיף לצרוך אותו דרך ספק API חיצוני.

pip install -U huggingface_hub
hf download mistralai/Ministral-3-14B-Reasoning-2512

הרישיון

רישיון apache-2.0 מתיר שימוש מסחרי ופרטי מלא, כולל שינוי של המשקלים, התאמה ושילוב במוצרים סגורים. התנאי המרכזי הוא שמירה על הודעת זכויות היוצרים והרישיון המקורי, לצד איסור על הפרת זכויות של צד שלישי.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗