GPT
M

Ministral-3-14B-Base-2512

קוד פתוח

mistralaiapache-2.02025-10-31

  • vllm
  • safetensors
  • mistral3
  • mistral-common
  • en

גרסת בסיס של 14 מיליארד פרמטרים שמשלבת ראייה ממוחשבת וחלון הקשר ענק. היא מיועדת בעיקר למי שרוצה לאמן או לכוונן מודל עצמאי על חומרה מקומית נגישה.

  • 14Bפרמטרים
  • 262,144טוקנים בהקשר
  • 52.0 GBמשקל הקבצים
  • 3,762הורדות בחודש

מה זה

מדובר במודל שמשלב מודל שפה של 13.5 מיליארד פרמטרים יחד עם רכיב ראייה ממוחשבת של 400 מיליון פרמטרים. השילוב הזה נותן לו לנתח תמונות לצד טקסט ישירות משלב האימון המקדים, עם תמיכה מוצהרת בריבוי שפות שכולל אנגלית, צרפתית, ספרדית, גרמנית, איטלקית, פורטוגזית, הולנדית, סינית, יפנית, קוריאנית וערבית.

במבחני הבסיס של מודלים בגודל הזה, הוא מציג תוצאות צמודות מאוד למתחרים. במבחן MMLU הרגיל הוא קיבל 0.794 לעומת 0.804 של Qwen3 14B Base, ובמבחן AGIEval קיבל 0.648 מול 0.661 של Qwen. המקום שבו הוא עוקף את המתחרה הישיר הוא במתמטיקה עם שרשרת מחשבה, שם רשם 0.676 מול 0.620. זה מראה על יכולת ניתוח טובה של נתונים מורכבים כבר ברמת משקלי הבסיס.

מתאים ל

  • אימון מודל מותאם אישית

    משקלי בסיס נקיים שמתאימים לתהליכי כיוונון ממוקדים על דאטה פנימי של ארגונים.

  • ניתוח מסמכים ותמונות

    שילוב ראייה ממוחשבת בתוך מודל שפה של 14B לעיבוד תרשימים ודוחות ויזואליים.

  • סוכנים אוטונומיים מקומיים

    ריצה מקומית על חומרה של 24GB או 32GB זיכרון ללא תלות בחיבור חיצוני.

איפה זה נופל

זהו מודל בסיס שטרם עבר אימון להוראות או שיחה. אם תשלחו לו שאלה, הוא ינסה להשלים את הטקסט ולא בהכרח יענה עליה, ולכן הוא לא מתאים לעבודה ישירה מול משתמש קצה בלי שתעשו לו כיוונון עדין בעצמכם. בנוסף, עברית אינה מופיעה ברשימת השפות שנתמכות רשמית בכרטיס המודל, כך שיש לבדוק את התנהגותו עם טקסט מקומי לפני שמתבססים עליו.

שאלות
נפוצות

אפשר להשתמש בו ישירות כבוט לצ'אט?

לא מומלץ בכלל. זהו מודל בסיס שנועד להשלמת טקסט, ולא עבר אופטימיזציה להבנת פקודות או שיחה. לשימושי צ'אט יש גרסה ייעודית בשם Instruct.

האם הוא באמת יכול לקרוא 256 אלף טוקנים על כרטיס ביתי?

המודל תומך באורך הזה, אבל צריכת הזיכרון על הקשר מלא תחנוק כרטיסים רגילים. היצרן מציין שבשביל לנצל את כל ההקשר מומלץ מערך של שני כרטיסי H200.

מה דרוש כדי להריץ אותו עם ספריות פייתון קיימות?

אתם צריכים גרסאות חדשות מאוד. נדרשת ספריית vLLM מגרסה 1.12.0 ומעלה, או ספריית Transformers מגרסה 5.0.0rc0 לפחות, יחד עם חבילת mistral-common.

איך מריצים

כדי להריץ אותו בפורמט BF16 המקורי צריך לפחות 32GB זיכרון כרטיס מסך, וכשמבצעים קוונטיזציה אפשר לרדת מתחת ל־24GB. אם אתם רוצים לנצל את כל חלון ההקשר של 256 אלף הטוקנים, היצרן ממליץ להשתמש בשני כרטיסי H200. כרטיס בודד יספיק רק אם תגבילו משמעותית את אורך הקלט דרך vLLM בעזרת הפרמטר שמגדיר את אורך ההקשר המרבי.

ההרצה המקומית נתמכת דרך ספריות vLLM מגרסה 1.12.0 ומעלה, או Transformers בגרסת 5.0.0rc0. אם אין לכם שרת ייעודי עם כרטיסי מסך חזקים ואתם צריכים לפתוח את כל ההקשר לעיבוד מסמכים גדולים, עלויות החומרה כאן יהיו גבוהות משמעותית משימוש בממשק ענן מנוהל.

pip install -U huggingface_hub
hf download mistralai/Ministral-3-14B-Base-2512

הרישיון

הרישיון הוא Apache 2.0 מלא. אתם רשאים להשתמש בו לצרכים מסחריים, לשנות אותו, לאמן עליו גרסאות חדשות ולהפיץ אותו בתוך מוצרים סגורים. התנאי העיקרי הוא שמירה על הצהרת זכויות היוצרים של המקור, לצד התחייבות לא להפר זכויות של צדדים שלישיים.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗