GPT
M

Ministral-3-3B-Base-2512

קוד פתוח

mistralaiapache-2.02025-10-31

  • vllm
  • safetensors
  • mistral3
  • mistral-common
  • en

מודל בסיס קטן עם עיבוד תמונה וחלון הקשר עצום, שנועד בעיקר לאימון עצמי על חומרה צנועה מקומית בלי לשתף מידע ברשת.

  • 4.3Bפרמטרים
  • 262,144טוקנים בהקשר
  • 14.4 GBמשקל הקבצים
  • 9,297הורדות בחודש

מה זה

מדובר במודל משולב של 4.3 מיליארד פרמטרים, שמחולק למודל שפה של 3.4 מיליארד פרמטרים ומקודד תמונה של 0.4 מיליארד. הוא מגיע בגרסת בסיס גולמית, כלומר הוא מאומן רק על המשך טקסט ולא עבר התאמה לשיחה או מילוי הוראות. היתרון המשמעותי שלו לעומת מודלים קטנים אחרים הוא שילוב ישיר של קלט תמונה לצד חלון הקשר של 256 אלף טוקנים.

במבחני הבסיס של חשיבה מתמטית עם שתי דוגמאות הוא מוביל על מתחרים ישירים כמו Qwen 3 4B ו־Gemma 3 4B עם ציון של 0.601 לעומת 0.405 ו־0.294 בהתאמה. במבחני ידע כללי ושפות כמו MMLU הוא עומד ראש בראש עם Qwen בלי פער מורגש. זה אומר שיש כאן נקודת פתיחה חזקה מאוד להמשך אימון, אבל לא מוצר שמוכן לעבודה עם משתמשי קצה ישר מהקופסה.

מתאים ל

  • אימון ייעודי למשימות ספציפיות

    מודל בסיס קומפקטי וזול לאימון שמהווה נקודת זינוק נקייה למי שרוצה לבנות מודל מותאם אישית.

  • חילוץ מידע ממסמכים ותמונות

    מקודד התמונה המובנה מאפשר לנתח קבצים גרפיים מקומית על חומרה של 16 גיגה זיכרון בלבד.

  • סיווג טקסט על חומרה מקומית

    גודל קטן שמאפשר להריץ מיון והשלמת נתונים ישירות על ציוד קצה וללא תלות בחיבור לרשת.

איפה זה נופל

זה מודל בסיס נטו. הוא לא יענה לפקודות, לא ינהל שיחה, ונוטה לפלוט המשכי משפטים אקראיים אם לא מאמנים אותו על נתונים מתאימים מראש. מי שמחפש תחליף מהיר לבוט יקבל תוצאות מאכזבות.

בנוסף, עברית כלל לא מופיעה ברשימת השפות הנתמכות שפורסמו בכרטיס המודל. אם התוכנית שלכם כוללת עיבוד טקסט בעברית, חובה לבדוק היטב את איכות הטוקניזציה והפלט לפני שמבזבזים זמן ומשאבים על אימון ייעודי.

שאלות
נפוצות

אפשר להוריד את המודל ולהתחיל להתכתב איתו כמו בצ'אט?

לא. זה מודל בסיס שמיועד להשלמת טקסט ולא אומן להבין הנחיות או לנהל שיחה. לשימושי צ'אט עדיף להוריד ישירות את גרסת ה־Instruct של אותו מודל.

כמה זיכרון גרפי נדרש בפועל כדי להריץ אותו?

במשקלים המקוריים שלו תצטרכו כרטיס עם 16 גיגה זיכרון לפחות. אם תשתמשו בגרסה מכוילת לקוונטיזציה, תוכלו להסתפק בפחות מ־8 גיגה זיכרון על המחשב.

האם המודל מתאים לעבודה עם טקסטים בעברית?

הכרטיס מפרט שפות מערביות, סינית, ערבית, יפנית וקוריאנית, אך עברית אינה מוזכרת. מומלץ לבחון את ההתנהגות שלו על דוגמאות בודדות לפני שמשקיעים בפרויקט.

איך מריצים

כדי להריץ אותו בפורמט המקורי ב־BF16 תצטרכו כרטיס מסך עם 16 גיגה זיכרון גרפי, ואם תבצעו כיול לקוונטיזציה תוכלו לדחוס אותו לפחות מ־8 גיגה זיכרון. המפתחים ממליצים להשתמש ב־vLLM מגרסה 1.12 ומעלה, או בגרסת טרום הפצה של ספריית transformers מגרסה חמש יחד עם mistral-common לתמיכה בטוקנייזר.

ברירת המחדל של חלון ההקשר מוגדרת למקסימום, לכן כדאי להגביל את אורך הקלט עם הדגל max-model-len כדי למנוע קריסה של זיכרון ה־GPU. אם אתם רק צריכים צ'אט או מודל שעונה לשאלות ולא מתכננים לאמן אותו בעצמכם, עדיף לקחת ישירות את גרסת ה־Instruct המוכנה או לפנות ל־API חיצוני במקום להרים שרת עצמאי.

pip install -U huggingface_hub
hf download mistralai/Ministral-3-3B-Base-2512

הרישיון

המודל מופץ תחת רישיון קוד פתוח של אפאצ'י 2.0. מותר להשתמש בו לצרכים מסחריים, לבצע שינויים, לאמן אותו מחדש ולהטמיע אותו במוצרים פרטיים בלי תשלום תמלוגים, כל עוד שומרים על הודעת הרישיון המקורית ולא מפרים זכויות יוצרים של צד שלישי.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗