GPT
M

Ministral-3-14B-Instruct-2512

קוד פתוח

mistralaiapache-2.02025-10-31

  • vllm
  • safetensors
  • mistral3
  • mistral-common
  • en

מודל 14B שמגיע מוכן ב־FP8 עם ראייה מובנית וחלון ענק. הוא מיועד למי שרוצה להריץ מקומית יכולות של מודלים גדולים יותר בלי לחרוג מכרטיס מסך בודד.

  • 14Bפרמטרים
  • 262,144טוקנים בהקשר
  • 29.3 GBמשקל הקבצים
  • 352,127הורדות בחודש

מה זה

הגרסה הזו משלבת מודל שפה של 13.5 מיליארד פרמטרים עם רכיב ראייה של 400 מיליון פרמטרים, כשהמשקלים כבר מכוילים ל־FP8. המבנה הזה נותן מענה ישיר לעבודה עם תמונות וטקסט יחד, עם תמיכה מובנית בהפעלת פונקציות ופלט בפורמט JSON.

במדדי ההוראות הוא מציג יתרון ברור על פני מתחרים ישירים כמו Gemma3-12B ו־Qwen3-14B, עם ציון של 0.551 ב־Arena Hard ו־8.49 ב־MM MTBench. המשמעות בשטח היא יכולת הבנת תמונה חזקה ומענה מדויק יותר להנחיות מערכת מורכבות, ברמה שמתקרבת למודלים של 24B מאותו בית.

מתאים ל

  • סוכני קוד מקומיים

    תמיכה מובנית ב־JSON והפעלת פונקציות ברמת דיוק גבוהה, שרצות על כרטיס 24GB בודד.

  • ניתוח מסמכים ותמונות

    רכיב ראייה של 0.4B המאפשר עיבוד משולב של תמונות וטקסט בחלון הקשר רחב.

  • עוזר פנימי בארגון

    רישיון חופשי לחלוטין שמאפשר פריסה מאובטחת בשרתים מקומיים ללא דליפת מידע החוצה.

איפה זה נופל

המודל רגיש מאוד לפרופורציות של תמונות. היצרן מזהיר במפורש שיש לחתוך תמונות ליחס של 1:1, כי תמונות צרות או רחבות מדי יפגעו בדיוק הראייה. בנוסף, הוא נוטה לאבד יציבות אם מגדירים יותר מדי כלים בו-זמנית, ולכן ההמלצה היא להגביל את מספר הפונקציות למינימום ההכרחי. עוד נקודה קריטית: רשימת השפות הנתמכות כוללת שפות אירופיות, ערבית וסינית, אך עברית אינה מופיעה ברשימה הרשמית ומחייבת בדיקה זהירה מראש.

אותה משפחה

Ministral-3-14B-Instruct-2512 יצא ב־2 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם אפשר להריץ אותו על מחשב ביתי רגיל?

רק אם יש לכם כרטיס מסך מודרני עם לפחות 24GB VRAM, כמו RTX 3090 או 4090. המודל מגיע מכווץ ב־FP8, כך שעל כרטיסים חלשים יותר תצטרכו לבצע קוונטיזציה נוספת שעלולה לפגוע בדיוק.

האם המודל מתאים לשימוש בעברית?

עברית לא נכללת ברשימת השפות הרשמית של המודל, הכוללת בעיקר שפות אירופיות, סינית, יפנית, קוריאנית וערבית. מומלץ לבדוק ביצועים ישירות על דוגמאות שלכם לפני שמחליטים להשתמש בו עבור טקסט עברי.

איך מריצים

המשקלים מגיעים ב־FP8 ותופסים 29.3 גיגה-בייט על הדיסק, כך שהם נכנסים במלואם לכרטיס מסך בודד עם 24GB VRAM, או על מאיצי ענן כמו H200. מריצים אותו דרך vLLM מגרסה 0.12.0 ומעלה, עם חבילת mistral-common תואמת. אם משאירים את חלון ההקשר על המקסימום שלו, 256k טוקנים, תצטרכו הרבה יותר זיכרון עבור ה־KV cache, לכן כדאי להגביל מראש את אורך הקלט.

אם אין לכם כרטיס עם 24GB פנויים ולא בא לכם להתעסק עם קוונטיזציה עמוקה יותר שתפגע באיכות, עדיף לצרוך את המודל דרך שירות ענן קיים במקום לקנות חומרה ייעודית.

pip install -U huggingface_hub
hf download mistralai/Ministral-3-14B-Instruct-2512

הרישיון

הרישיון הוא Apache 2.0 מלא. מותר להשתמש בו לצרכים מסחריים, לשנות את המשקלים, לאמן עליהם מחדש ולשלב את המודל בכל מוצר מסחרי סגור, בתנאי ששומרים על הודעת זכויות היוצרים המקורית.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗