GPT
M

Ministral-3-8B-Instruct-2512-GGUF

קוד פתוח

mistralaiapache-2.02025-10-31

  • vllm
  • gguf
  • mistral-common
  • en
  • fr

גרסת GGUF של מיסטרל שמשלבת מודל שפה עם מפענח תמונה וחלון הקשר עצום. מתאים למי שחייב להריץ מודל ראייה מקומית על חומרה נגישה יחסית.

  • 35.5 GBמשקל הקבצים
  • 67,739הורדות בחודש
  • 63לייקים

מה זה

מדובר במודל שפה של 8.4 מיליארד פרמטרים שאליו מוצמד מפענח ראייה של 0.4 מיליארד פרמטרים. השילוב הזה נותן יכולת לנתח תמונות לצד טקסט, בלי לנפח את המודל לממדים שדורשים שרתים ייעודיים כבדים. הוא מותאם במיוחד למשימות של שיחה, ציות להוראות, ופליטת מבני JSON עם קריאות לפונקציות.

היתרון הבולט לעומת מודלים אחרים במשקל הזה הוא התמיכה בחלון הקשר של 256k. זה מאפשר להזין מסמכים ארוכים מאוד או היסטוריית שיחה עמוקה יחד עם תמונות, כל עוד החומרה שלכם מחזיקה את הזיכרון הנדרש לגודל כזה.

מתאים ל

  • ניתוח תמונות מקומי

    מפענח הראייה המובנה מאפשר לבדוק תצלומים ותרשימים מקומית בלי לשלוח שום קובץ לענן חיצוני.

  • סוכני אוטומציה מבוססי JSON

    הוא אומן במיוחד לקרוא לפונקציות ולהחזיר פלט מובנה, מצוין לחיבור מערכות קיימות לקוד.

  • עיבוד מסמכים ארוכים

    חלון הקשר של 256k מתאים להזנת טקסטים מסיביים ביחד עם תמונות בלי לאבד את ההקשר.

איפה זה נופל

המודל דורש התאמות ספציפיות כדי לא להתפזר. ההנחיות דורשות להגביל את כמות הכלים שנותנים לו ולהשתמש בטמפרטורה נמוכה מ־0.1 בסביבת ייצור, אחרת הביצועים דועכים. בנוסף, מפענח התמונה רגיש מאוד ליחס התצוגה. תמונות רחבות או צרות מדי פוגעות באיכות הניתוח, והיצרן דורש לחתוך אותן קרוב ליחס של אחד לאחד לפני השליחה למודל. עברית לא נכללת ברשימת שפות המקור של הכרטיס, כך שחובה לבדוק היטב איך הוא מגיב לשפה לפני שבונים עליו.

אותה משפחה

Ministral-3-8B-Instruct-2512 יצא ב־2 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם המודל מבין עברית?

הכרטיס מפרט שפות כמו אנגלית, צרפתית, ערבית ועוד, אך עברית אינה ברשימה הרשמית. מודלים רב־לשוניים מבינים לעיתים עברית בסיסית, אבל חובה לבדוק את איכות הפלט וההבנה לפני שמסתמכים עליו.

איזה כרטיס מסך צריך בשביל להריץ אותו?

בפורמט FP8 המודל תופס כ־12 גיגה בייט VRAM. עם כימות נמוך יותר אפשר לרדת מזה, אך מומלץ כרטיס עם 12 עד 16 גיגה בייט כדי להשאיר מקום להקשר.

איך צריך להכין תמונות לפני שליחה למודל?

היצרן ממליץ במפורש לחתוך את התמונות מראש ליחס גובה־רוחב שקרוב לאחד לאחד. תמונות מוארכות או רחבות במיוחד פוגעות בדיוק של מפענח הראייה.

איך מריצים

המודל מגיע בפורמט GGUF בחלוקה לכמה קבצים במשקל כולל של 35.5 גיגה בייט. בפורמט FP8 הוא תופס כ־12 גיגה בייט של זיכרון כרטיס מסך, וכשמשתמשים בכימות כבד יותר אפשר להסתדר עם פחות מזה. כרטיס מסך ביתי חזק או תחנת עבודה סבירה יספיקו כדי להרים אותו מקומית עם כלים שתומכים בפורמט או דרך vLLM.

אם אתם צריכים רק שאילתות בודדות ביום או שאין לכם כרטיס מסך ייעודי של 12 גיגה ומעלה, החזקת שרת פרטי בשבילו תהיה יקרה ומיותרת. במצב כזה עדיף לקרוא למודל דרך שירות חיצוני שגובה לפי שימוש.

ollama run hf.co/mistralai/Ministral-3-8B-Instruct-2512-GGUF:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

המודל משוחרר תחת רישיון Apache 2.0 מלא. אפשר להשתמש בו חופשי לפרויקטים פנימיים או למוצרים מסחריים, לשנות אותו, להפיץ אותו מחדש ולארח אותו אצלכם בלי לשלם תמלוגים, כל עוד שומרים על תנאי הרישיון המקוריים ולא מפרים זכויות צד שלישי.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗