GPT
M

Ministral-3-14B-Instruct-2512-GGUF

קוד פתוח

mistralaiapache-2.02025-10-31

  • vllm
  • gguf
  • mistral-common
  • en
  • fr

גרסת GGUF שמשלבת ראייה ממוחשבת בתוך מודל שפה קומפקטי, עם חלון של 256k ורישיון חופשי לחלוטין. הוא נבנה לתפקד כמו מודל של 24B אבל להיכנס בחומרה מקומית.

  • 56.0 GBמשקל הקבצים
  • 16,992הורדות בחודש
  • 68לייקים

מה זה

מדובר במודל שמחולק לשני חלקים ברורים, רכיב שפה של 13.5B ורכיב ראייה של 0.4B. השילוב הזה נותן לו לנתח תמונות לצד טקסט בלי להזדקק למודל נפרד, והוא מגיע מכויל מראש למשימות של שיחה ומעקב אחרי הנחיות.

היתרון שלו על פני מודלים דומים בגודל הזה הוא היכולת לטפל בהקשר של עד 256k טוקנים, תמיכה מובנית בהפעלת פונקציות ופליטת JSON מסודר. המפתחים טוענים שהוא מציג ביצועים שמזכירים את Mistral Small 3.2 24B, רק במבנה שתוכנן מראש לקצוות רשת ולמכשירים עם משאבים מוגבלים.

מתאים ל

  • סוכנים אוטונומיים

    תמיכה מובנית ב־function calling ובפלט JSON מאפשרת לו להריץ משימות מוגדרות מראש.

  • ניתוח מסמכים ותמונות

    רכיב הראייה המובנה מאפשר לקרוא ולנתח מדיה חזותית ביחס ריבועי בלי שרת נוסף.

  • עיבוד טקסטים ארוכים

    חלון הקשר של 256k מתאים לניתוח של קבצים מסיביים והיסטוריית שיחה עמוקה מקומית.

איפה זה נופל

המודל דורש התאמות מדויקות של הקלט כדי לא להישבר. בכרטיס המודל מזהירים במפורש שחייבים לחתוך תמונות ליחס של קרוב ל־1:1, כי תמונות רחבות או צרות מדי פוגעות בביצועים. בנוסף, הוא רגיש לכמות הכלים שנותנים לו ומחייב צמצום של הכלים למינימום ההכרחי כדי לא להעמיס עליו. לסביבת ייצור ממליצים שם להישאר עם טמפרטורה מתחת ל־0.1, מה שאומר שיש לו נטייה לסטות מהר מההוראות בהגדרות חופשיות יותר. עברית לא מופיעה ברשימת השפות המרכזיות שנבדקו.

אותה משפחה

Ministral-3-14B-Instruct-2512 יצא ב־2 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם אפשר להריץ אותו על מחשב מקומי?

כן, בתנאי שיש לכם לפחות 24GB זיכרון גרפי עבור גרסת FP8. אם תבחרו בגרסה עם כיול משמעותי יותר מתוך קובצי ה־GGUF, תוכלו להסתפק גם בפחות מזה.

איך המודל מתמודד עם תמונות בכל גודל?

לא טוב. ההנחיה היא לשמור על יחס של 1:1 ולחתוך מראש תמונות רחבות או צרות מדי כדי למנוע ירידה באיכות התוצאות.

איך מריצים

כדי להריץ אותו בפורמט FP8 תצטרכו לפחות 24GB של זיכרון גרפי, ואפשר לרדת מזה אם משתמשים בגרסאות מכווצות יותר שנמצאות בתוך 56.0 GB של קובצי ה־GGUF שפורסמו. ההרצה המקומית נתמכת דרך ספריות כמו vLLM ומתאימה למי שרוצה שליטה מלאה במידע.

אם אין לכם כרטיס עם מספיק זיכרון או שאתם לא רוצים להתעסק עם ניהול קבצים ותצורות שרת, קריאה ל־API תהיה פשוטה וזולה יותר מחומרה ייעודית.

ollama run hf.co/mistralai/Ministral-3-14B-Instruct-2512-GGUF:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הרישיון הוא Apache 2.0 מלא. אתם רשאים להריץ, לשנות ולשלב אותו במוצרים מסחריים או פנימיים בלי לשלם תמלוגים, כל עוד שומרים על תנאי הרישיון המקוריים ולא מפרים זכויות צד שלישי.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗