GPT
M

Ministral-3-3B-Reasoning-2512-GGUF

קוד פתוח

mistralaiapache-2.02025-10-31

  • vllm
  • gguf
  • mistral-common
  • en
  • fr

גרסה מכווצת למודל קטן שמשלב עיבוד תמונה ויכולות חשיבה מתמטית ותכנות. הוא נכנס בקלות לחומרה ביתית בלי שתצטרכו שרת יקר.

  • 14.9 GBמשקל הקבצים
  • 5,625הורדות בחודש
  • 44לייקים

מה זה

מיסטרל בנו כאן שילוב מעניין של מודל שפה עם 3.4 מיליארד פרמטרים ומקודד ראייה של 0.4 מיליארד פרמטרים. המטרה היא לתת מענה למשימות שדורשות היגיון רב-שלבי, כתיבת קוד, פתרון בעיות במדעים מדויקים, וניתוח תמונות, וכל זה בגודל שנחשב זעיר. בנוסף יש לו חלון הקשר של 256k ותמיכה מובנית בהפעלת פונקציות ופלט בפורמט JSON.

בניגוד למודלים רגילים בסדר הגודל הזה שמתקשים להחזיק שרשרת מחשבה, הגרסה הזו עברה אימון ייעודי למשימות חשיבה מורכבות. היא מיועדת לעבוד עם פרומפט מערכת מוגדר מראש וטמפרטורה מומלצת של 0.7, תוך שמירה על עקבות החשיבה בהקשר כדי לא לאבד את הכיוון בשיחות מתמשכות.

מתאים ל

  • פתרון בעיות קוד מקומי

    אימון ייעודי למשימות תכנות שרץ מהר ישירות על המחשב האישי בלי תלות ברשת.

  • ניתוח תרשימים וגרפים

    משלב עיבוד תמונה והסקה מתמטית כדי להבין נתונים חזותיים ביחס ריבועי.

  • סוכן אוטונומי קל משקל

    תמיכה מובנית בקריאת פונקציות ופלט JSON שמתאימה לחיבור כלי עבודה בודדים.

איפה זה נופל

למרות היכולות, יש לו מגבלות תפעוליות ברורות. בעיבוד תמונה הוא רגיש ליחסי ממדים ודורש תמונות קרובות ליחס של 1:1, כך שתצטרכו לחתוך מראש תמונות רחבות או צרות מדי כדי למנוע ירידה בביצועים. בעבודה עם כלים חיצוניים אסור להעמיס עליו כמות גדולה של פונקציות במקביל כי הוא מתבלבל בקלות. בנוסף, עברית אינה מופיעה ברשימת השפות הנתמכות שפורסמה, כך שחובה לבדוק את איכות הפלט לפני שמסתמכים עליו לשפה המקומית.

אותה משפחה

Ministral-3-3B-Reasoning-2512 יצא ב־2 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם המודל יודע לעבוד בעברית?

רשימת השפות הרשמית כוללת אנגלית, שפות אירופיות, סינית, יפנית, קוריאנית וערבית. עברית לא מוזכרת בכרטיס המודל. ייתכן שהוא יבין מילים מסוימות בגלל אימון כללי, אבל לא מומלץ לבנות עליו משימות הסקה מורכבות בעברית בלי בדיקה מעמיקה מראש.

למה התמונות חייבות להיות מרובעות?

היוצרים ממליצים להקפיד על יחס של 1:1 כי מקודד הראייה בנפח 0.4B אומן בצורה אופטימלית למבנה הזה. תמונות רחבות או צרות במיוחד פוגעות בדיוק הזיהוי שלו, ולכן עדיף לבצע חיתוך ידני בצד שלכם לפני השליחה.

איך מריצים

אם אתם מריצים את הגרסה המכווצת בפורמט GGUF, תצטרכו פחות מ־8GB של זיכרון עבודה או זיכרון כרטיס מסך, מה שאומר שהוא ירוץ על כמעט כל לפטופ מודרני. בגרסה המלאה ללא כיבוץ נדרשים 16GB של VRAM, שם כבר צריך כרטיס ייעודי סביר.

ההרצה המקומית מתאימה במיוחד לפיתוח סוכנים אוטומטיים מקומיים או עיבוד נתונים רגישים שלא רוצים להוציא החוצה. אם מדובר בעומס עבודה מזדמן בלי צורך בפרטיות מוחלטת, פנייה ל־API חיצוני תחסוך לכם את ניהול התהליכים והזיכרון במחשב.

ollama run hf.co/mistralai/Ministral-3-3B-Reasoning-2512-GGUF:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

המודל משוחרר תחת רישיון Apache 2.0. מותר להשתמש בו, לשנות אותו, לשלב אותו במוצרים מסחריים ולהפיץ אותו בחופשיות. התנאי העיקרי הוא שמירה על הודעת זכויות היוצרים המקורית והימנעות משימוש שמפר זכויות של צד שלישי.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗