GPT
M

Ministral-3-8B-Reasoning-2512-GGUF

קוד פתוח

mistralaiapache-2.02025-10-31

  • vllm
  • gguf
  • mistral-common
  • en
  • fr

גרסה מכווצת למודל חשיבה וראייה ממוחשבת בגודל שמתאים למחשב מקומי. הוא משלב ניתוח תמונות, חלון הקשר של 256k וקריאה לפונקציות בקובץ GGUF יעיל.

  • 35.5 GBמשקל הקבצים
  • 5,006הורדות בחודש
  • 43לייקים

מה זה

מדובר במודל שמשלב רכיב שפה של 8.4 מיליארד פרמטרים ומקודד ראייה ממוחשבת קטן של 0.4 מיליארד. החיבור הזה מאפשר לו לעבד תמונות וטקסט יחד, תוך התמקדות בפתרון בעיות בשלבים, מתמטיקה, קוד ותחומי מדעים מדויקים. חלון ההקשר שלו מגיע ל־256k, כך שאפשר להזין לו נפח מידע גדול מאוד בפנייה אחת.

בנוסף לחשיבה רב שלבית, הוא כולל תמיכה מובנית בפלט JSON והפעלת כלים חיצוניים במערכות של סוכנים אוטונומיים. המודל אומן על עשרות שפות שונות, וכולל בין השאר אנגלית, צרפתית, גרמנית, ערבית וסינית.

מתאים ל

  • סוכן חכם עם קריאת כלים

    הוא תומך בהפעלת פונקציות ובפלט JSON מובנה, ומסוגל לבצע חשיבה רב שלבית מקומית.

  • ניתוח מסמכים ותרשימים

    מקודד הראייה המובנה מאפשר לו לקרוא ולנתח מידע חזותי בשילוב טקסט בחלון ענק.

  • עבודה מקומית ללא ענן

    צריכת הזיכרון הנמוכה שלו מאפשרת ריצה על מחשב בודד עם פחות מ־12GB זיכרון.

איפה זה נופל

היוצרים מדגישים שרכיב הראייה הממוחשבת דורש תמונות ביחס קרוב ל־1:1, כך שתמונות רחבות או צרות מדי עלולות לפגוע בדיוק אם לא תחתכו אותן מראש. בנוסף, המודל מתקשה כאשר מעמיסים עליו יותר מדי כלים בבת אחת, ולכן חייבים להגדיר לו סט מצומצם וברור של פונקציות. עברית אינה מופיעה ברשימת השפות המצוינת בכרטיס, מה שמחייב לבדוק את איכות הפלט לפני שרצים איתו בשפה הזו.

אותה משפחה

Ministral-3-8B-Reasoning-2512 יצא ב־2 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם המודל ירוץ בצורה חלקה על מחשב נייד רגיל?

בגרסה המכווצת הוא דורש פחות מ־12GB של זיכרון, כך שמחשב מודרני עם כרטיס מסך סביר או מעבד מתאים יוכל להריץ אותו. לביצועים מהירים באמת עדיף כרטיס מסך עם זיכרון ייעודי.

איך כדאי להכין תמונות לפני ששולחים אותן למודל?

הכרטיס ממליץ לחתוך את התמונות מראש כך שיהיו קרובות ליחס של אחד על אחד. תמונות מוארכות או רחבות מאוד יפגעו באיכות הניתוח הוויזואלי שלו.

איך מריצים

כדי להריץ אותו בפורמט המכווץ, צריך פחות מ־12GB של זיכרון RAM או VRAM, תלוי ברמת הקוונטיזציה שבחרתם להוריד. אם תרצו להריץ אותו ברמת דיוק מלאה של BF16, כבר תצטרכו לפחות 24GB של VRAM בכרטיס מסך ייעודי. הקבצים מגיעים בתבנית GGUF שמתאימה לריצה מקומית על מעבדים או מאיצים גרפיים שונים.

המפתחים ממליצים לעבוד עם טמפרטורה של 0.7 ולשמור את עקבות החשיבה של המודל בתוך ההקשר בשיחות מרובות שלבים. אם אין לכם חומרה עם לפחות 12GB זיכרון פנוי, או שאתם לא רוצים לנהל שרתים ותשתיות, פנייה ל־API חיצוני תחסוך את כאב הראש.

ollama run hf.co/mistralai/Ministral-3-8B-Reasoning-2512-GGUF:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הרישיון הוא Apache 2.0 פתוח ומלא. מותר להשתמש בו, לשנות אותו, להטמיע אותו במוצרים מסחריים ולהפיץ אותו חופשי, כל עוד שומרים על הודעת זכויות היוצרים המקורית ולא מפרים זכויות של צד שלישי.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗