GPT
M

Ministral-3-14B-Reasoning-2512-GGUF

קוד פתוח

mistralaiapache-2.02025-10-31

  • vllm
  • gguf
  • mistral-common
  • en
  • fr

גרסת GGUF מכוונת לחשיבה ולוגיקה, שמשלבת יכולות ראייה וטקסט בנפח שמתאים להרצה על חומרה מקומית. הפתרון פונה למי שמחפש ביצועים ממוקדי קוד ומתמטיקה בלי תלות בשרתים חיצוניים.

  • 56.0 GBמשקל הקבצים
  • 23,994הורדות בחודש
  • 46לייקים

מה זה

מדובר במודל שמחולק לשני רכיבים, מודל שפה של 13.5 מיליארד פרמטרים ורכיב ראייה של 0.4 מיליארד פרמטרים. ההתמקדות כאן היא בהסקה לוגית רב שלבית, פתרון בעיות במדעים מדויקים וכתיבת קוד, לצד יכולת מובנית לפעול כסוכן עצמאי עם הוצאת פלט בפורמט JSON והפעלת פונקציות.

הוא מציע חלון הקשר של 256 אלף טוקנים, ותומך ברשימה של שפות אירופיות ואסיאתיות, כולל ערבית. עברית לא מצוינת במפורש ברשימת השפות הנתמכות, ולכן כדאי לבדוק אותה בזהירות. השילוב של אנליזת תמונה יחד עם יכולת הסקה עמוקה מאפשר לנתח מסמכים טכניים או תרשימים ישירות על המחשב שלכם.

מתאים ל

  • פתרון בעיות קוד ואלגוריתמיקה

    המודל עבר אימון ייעודי למשימות היגיון ומתמטיקה, ומחזיר מבני JSON בצורה נקייה.

  • ניתוח תרשימים ואיורים

    רכיב הראייה מאפשר לפענח תמונות ביחס ריבועי לצד השאילתה הטקסטואלית.

  • סוכנים אוטונומיים מקומיים

    תמיכה מובנית בזימון פונקציות ובחלון הקשר גדול מאפשרת לבנות סוכן פרטי לגמרי.

איפה זה נופל

המודל דורש התאמות ספציפיות כדי לא להתפזר. ההנחיות דורשות טמפרטורה קבועה של 1, ושמירה של כל עקבות החשיבה הקודמים בהקשר כדי לא לפגוע ברצף הלוגי. מעבר לזה, רכיב הראייה מוגבל מאוד ודורש לחתוך תמונות ליחס של 1:1, אחרת הביצועים נפגעים. עומס של יותר מדי כלים ישבור לו את יכולת הפעלת הפונקציות, ועברית כלל אינה ברשימת השפות הרשמית.

אותה משפחה

Ministral-3-14B-Reasoning-2512 יצא ב־2 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

איזה כרטיס מסך צריך בשביל להריץ אותו?

עבור הגרסאות המכווצות תצטרכו פחות מ־24 גיגה של זיכרון גרפי או זיכרון מערכת מאוחד. אם תרצו לטעון אותו במצב מלא ללא כיווץ, יש צורך בלפחות 32 גיגה של VRAM.

איך הכי נכון להזין לו תמונות לניתוח?

המודל מתוכנן לעבוד עם תמונות שקרובות ליחס של אחד לאחד. תמונות רחבות מדי או צרות מדי פוגעות בתוצאות, ולכן מומלץ לחתוך אותן מראש לפני השליחה.

האם הוא מומלץ לעבודה שוטפת בעברית?

עברית אינה מופיעה ברשימת השפות הרשמית שכוללת אנגלית, שפות אירופיות, ערבית, סינית, יפנית וקוריאנית. מומלץ לבדוק את איכות הפלט בעברית באופן עצמאי לפני שמסתמכים עליו.

איך מריצים

כדי להריץ אותו בפורמט GGUF המכוון, תצטרכו פחות מ־24 גיגה זיכרון RAM או VRAM בגרסאות המכווצות. אם תרצו להריץ אותו ללא כיווץ בפורמט המקורי, תצטרכו 32 גיגה זיכרון גרפי ייעודי.

אם יש לכם כרטיס מסך ביתי חזק או מחשב מק עם זיכרון מאוחד מתאים, אפשר להריץ אותו מקומית בלי לשלם על שרתים. לעומת זאת, אם אין לכם את החומרה הזו או שאתם צריכים רק שאילתות בודדות פה ושם, עדיף להשתמש ב־API מרוחק במקום להשקיע במכונה ייעודית.

ollama run hf.co/mistralai/Ministral-3-14B-Reasoning-2512-GGUF:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הרישיון הוא Apache 2.0 מלא. מותר להשתמש במודל לצרכים מסחריים, לשנות אותו, להפיץ אותו ולשלב אותו במוצרים סגורים, כל עוד לא מפרים זכויות צד שלישי ושומרים על תנאי הרישיון המקוריים.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗