GPT
M

MiniCPM5-2B-GGUF

קוד פתוח

openbmbapache-2.02026-09-05

  • transformers
  • gguf
  • minicpm
  • minicpm5
  • llama

גרסת GGUF למודל שפה קומפקטי שמביא יכולות קוד, סוכנים וחישוב חריגות למשקל של שני מיליארד פרמטרים. פתרון ישיר להרצה מקומית על מחשב רגיל בלי להסתמך על שרתים מרוחקים.

  • 8.6 GBמשקל הקבצים
  • 7,760הורדות בחודש
  • 140לייקים

מה זה

המודל הזה נבנה כמנוע טקסט צפוף של שני מיליארד פרמטרים המיועד לסביבות עבודה עם משאבים מוגבלים ומחשוב קצה. למרות הגודל הקומפקטי שלו, הוא תומך בחלון הקשר של 131,072 טוקנים ומבוסס על ארכיטקטורת Llama רגילה עם מנגנון Grouped-Query Attention. הוא מגיע אחרי תהליכי כוונון עדין ואימון עם למידת חיזוק שמותאמים ספציפית למשימות סוכנים והפעלת כלים חיצוניים.

במבחני ביצועים מול מודלים מקבילים בקטגוריית המשקל שלו, וגם מול מודלים במשקל ארבעה מיליארד פרמטרים, הוא מציג יתרון מובהק בלוגיקה ובכתיבת קוד. במבחן LiveCodeBench v6 הוא הגיע לציון של 69.1 לעומת 56.4 של Qwen3.5-4B וציון כולל ממוצע של 53.9 לעומת 51.1. המשמעות בפועל היא יכולת תכנות ופתרון תרגילים שמתחרה ישירות במודלים כפולים ממנו בגודל.

מתאים ל

  • סוכן תכנות מקומי

    אינטגרציה בסביבת פיתוח מקומית להשלמת קוד ופתרון באגים ללא הוצאת נתונים לרשת.

  • הרצת כלים ואוטומציה

    ביצוע קריאות לפונקציות וניהול תהליכים מוגדרים תחת משאבי מחשוב מינימליים.

  • ניתוח מסמכים באנגלית

    עיבוד טקסטים ארוכים במיוחד על מחשב אישי הודות לחלון הקשר של 131,072 טוקנים.

איפה זה נופל

המודל אומן ותומך אך ורק בשפות אנגלית וסינית. שימוש בו בעברית צפוי לייצר שיבושים קשים, פלט קטוע או הזיות מוחלטות, ולכן הוא לא רלוונטי למוצרים שמכוונים לקהל מקומי בשפת האם. בנוסף, המדדים הגבוהים שלו בכתיבת קוד ובמבחנים ממוקדים לא הופכים אותו למודל ידע כללי חזק, שם הוא עדיין מוגבל על ידי כמות הפרמטרים הצנועה שלו.

אותה משפחה

MiniCPM5 יצא ב־5 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם המודל תומך בעברית?

הוא אינו תומך בעברית. המודל אומן לשפות אנגלית וסינית בלבד, וכל ניסיון להפעיל אותו בעברית יפיק תוצאות נחותות ולא שמישות.

איזו חומרה צריך כדי להריץ אותו על המחשב?

מספיק מחשב אישי רגיל עם מעבד סביר וכמה גיגה בייטים בודדים של זיכרון פנוי. אין צורך בשרת ייעודי או כרטיס גרפי יקר.

במה הגרסה הזו שונה מגרסת הבסיס של המודל?

גרסת GGUF עברה אופטימיזציה כדי לעבוד ישירות בתוכנות הרצה קלות כמו llama.cpp ללא צורך בהקמת סביבת פייתון מורכבת.

איך מריצים

כדי להריץ את גרסת ה־GGUF צריך סביבה כמו llama.cpp, Ollama או LM Studio. מודל של 2B לא דורש כרטיסי מסך יקרים של שרתים וירוץ בקלות על מעבד מחשב נייד או זיכרון של כרטיס מסך ביתי בסיסי. קבצי הפרויקט תופסים בסך הכול 8.6 ג'יגה בייט בפורמטים השונים שלו.

שווה להריץ אותו מקומית כשצריכים פרטיות מלאה, חוסר תלות ברשת או עבודה בתוך קוד שרץ אוטומטית על מכונות קצה. אם אתם זקוקים למענה כללי עמוק בעברית, המאמץ מיותר ועדיף לקרוא למודלים גדולים ומבוססים דרך API מסחרי רגיל.

ollama run hf.co/openbmb/MiniCPM5-2B-GGUF:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הקבצים

6 קבצים במאגר, 8.6 GB סך הכול. הקישורים מובילים ישירות ל־Hugging Face.

הרישיון

המודל משוחרר ברישיון apache-2.0. זהו רישיון קוד פתוח מתירני שמאפשר שימוש חופשי לצרכים מסחריים ופרטיים כאחד, כולל שינוי הקוד והפצה פנימית בתוך מוצרים. התנאי המרכזי הוא שמירה על הודעת זכויות היוצרים והרישיון המקורי בקבצים.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗