GPT
M

MiniMax-M2.1-PRISM

קוד פתוח

Ex0bitmit2026-01-01

  • gguf
  • abliterated
  • uncensored
  • prism
  • minimax

גרסה נטולת מנגנוני סירוב של מודל ענק עם 229 מיליארד פרמטרים. היא פונה למי שצריך יכולות קידוד ופתרון בעיות מתקדמות בלי לקבל שגיאות תקינות או חסימות סירוב.

  • 233 GBמשקל הקבצים
  • 249הורדות בחודש
  • 109לייקים

מה זה

מדובר בעיבוד של MiniMax-M2.1 שעבר הסרה של מנגנוני הסירוב באמצעות שיטה בשם PRISM. המבנה מבוסס על תערובת מומחים עם 256 מומחים, שמתוכם שמונה פעילים בכל טוקן, מה שמאפשר לו להחזיק כמות עצומה של ידע חישובי בלי לחשב את כל הרשת בכל צעד. המודל מכוון למשימות פיתוח תוכנה מורכבות, תכנון תהליכים ארוכי טווח והפעלת כלים חיצוניים באנגלית ובסינית.

בבדיקות הקוד של SWE-bench המודל הבסיסי קיבל 74 נקודות בגרסה המאומתת, לצד 88 נקודות ב־MMLU-Pro ו־83 נקודות ב־AIME25. המשמעות בשטח היא יכולת חזקה מאוד בניתוח באגים, מתמטיקה והבנת בעיות תכנות מורכבות. לפי נתוני היוצר, תהליך הסרת החסימות ענה על 100 אחוז מתוך 4,096 שאילתות תקיפה שנבדקו בלי לפגוע בעקביות התשובות.

מתאים ל

  • פתרון בעיות קוד מורכבות

    מתאים לניתוח באגים ותיקון תוכנה הדורשים הבנה רחבה ללא קטיעת התהליך על ידי מנגנוני סירוב.

  • מחקר מנגנוני סירוב ובטיחות

    משמש כבסיס השוואתי לבדיקת התנהגות מודלים שהוסרו מהם מחסומי הבטיחות המובנים.

  • סוכני פעולה ואוטומציה

    מבצע שרשראות חשיבה ארוכות והפעלת כלים במשימות מערכת מורכבות ללא עצירות שווא.

איפה זה נופל

המודל מוגדר רשמית כנטול עכבות ומנגנוני הבטיחות שלו הוסרו לחלוטין. אם תשתמשו בו מול משתמשי קצה בלי שכבת סינון עצמאית, הוא עלול לייצר תוכן מסוכן או שגוי בלי להתריע. בנוסף, רמת הכיווץ של גרסת ה־43 ג'יגה בייט נמוכה מאוד ומגיעה ל־IQ1_S, מה שעלול לפגוע באיכות הפלט בפועל ביחס למודל המלא.

שאלות
נפוצות

האם אפשר להריץ את המודל על מחשב פיתוח רגיל?

לא בגרסה המלאה, שדורשת מאות ג'יגה בייט של זיכרון גרפי. רק גרסת ה־GGUF המכווצת ל־43 ג'יגה בייט עשויה לפעול על תחנת עבודה חזקה עם llama.cpp, וגם זה ידרוש משאבי זיכרון משמעותיים.

האם המודל מתאים לשימוש בעברית?

המודל הוגדר ואומן עבור שפות אנגלית וסינית. הוא מסוגל לקרוא מעט עברית כמו רוב מודלי השפה, אך הביצועים שלו בשפה זו אינם נתמכים או נמדדים בכרטיס.

איך מריצים

כדי להריץ את הגרסה המלאה בקבצי Safetensors של כ־426 ג'יגה בייט בפורמט BF16, תצטרכו שרת עם מספר כרטיסי מסך חזקים במיוחד, תוך שימוש במנועים כמו vLLM או SGLang. קבצי המאגר עצמם שוקלים 233 ג'יגה בייט, כך שמדובר באופרציה כבדה מאוד לחומרה מקומית.

גרסת GGUF מכווצת ברמת IQ1_S שוקלת כ־43 ג'יגה בייט ומאפשרת הרצה ב־llama.cpp. אם אין לכם גישה לשרת ייעודי עם זיכרון וידאו של מאות ג'יגה בייט, עדיף להשתמש ב־API מרוחק של המודל המקורי, אלא אם ביטול הסירובים הכרחי למחקר שלכם.

ollama run hf.co/Ex0bit/MiniMax-M2.1-PRISM:IQ2_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הקבצים

5 קבצים במאגר, 233 GB סך הכול. הקישורים מובילים ישירות ל־Hugging Face.

הרישיון

הרישיון המדווח במאגר הוא MIT, אך כרטיס המודל מציין שהוא יורש רישיון MIT מותאם של חברת MiniMax. המשמעות היא שחובה לבדוק את תנאי הרישיון המקוריים של החברה לפני שמשלבים את המשקלים במוצר מסחרי, כדי לוודא שאין הגבלות שימוש נוספות מעבר ל־MIT הסטנדרטי.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש

הרישיון המלא בעמוד המודל ↗