GPT
M

Mistral-Nemo-2407-12B-Thinking-Claude-Gemini-GPT5.2-Uncensored-HERETIC-GGUF

קוד פתוח

mradermacherרישיון לא דווח2026-01-10

  • transformers
  • gguf
  • uncensored
  • heretic
  • abliterated

גרסת קוונטיזציה לא מסוננת של מיסטרל נמו בנפח 12 מיליארד פרמטרים. מי שמוריד אותה מחפש הרצה מקומית של מודל חשיבה שלא מוגבל על ידי מעצורי בטיחות מסחריים.

  • 78.9 GBמשקל הקבצים
  • 8,457הורדות בחודש
  • 63לייקים

מה זה

המאגר הזה מציג קובצי GGUF סטטיים שמבוססים על מיזוג או כוונון של Mistral-Nemo בנפח 12B, שבוצע על ידי DavidAU תחת השם הבומבסטי Thinking-Claude-Gemini-GPT5.2-Uncensored-HERETIC. המטרה כאן היא שילוב של דפוסי חשיבה ופתרון בעיות המדמים מודלים סגורים גדולים, אך בתוך מודל קומפקטי ופתוח לחלוטין וללא שכבות סינון תכנים. היוצר mradermacher לקח את משקלי המקור והמיר אותם לפורמטים מכווצים כדי שאפשר יהיה להריץ אותם על מגוון סוגי חומרה ביתית ומשרדית.

דף המודל לא מציג מבחני ביצועים רשמיים, ציוני בנצ'מרק או השוואות מסודרות מול מודלים אחרים בגודל 12B. השם רומז ליכולות של מודלי ענק, אך בפועל מדובר בבסיס של מיסטרל נמו שעבר אימון נוסף. התוצאה בפועל תלויה במידת ההצלחה של תהליך ההסרה של מגבלות הבטיחות והטמעת שלבי החשיבה, בלי שום התחייבות רשמית ליציבות התוכן.

מתאים ל

  • מחקר על מודלים לא מסוננים

    בדיקת התנהגות מודל חשיבה נטול מעצורי בטיחות מקומיים בסביבת פיתוח סגורה.

  • הרצה מקומית על חומרה ביתית

    שימוש בקובצי Q4_K על גבי כרטיסי מסך צרכניים רגילים עם זיכרון של שמונה גיגה.

  • עיבוד טקסט בשפות אירופיות

    עבודה מול שפות שנתמכות רשמית בכרטיס המודל כמו אנגלית, גרמנית, ספרדית וצרפתית.

איפה זה נופל

הבעיה העיקרית היא חוסר מוחלט במידע טכני על אופן האימון, הנתונים ששימשו ליצירתו או בדיקות איכות השוואתיות. מעבר לכך, המודל מוגדר כלא מסונן, כך שאין שום מנגנון הגנה מובנה מפני פליטת תוכן פוגעני, שגוי או רעיל, מה שדורש בדיקה מעמיקה ובניית מעטפת הגנה עצמאית לפני שמשלבים אותו במערכת פעילה. בנוסף, עברית אינה מופיעה ברשימת השפות הנתמכות בדף, שכוללת שפות אירופיות, רוסית וסינית בלבד, ולכן הביצועים שלה צפויים להיות ירודים.

שאלות
נפוצות

איזו גרסה כדאי להוריד מתוך הרשימה?

הגרסאות המאוזנות ביותר הן Q4_K_M בנפח 7.6 גיגה בייט או Q4_K_S בנפח 7.2 גיגה בייט, שמוגדרות בדף כמומלצות ומהירות. מי שיש לו כרטיס חזק ורוצה איכות גבוהה יכול לקחת את Q6_K, בעוד שגרסאות Q2 ו־Q3 מיועדות רק למקרים של מחסור קיצוני בזיכרון בגלל ירידה באיכות התוצרים.

האם המודל יתפקד היטב בעברית?

עברית אינה מופיעה ברשימת השפות שנתמכות במודל הזה, הכוללת בעיקר אנגלית, צרפתית, גרמנית, ספרדית, איטלקית, פורטוגזית, רוסית וסינית. סביר להניח שהוא יידע לפענח מעט עברית בזכות משקלי הבסיס, אך התוצאות יהיו מוגבלות ומלאות שגיאות לעומת השפות הנתמכות.

איך מריצים

המודל מחולק למגוון קוונטים בפורמט GGUF, החל מגרסת Q2_K הזעירה ששוקלת 4.9 גיגה בייט ועד לגרסת Q8_0 שתופסת 13.1 גיגה בייט. לרוב המשתמשים מומלץ להוריד את Q4_K_M ששוקל 7.6 גיגה בייט, או את Q4_K_S בנפח 7.2 גיגה בייט, שכן אלה מציעים איזון טוב בין מהירות לאיכות ורצים בנוחות על כרטיס מסך בודד עם 8 עד 12 גיגה בייט VRAM. מי שרוצה דיוק מרבי בלי לעבור לשרת ייעודי יבחר בגרסת Q6_K שדורשת כעשרה גיגה זיכרון.

אם יש לכם מחשב ללא כרטיס מסך מתאים, הקבצים הקטנים יכולים לרוץ גם על מעבד רגיל עם זיכרון RAM סביר, אם כי בקצב איטי יותר. במקרים שבהם נדרשת זמינות גבוהה או כוח חישוב שאין במחשב המקומי, עדיף להשתמש בשרת ענן או ב־API חיצוני, במיוחד אם לא רוצים להתעסק בניהול קבצים מקומיים.

ollama run hf.co/mradermacher/Mistral-Nemo-2407-12B-Thinking-Claude-Gemini-GPT5.2-Uncensored-HERETIC-GGUF:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הרישיון לא דווח בעמוד המודל. המשמעות היא שאין הרשאה מפורשת להשתמש בו לצרכים מסחריים, ואי אפשר לדעת אילו הגבלות חלות עליו מבחינה משפטית. לשימוש בתוך מוצר מסחרי מדובר בסיכון, ועדיף להמתין להבהרה מהיוצרים או לבחור מודל עם רישיון פתוח ברור.

הרישיון המלא בעמוד המודל ↗