GPT
M

Mistral-Nemo-2407-12B-Thinking-Claude-Gemini-GPT5.2-Uncensored-HERETIC

קוד פתוח

DavidAUרישיון לא דווח2026-01-09

  • transformers
  • safetensors
  • mistral
  • text-generation
  • uncensored

שילוב בין בסיס של 12 מיליארד פרמטרים, הסרת הגנות מוחלטת ומנגנון חשיבה מובנה. מתאים למי שחייב מודל שלא יסרב לשום בקשה ושמסוגל להפיק טקסטים מורכבים.

  • 12Bפרמטרים
  • 1,024,000טוקנים בהקשר
  • 22.8 GBמשקל הקבצים
  • 1,845הורדות בחודש

מה זה

הבסיס כאן הוא Mistral Nemo Instruct, שעבר שני שלבים מהותיים. קודם כל ניקו ממנו את מנגנוני הסירוב, לפי נתוני היוצר משיעור סירובים של 87 מתוך 100 ל־14 מתוך 100 בלבד. לאחר מכן אימנו אותו עם ערכות נתונים של חשיבה שמבוססות על מודלים מתקדמים, במטרה לייצר בלוקים קצרים וממוקדים של תהליך חשיבה לפני התשובה עצמה.

בלוקי החשיבה תופסים בין 300 ל־600 טוקנים, לרוב 3 עד 6 פסקאות, ולא נמרחים סתם. תהליך החשיבה הזה מייצר פלטים מפורטים ועמוקים יותר, בלי תלות בטמפרטורת הדגימה, שעובדת בין 0.1 ל־2.5 ומעלה. עם זאת, מבחני הביצועים שמופיעים בדף שייכים כולם לגרסת המקור של מיסטרל ולא נמדדו מחדש אחרי הסרת ההגנות והאימון הנוסף, כך שקשה לדעת איך השינויים השפיעו על הדיוק הכללי.

מתאים ל

  • כתיבת סיפורי אימה גרפיים

    הוא אומן להפיק תיאורים אלימים, אימה קשה וקללות בלי לצנזר או לעצור.

  • משחקי תפקידים ללא הגבלות

    הוא מתעלם מכללי בטיחות ומאפשר שיחות עמוקות בזכות בלוקי החשיבה המובנים.

  • מחקר על מודלים נטולי סירוב

    שיעור הסירובים ירד ל־14 מתוך 100, מה שמאפשר לבחון עמידות וגבולות של מודלי שפה.

איפה זה נופל

העברית כלל לא נבדקה ולא מופיעה ברשימת השפות הנתמכות, שכוללת רק אנגלית, צרפתית, גרמנית, ספרדית, איטלקית, פורטוגזית, רוסית וסינית. מעבר לזה, המודל פתוח לחלוטין לתוכן קיצוני, אימה, קללות ותיאורים גרפיים קשים. אם אתם בונים מוצר שפונה לקהל רחב, הוא עלול לפלוט תוכן אלים ללא שום מנגנון בלימה.

שאלות
נפוצות

האם המודל יסרב לבקשות של תוכן רגיש או קיצוני?

ברוב המקרים לא. תהליך ההסרה הוריד את שיעור הסירוב מ־87 מתוך 100 ל־14 בלבד. הוא מוגדר במפורש לפלוט תוכן ישיר, בוטה וחסר צנזורה.

האם אפשר להשתמש בו ישירות בעברית?

עברית אינה מופיעה ברשימת השפות הנתמכות של המודל. סביר להניח שהיכולת שלו בעברית תהיה חלשה ומקוטעת, ואם הממשק שלכם דורש עברית עדיף לבדוק חלופה אחרת.

איך מפעילים את מנגנון החשיבה בצורה מיטבית?

אסור להגדיר לו system prompt, כי הבלוקים נוצרים לבד. היוצר ממליץ על חלון הקשר של 8k טוקנים לפחות, ושימוש במודל מכווץ ברמה של Q4KS לפחות כדי לא לפגוע בהפעלת החשיבה.

איך מריצים

המשקל הכולל של הקבצים בפורמט המקורי מגיע ל־22.8 גיגה בייט המחולקים ל־15 קבצים. היוצר ממליץ לחפש או להמיר לגרסאות מכווצות כמו Q4KS או IQ3_M, ומציין במפורש שכיווץ אגרסיבי יותר יפגע ביכולת של מודל החשיבה להידלק ולעבוד נכון.

ההנחיות קובעות שלא להשתמש ב־system prompt בכלל, כי תגיות החשיבה נוצרות לבד. בנוסף מומלץ לקבוע חלון הקשר של לפחות 8k טוקנים, rep pen של 1.05 ומטה, ובתוכנות כמו KoboldCpp או Silly Tavern להגדיר smoothing factor על 1.5 כדי למנוע חזרות.

from transformers import pipeline

pipe = pipeline("text-generation", model="DavidAU/Mistral-Nemo-2407-12B-Thinking-Claude-Gemini-GPT5.2-Uncensored-HERETIC")
print(pipe("שלום"))

הרישיון

היוצר לא דיווח על שום רישיון בעמוד המודל. מבחינה משפטית מדובר בשטח הפקר, אין אישור מפורש לשימוש מסחרי, ואין הבהרה באילו תנאים מותר להפיץ אותו. לשימוש אישי במחשב שלכם זה לא משנה, אבל להטמיע אותו במוצר של חברה זה סיכון שאסור לקחת.

הרישיון המלא בעמוד המודל ↗