GPT
M

MN-12B-Celeste-V1.9

קוד פתוח

nothingiisrealapache-2.02024-07-31

  • transformers
  • safetensors
  • mistral
  • text-generation
  • conversational

זה כוונון עדין של מיסטרל נמו 12B שנועד ספציפית לכתיבת סיפורים ומשחקי תפקידים ללא צנזורה. מי שבוחר בו מחפש כתיבה אנושית באנגלית ויכולת לשלוט בעלילה בהוראות ישירות.

  • 12Bפרמטרים
  • 1,024,000טוקנים בהקשר
  • 22.8 GBמשקל הקבצים
  • 156הורדות בחודש

מה זה

המודל מתבסס על Mistral NeMo 12B ואומן על דאטהסטים מרדיט של כתיבת פרומפטים, שיחות קלוד מסוננות ויומני שיחה של משחקי תפקידים. המטרה כאן ממוקדת לגמרי: פרוזה יצירתית, דיאלוגים מורכבים ועמידה בתוכן למבוגרים בלי סירובים מיותרים. הוא הותאם לעבוד עם מבנה ChatML כדי למנוע זליגה של טוקני סיום שיחה.

בניגוד למודלי שיחה כלליים בגודל הזה שנוטים ליישר קו עם תבניות תאגידיות, כאן אימנו אותו להגיב להנחיות חיצוניות מתוך הטקסט כמו הוראות במאי. המפתחים מדווחים שהוא פחות סובל מהזיות ומשגיאות עיצוב ביחס לחלופות כמו לאמה 3, אבל כן נוטה לחזרתיות אם לא משחקים עם הגדרות הדגימה.

מתאים ל

  • משחקי תפקידים מותאמים

    הוא מגיב מצוין להנחיות OOC ומחזיק דמויות מורכבות בעזרת כרטיסי עולם בלי לשבור אופי.

  • כתיבת סיפורים קצרים

    האימון על פרומפטים אנושיים נותן פרוזה טבעית יותר ופחות קלישאתית בהשוואה למודלים גנריים.

  • יצירת תוכן ללא צנזורה

    הוא כמעט לא מסרב לבקשות של תוכן אפל, מורכב או בוגר, וממשיך את העלילה בלי לחנך.

איפה זה נופל

האימון נעשה בהקשר של 8K טוקנים בלבד, למרות שמודל הבסיס תומך בחלון ארוך בהרבה, כך שהסתמכות על עלילות ארוכות מעבר ל־16K טוקנים עלולה לפגוע בעקביות. המפתחים עצמם מציינים שהמודל נוטה לסיים סצנות מהר מדי, בעיה שמחייבת חיתוך ידני של התשובות או הגבלת טוקנים נוקשה.

בנוסף, הוא מיועד לשפה האנגלית בלבד ולא מתאים למשימות בעברית. היכולות הלוגיות והבנת ההוראות הכלליות שלו חלשות יותר ממודל הבסיס של מיסטרל, והוא דורש עריכה של ההודעות הראשונות כדי לייצב את סגנון הכתיבה.

שאלות
נפוצות

איך שולטים בכיוון העלילה כשהמודל נתקע?

אפשר להכניס הערות ישירות בתוך הטקסט עם הקידומת OOC, כמו למשל הנחיה לדמות לפעול בתקיפות. המודל אומן לקבל את ההוראות האלה בכל שלב בשיחה ולשנות גישה מיד.

האם הוא מתאים ליישומי קוד, ניתוח נתונים או צ'אט כללי?

לא, המודל הזה כוונן באופן בלעדי לכתיבה יצירתית ולמשחקי תפקידים. הכוונון פגע ביכולות הכלליות שלו, ולמשימות הנדסיות או עסקיות עדיף להשתמש במיסטרל נמו המקורי.

איך מריצים

המשקל המקורי עומד על 22.8 גיגהבייט בדיוק bfloat16, כך שתצטרכו כרטיס עם לפחות 24 גיגהבייט זיכרון כדי להריץ אותו ישירות. אם החומרה שלכם צנועה יותר, יש גרסאות מכווצות בפורמט GGUF, גרסאות EXL2 וגרסת FP8, שמאפשרות דחיסה לכרטיסים ביתיים עם 12 או 16 גיגהבייט זיכרון.

הוא זמין גם בשרתי API כמו OpenRouter, Featherless ו־Infermatic. אם אתם רק רוצים לבדוק את איכות הכתיבה לפני שאתם מורידים עשרות גיגהבייט ומקצים כוח מחשוב מקומי, קריאה ל־API תחסוך לכם זמן והתעסקות.

from transformers import pipeline

pipe = pipeline("text-generation", model="nothingiisreal/MN-12B-Celeste-V1.9")
print(pipe("שלום"))

הרישיון

הפרויקט מופץ ברישיון Apache 2.0. הרישיון הזה מתיר שימוש מסחרי מלא, שינוי של המשקלים והפצה חופשית, בתנאי שאתם שומרים על הודעת זכויות היוצרים והרישיון המקורי. אין כאן הגבלות שימוש ייחודיות מעבר לתנאי הבסיס של אפאצ'י.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗