GPT
M

Moistral-11B-v3

קוד פתוח

BeaverLegacycc-by-nc-4.02024-04-24

  • transformers
  • safetensors
  • llama
  • text-generation
  • not-for-all-audiences

התאמה אישית לאימון של Fimbulvetr שנועדה לכתיבת סיפורים ומשחקי תפקידים למבוגרים. הוא מציע סגנון בוטה ואוצר מילים ממוקד בלי הצנזורה של מודלים תאגידיים רגילים.

  • 11Bפרמטרים
  • 8,192טוקנים בהקשר
  • 20.0 GBמשקל הקבצים
  • 95הורדות בחודש

מה זה

מדובר במודל שפה מבוסס LlamaForCausalLM עם ארבעים ושמונה שכבות, שעבר כוונון אגרסיבי של Fimbulvetr v2 במטרה לייצר תוכן ארוטי וסיפורי עלילה. בגרסה הזו המפתחים הרחיבו את מערך הנתונים של הטקסט הממוקד לחלון של שמונת אלפים טוקנים, וניקו ביטויים טיפוסיים של ChatGPT כדי לתת לטקסט תחושה של כתיבה אנושית חופשית יותר.

המבנה שלו מתאים לפורמט של הוראות בסגנון Alpaca, מה שמספק שליטה בכתיבה מכמה נקודות מבט שונות, כמו דמות בעלילה, קריין או במאי שמכוון את ההתרחשות. הוא כולל תמיכה בז'אנרים מגוונים של פנטזיה, מדע בדיוני ורומנטיקה, ומכוון לייצר תגובות באורך שתואם להקשר שאתם בונים בתחילת הריצה בלי לקצר תשובות.

מתאים ל

  • משחקי תפקידים למבוגרים

    הוא אומן על טקסטים ארוטיים חופשיים ומגיב היטב להנחיות בגוף ראשון או שני.

  • כתיבת סיפורי פנטזיה ורומן

    מערך הנתונים שלו נוקה מביטויים רובוטיים ומכוון לייצר עלילות ארוכות לפי הוראות.

  • בימוי סצנות אינטראקטיבי

    המבנה שלו מתאים לקבלת פקודות בימוי דרך Alpaca ומשנה את התנהגות הדמויות בהתאם.

איפה זה נופל

המודל הזה לא נועד למשימות קלאסיות כמו כתיבת קוד, ניתוח מסמכים או מענה על שאלות עובדתיות. כל האימון שלו נבנה סביב תוכן ארוטי וכתיבה עלילתית, ולכן הוא ייטה להכניס מוטיבים כאלה או לסטות מנושאים מקצועיים. מעבר לזה, המפתחים מודים שבתחילת יצירת סיפור צריך לייצר מחדש את התשובות כמה פעמים עד שהמודל מיישר קו עם האורך המבוקש.

אותה משפחה

Moistral יצא ב־2 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם המודל הזה מתאים לשימוש כללי באפליקציה שלי?

לא. המודל עבר כוונון ייעודי לתוכן מיני ומשחקי תפקידים למבוגרים. הוא אינו מיועד למשימות פרודוקטיביות, סיכום מידע או שירות לקוחות.

איך גורמים לו לייצר תשובות ארוכות יותר בסיפור?

המפתחים מציינים שבתחילת הריצה צריך להמשיך את הפלט או לייצר אותו מחדש מספר פעמים. אחרי כמה סבבים כאלה, המודל מתאים את אורך התגובה שלו באופן אוטומטי להקשר הקיים.

איך מריצים

כדי להריץ את המודל הזה במשקלו המקורי בפורמט float16 תצטרכו לפחות 24 גיגה זיכרון בכרטיס המסך, מה שמחייב כרטיס מקומי חזק או השכרת שרת ענן ייעודי. גודל הקבצים מגיע לעשרים גיגה ומחולק לשנים עשר חלקים דרך ספריית transformers הרגילה.

אם אין לכם חומרה כבדה, עדיף להוריד את גרסאות ה־GGUF או EXL2 שהמפתחים קישרו אליהן. הן דורשות פחות זיכרון ומאפשרות הרצה מקומית סבירה על כרטיסים צנועים יותר.

from transformers import pipeline

pipe = pipeline("text-generation", model="BeaverLegacy/Moistral-11B-v3")
print(pipe("שלום"))

הרישיון

הרישיון הוא cc-by-nc-4.0, וזה אומר שאסור להשתמש במודל הזה לשום מטרה מסחרית. מותר להוריד, להריץ ולשנות אותו לשימוש אישי או מחקרי בלבד, כל עוד נותנים קרדיט למפרסם המקורי. מי שמתכנן להטמיע אותו במוצר רווחי או בשירות בתשלום לא יכול לעשות זאת באופן חוקי.

  • שינוי הקוד
  • חובת ייחוס
  • שימוש מסחרי: לא

הרישיון המלא בעמוד המודל ↗