GPT
L

Lumimaid-v0.2-12B

קוד פתוח

NeverSleepcc-by-nc-4.02024-07-25

  • transformers
  • safetensors
  • mistral
  • text-generation
  • not-for-all-audiences

התאמה אישית על בסיס מיסטרל נמו שמתמקדת בכתיבה יצירתית ומשחקי תפקידים. המפתחים ניקו ממאגרי האימון ניסוחים שבלוניים כדי לקבל שיחה חדה ועשירה יותר.

  • 12Bפרמטרים
  • 1,024,000טוקנים בהקשר
  • 22.8 GBמשקל הקבצים
  • 441הורדות בחודש

מה זה

מדובר בכיוונון עדין למודל Mistral-Nemo-Instruct-2407 שיושב על ארכיטקטורת MistralForCausalLM עם 40 שכבות. המטרה המרכזית בגרסה 0.2 הייתה מחיקה וסינון של תשובות נוסחתיות ומרוחות, מה שמכונה בעולם המודלים slop. לצורך כך שילבו מאגרי שיחות סינתטיים מבוססי קלוד 3, דאטה־סטים של כתיבה יוצרת ותרחישי משחק תפקידים אפלים.

הבסיס מגיע עם חלון הקשר ענק שמגיע תיאורטית עד 1,024,000 טוקנים. זה אומר שאפשר להחזיק היסטוריית שיחה ארוכה במיוחד בלי לאבד את ההקשר, כל עוד החומרה מאפשרת את זה. המפתחים לא צירפו מדידות ביצועים מספריות או בנצ'מרקים בכרטיס, כך שהשיפוט נשען על איכות הטקסט והעקביות בלבד.

מתאים ל

  • משחקי תפקידים בטקסט

    הוא אומן על מגוון מאגרי משחקי תפקידים ועבר ניקוי של תגובות שבלוניות, מה שמתאים לדיאלוגים מורכבים.

  • כתיבה יוצרת ועלילתית

    מאגרי כתיבה כמו WritingPrompts ושיחות קלוד מקנים לו סגנון עשיר שמתאים לטיוטות סיפורים.

  • בדיקת שיחות ארוכות טווח

    חלון ההקשר הגדול מאפשר לבחון איך המודל זוכר פרטים עלילתיים מורכבים לאורך שיחה מתמשכת.

איפה זה נופל

הכרטיס לא כולל שום מדידה מספרית, אין נתוני בנצ'מרק של MMLU או מבחני חשיבה אחרים. הדגש כאן הוא על שיחה וכתיבה, ולכן לא הייתי סומך עליו במשימות קוד, חילוץ מידע מובנה או פתרון בעיות לוגיות מורכבות. בנוסף, האימון כולל דאטה־סטים כמו ToxicQA ושיחות לא מסוננות, כך שהמודל עלול לייצר תוכן בוטה, פוגעני או רעיל בלי אזהרה מוקדמת.

אותה משפחה

Lumimaid יצא ב־5 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם המודל מתאים ליישום מסחרי בחברה?

לא. הרישיון הוא cc-by-nc-4.0, מה שאוסר במפורש שימוש מסחרי מכל סוג. אם אתם בונים שירות למשתמשים משלמים או מוצר עסקי, תצטרכו לחפש מודל בסיס עם רישיון אפאצ'י או MIT.

איך צריך להגדיר את הפרמטרים בריצה?

המפתחים מציינים במפורש להשתמש בטמפרטורה נמוכה, בהתאם להמלצות של מיסטרל עבור Nemo Instruct. חובה גם לשמור על תבנית הפרומפט המקורית עם סוגרי INST כדי שהמודל יבין מתי מדובר בהוראה ומתי בתשובה.

כמה זיכרון כרטיס מסך נחוץ בשביל ההקשר המלא?

אמנם המודל תומך עקרונית בהקשר של מעל מיליון טוקנים, אבל בפועל טעינת הקשר כזה תדרוש כמות עצומה של זיכרון מעבר למשקל הבסיסי של 22.8 ג'יגה־בייט. בכרטיס ביתי של 24 ג'יגה תצטרכו להסתפק בהקשר קצר בהרבה או לבצע קוונטיזציה כבדה.

איך מריצים

המשקלים תופסים 22.8 ג'יגה־בייט בפורמט bfloat16 ומחולקים ל־13 קבצים. כדי להריץ אותו מקומית ברמת דיוק מלאה תצטרכו כרטיס מסך עם לפחות 24 ג'יגה זיכרון, כמו RTX 3090 או RTX 4090, וגם אז כנראה תצטרכו לכווץ אותו לגרסאות 4 או 8 ביט כדי לשמור מקום לזיכרון הקשר רחב.

המודל דורש את תבנית ההוראות המקורית של מיסטרל עם תגי INST. היוצרים ממליצים בפירוש להשתמש בטמפרטורה נמוכה בגלל התנהגות מודל הבסיס, ולבדוק ערכים שונים בהתאם לתוצאה.

from transformers import pipeline

pipe = pipeline("text-generation", model="NeverSleep/Lumimaid-v0.2-12B")
print(pipe("שלום"))

הרישיון

המודל שוחרר תחת רישיון cc-by-nc-4.0. המשמעות ברורה וחדה, אסור להשתמש בו בשום צורה מסחרית או לשלב אותו במוצר שמייצר הכנסות. הוא מיועד למחקר, ניסויים אישיים ופיתוח עצמי בלבד, תוך מתן קרדיט ליוצרים.

  • שינוי הקוד
  • חובת ייחוס
  • שימוש מסחרי: לא

הרישיון המלא בעמוד המודל ↗