GPT
M

Mistral-22B-v0.2

קוד פתוח

Vezoraapache-2.02024-04-13

  • transformers
  • safetensors
  • mistral
  • text-generation
  • text-generation-inference

דחיסה נסיונית שממזגת מודל מומחים לרשת רגילה של 22 מיליארד פרמטרים. היא מיועדת למי שמחפש מודל פתוח לגמרי בלי צנזורה ומוכן להתמודד עם פרויקט בשלבי פיתוח מוקדמים.

  • 22Bפרמטרים
  • 65,536טוקנים בהקשר
  • 41.4 GBמשקל הקבצים
  • 76הורדות בחודש

מה זה

ניקולס מחיה-פטי מציג כאן ניסוי מעניין של זיקוק ידע מרשת מומחים לתוך מודל יחיד וצפוף בגודל 22B פרמטרים, במקום להחזיק ארכיטקטורת תערובת מומחים כבדה. המטרה היא לקבל את הידע של מודל גדול בהרבה בתוך מבנה פשוט וישיר יותר.

היוצר מדווח שהגרסה הזו אומנה על כמות נתונים גדולה פי שמונה מהגרסה הראשונה, בעיקר שיחות מרובות שלבים, קוד ומשימות סוכנים כמו ניווט בעמודי רשת לפי קוד מבנה. אין כאן מבחני ביצועים מסודרים או מדדים השוואתיים רשמיים, אלא בדיקות אישיות קטנות שהראו שהוא מצליח לייצר דף אינטרנט בסיסי שמשנה צבע רקע, משימה שהגרסה הקודמת נכשלה בה.

מתאים ל

  • מחקר על דחיסת מודלים

    בדיקת ההשפעה של מיזוג מודל מומחים למבנה רגיל.

  • ניסויי סוכנים בקוד פתוח

    אימון על משימות ניווט ושימוש בכלים בפורמט נתונים מובנה.

  • עבודה ללא מנגנוני סינון

    מחקר או יצירה שדורשים מודל שלא חוסם בקשות באופן אוטומטי.

איפה זה נופל

זהו מודל ניסיוני לחלוטין שנמצא בעיצומו של תהליך עבודה, והיוצר עצמו כבר עבר לאמן את הגרסאות הבאות. אין שום מבחני בנצ'מרק סטנדרטיים שמאמתים את יכולות המתמטיקה או הקוד שלו מעבר לבדיקות בודדות. בנוסף, המודל עבר הסרת צנזורה ולכן מייצר כל תוכן ללא הגבלה או הגנות בטיחות, ואי אפשר לשלב אותו במוצר בלי לבנות מנגנון סינון קפדני משלכם.

אותה משפחה

Mistral יצא ב־2 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם המודל הזה מתאים לשימוש יציב בייצור?

לא. מדובר בניסוי מוקדם של מפתח עצמאי ללא בדיקות ביצועים מקיפות, וכבר בעת שחרורו הוכרז על אימון גרסאות המשך עם ארכיטקטורה שונה.

מדוע חובה להשתמש בתבנית הפרומפט של Guanaco?

האימון התבצע כולו עם התגיות של Guanaco שמפרידות בין המערכת, המשתמש והעוזר. חריגה מהמבנה הזה גורמת למודל להתבלבל ולייצר פלטים שבורים.

איך מריצים

המשקל הכולל של הקבצים מגיע ל־41.4 גיגה-בייט בדיוק bfloat16. כדי להריץ אותו בלי כימות תצטרכו כרטיס מקצועי עם 48 גיגה זיכרון גרפי לפחות, או שני כרטיסי 24 גיגה, וזה עוד לפני שלוקחים בחשבון את הזיכרון הנדרש להקשר ארוך.

אם אין לכם חומרה כזו ייעודית, או אם אתם לא מחפשים לבצע מחקר ספציפי על דחיסת מודלים, זול ופשוט יותר להשתמש ב־API של מודל מסחרי מוכן. מי שכן מריץ מקומית חייב להשתמש במבנה התבנית של Guanaco, אחרת איכות התשובות נפגעת משמעותית.

from transformers import pipeline

pipe = pipeline("text-generation", model="Vezora/Mistral-22B-v0.2")
print(pipe("שלום"))

הרישיון

הרישיון הוא Apache 2.0. זהו רישיון קוד פתוח מתירני שמאפשר שימוש מסחרי, שינוי של הקוד והפצה חופשית, בתנאי ששומרים על הודעת זכויות היוצרים והרישיון המקורי. אפשר לשלב אותו בפרויקטים פנימיים או מסחריים בלי לשלם תמלוגים.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗