GPT
M

Mixtral-8x7B-Instruct-v0.1

קוד פתוח

mistralaiapache-2.02023-12-10

  • vllm
  • safetensors
  • mixtral
  • fr
  • it

ארכיטקטורת מומחים שנותנת ביצועים ברמה של מודלי ענק עם דרישות חישוב נמוכות יותר בפועל. מתאים למי שרוצה חלופת קוד פתוח חזקה לשיחה ולהוראות באנגלית ובאירופאיות.

  • 47Bפרמטרים
  • 32,768טוקנים בהקשר
  • 177 GBמשקל הקבצים
  • 235,912הורדות בחודש

מה זה

מדובר במודל מבוסס תערובת מומחים דלילה שכולל קרוב ל־47 מיליארד פרמטרים בסך הכול, אבל מפעיל רק חלק קטן מהם בכל צעד חישוב. Mistral AI מדווחים שהוא עוקף את Llama 2 70B ברוב המבחנים שהם בדקו, מה שאומר שאתם מקבלים איכות תשובות של מודל ענק עם זמני תגובה מהירים בהרבה.

הוא עבר כוונון ייעודי להבנת הוראות ושיחה, ומגיע עם תמיכה בחלון הקשר של 32,768 טוקנים. מעבר לאנגלית, המודל אומן ותומך ישירות בצרפתית, איטלקית, גרמנית וספרדית. אין כאן תמיכה רשמית בעברית, ולכן פניות בעברית ייצרו פלט פחות עקבי או ידרשו מכם תרגום מקדים.

מתאים ל

  • בוטים באנגלית ואירופאיות

    הוא מציג הבנה טובה של שפות אירופיות ומחזיר תשובות מהירות יחסית לגודל שלו בזכות חלוקת המומחים.

  • ניתוח מסמכים בינוניים

    חלון הקשר של מעל 32 אלף טוקנים מאפשר להזין טקסטים ארוכים ולחלץ מהם תובנות או סיכומים.

  • שרת פנימי מאובטח

    רישיון אפאצ'י מאפשר לטעון אותו בשרתי החברה דרך vLLM ולעבד מידע רגיש בלי לשלוח שום דבר החוצה.

איפה זה נופל

היוצרים מגדירים את גרסת ה־Instruct הזו כהדגמה מהירה של יכולות הכוונון, והם כותבים מפורשות שאין במודל שום מנגנוני סינון או מודרציה. זה אומר שהוא עלול לייצר פלטים רעילים, מוטים או בעייתיים בלי שום חסימה מובנית.

בנוסף, הוא רגיש מאוד לפורמט הפנייה. הכרטיס מזהיר שחייבים להקפיד בדיוק על תבנית ההוראות עם התגיות הייעודיות, אחרת האיכות של התשובות יורדת בצורה מורגשת. אם המוצר שלכם פונה לקהל רחב, תצטרכו לבנות שכבת בדיקות וסינון משלכם לפני החשיפה למשתמשים.

אותה משפחה

Mixtral יצא ב־4 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם המודל יודע לעבוד בעברית בצורה שוטפת?

השפות שנתמכות רשמית בכרטיס המודל הן אנגלית, צרפתית, איטלקית, גרמנית וספרדית בלבד. הוא מסוגל לקלוט מילים בעברית בזכות אימון כללי, אבל לא מומלץ להסתמך עליו למשימות מורכבות בעברית כי אוצר המילים והדיוק שלו בשפה מוגבלים.

למה התשובות שאני מקבל נראות מקוטעות ולא מדויקות?

הכרטיס מדגיש שחייבים להקפיד על מבנה הטוקניזציה המדויק עם תגיות ההוראה של מיסטרל, או להשתמש ישירות ב־chat template של הספריה. סטייה מהפורמט גורמת למודל לייצר פלטים ברמה ירודה בהרבה מהיכולת האמיתית שלו.

איך מריצים

כדי להריץ אותו כמו שהוא בדיוק bfloat16 או float16, תצטרכו הורדה של 177 גיגה בייט וכמות מכובדת של זיכרון גרפי, לפחות שני כרטיסי A100 או מקבילים של 80 גיגה בייט כדי להחזיק את כל המשקלים וההקשר. אפשר לכווץ את הדרישות דרך קוונטיזציה של 4 ביט או 8 ביט באמצעות bitsandbytes, או לטעון אותו בעזרת Flash Attention 2 וספריית vLLM כדי לשרת פניות ביעילות סבירה.

אם אין לכם שרת ייעודי כזה פועל כל הזמן, העלות של החזקת החומרה תהיה כבדה מאוד. במצב כזה עדיף לשלם לפי קריאה ל־API מנוהל שמגיש אותו, ולשמור את ההרצה העצמית רק למקרים שבהם המידע חייב להישאר אצלכם בשרת בגלל פרטיות.

pip install -U huggingface_hub
hf download mistralai/Mixtral-8x7B-Instruct-v0.1

הרישיון

המודל שוחרר ברישיון apache-2.0. זהו רישיון קוד פתוח מתירני שמאפשר שימוש מסחרי מלא, שינוי של המשקלים, שילוב במוצרים פרטיים והפצה מחדש. הדרישה העיקרית היא שמירה על הודעת זכויות היוצרים והרישיון המקורי, בלי תמלוגים או חובת שיתוף של הקוד שלכם.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗