GPT
O

OpenHermes-2.5-Mistral-7B

קוד פתוח

tekniumapache-2.02023-10-29

  • transformers
  • pytorch
  • safetensors
  • mistral
  • text-generation

אימון של מיסטרל שבעה מיליארד על מיליון דוגמאות סינתטיות בעיקר מג'יפיטי ארבע. הוא נותן קפיצה משמעותית בקוד ובשיחה בלי לדרוש שרתים מפלצתיים.

  • 7.2Bפרמטרים
  • 32,768טוקנים בהקשר
  • 27.0 GBמשקל הקבצים
  • 5,049הורדות בחודש

מה זה

הבסיס כאן הוא מודל מיסטרל עם שבעה נקודה שניים מיליארד פרמטרים שעבר כוונון עדין על מיליון רשומות, בעיקר נתונים שיוצרו עם ג'יפיטי ארבע. האימון שילב בין שבעה לארבעה עשר אחוז נתוני קוד. השילוב הזה הקפיץ את הביצועים גם במשימות כלליות לגמרי, כמו מבחני ידע והיגיון, ולא רק בתכנות.

במבחן היומן־אוול למשל, הגרסה הזו עלתה מ־43 אחוז הצלחה בריצה ראשונה ל־50.7 אחוז ביחס לגרסה שקדמה לה. הוא משתמש בפורמט צ'אט־אם־אל, אותו מבנה הודעות שמכירים מהממשק של אופן איי איי, מה שמאפשר לו להחזיק שיחות מרובות תורות ולהישמע להוראות מערכת קפדניות הרבה יותר טוב ממודלים פתוחים ישנים יותר בגודל הזה.

מתאים ל

  • בוט שיחה לאתר באנגלית

    תמיכה מלאה בפורמט צ'אט־אם־אל מאפשרת ניהול תפקידים ושיחות ארוכות בהתבסס על פרומפט מערכת קשיח.

  • סיוע בכתיבת סקריפטים

    ציון של 50.7 אחוז במבחן יומן־אוול מספק יכולת טובה לחילוץ פונקציות קצרות וקוד פייתון פשוט.

  • עיבוד מקומי של מידע רגיש

    מאפשר ריצה מקומית על חומרה צנועה יחסית ללא תלות ברשת חיצונית ובלי לשלוח מידע לצד שלישי.

איפה זה נופל

למרות השיפור הכללי, הוספת נתוני הקוד באימון פגעה ישירות בביצועים שלו במבחן ביג־בנץ'. בנוסף, שפת המודל המוגדרת היא אנגלית בלבד, כך שלא הייתי בונה עליו לעיבוד טקסטים מורכבים בעברית. המודל הסתמך בכבדות על נתונים סינתטיים ממודל מסחרי חזק, מה שעלול לייצר ביטחון עצמי מופרז בתשובות שגויות. צריך לבדוק אותו ביסודיות מול מקרי קצה ספציפיים לפני שסומכים עליו בתהליכים אוטומטיים.

שאלות
נפוצות

האם המודל מתאים לעבודה שוטפת בעברית?

הכרטיס מגדיר אנגלית כשפה נתמכת בלבד. הוא עשוי לפלוט עברית מקוטעת פה ושם, אבל אי אפשר להסתמך עליו למשימות עסקיות או ניתוח טקסטים מקומיים.

האם חייבים 27 ג'יגה זיכרון וידאו כדי להשתמש בו?

לא. המשקל הזה שייך למשקלים המקוריים בדיוק מלא. אפשר להוריד גרסאות מכווצות של הקהילה בפורמטים כמו ג'י־ג'י־יו־אף שמסתפקות בפחות מעשרה ג'יגה של זיכרון עבודה רגיל.

איך מגדירים לו התנהגות קבועה מראש?

משתמשים בתגית מערכת בפורמט צ'אט־אם־אל לפני הודעת המשתמש. המודל אומן ספציפית לציית להנחיות שמופיעות בחלק הזה לאורך מספר שלבים בשיחה.

איך מריצים

המשקל המלא בדיוק של בי־פלואוט שש־עשרה תופס 27 ג'יגה־בייט ומחולק לחמישה עשר קבצים. כדי להריץ אותו ככה במקור תצטרכו כרטיס מסך עם לפחות 16 עד 24 ג'יגה זיכרון וידאו. מי שרוצה להריץ אותו מקומית על מחשב אישי יפנה כמעט תמיד לגרסאות מכווצות כמו ג'י־ג'י־יו־אף או קוואנטים אחרים דרך כלים דוגמת אל־אם סטודיו.

אם אתם צריכים רק מענה מזדמן ולא מערכת שרצה אצלכם בתוך הרשת הפרטית, עדיף לפנות לממשק רשת מנוהל שמוכר טוקנים. הקמה ותחזוקה של מכונה ייעודית עם כרטיס תואם שוות את המאמץ רק כשיש דרישה ברורה לפרטיות מידע או תעבורה רציפה.

from transformers import pipeline

pipe = pipeline("text-generation", model="teknium/OpenHermes-2.5-Mistral-7B")
print(pipe("שלום"))

הרישיון

הפרויקט מופץ תחת רישיון אפאצ'י שתיים אפס. מותר להשתמש בו לצרכים מסחריים, לשנות את הקבצים ולשלב אותם במוצרים סגורים, בתנאי ששומרים על הודעת זכויות היוצרים והרישיון המקורי.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗