GPT
O

openchat_3.5

קוד פתוח

openchatapache-2.02023-10-30

  • transformers
  • pytorch
  • mistral
  • text-generation
  • openchat

גרסת קוד פתוח בגודל 7B שמציגה ביצועי שיחה דומים לגרסאות מוקדמות של ChatGPT. היא מתאימה למי שמחפש מודל קל יחסית שרץ על כרטיס מסך בודד.

  • 8,192טוקנים בהקשר
  • 13.5 GBמשקל הקבצים
  • 1,059הורדות בחודש
  • 1,140לייקים

מה זה

הבסיס כאן הוא Mistral עם ארכיטקטורת 32 שכבות, שעבר אימון בשיטה שנקראת C-RLFT. השיטה הזו מאפשרת למודל ללמוד ממאגרי מידע באיכויות מעורבות בלי צורך בתיוג ידני של העדפות, וכך הוא מצליח לסחוט יכולות שיחה גבוהות ממספר פרמטרים צנוע.

במבחני ביצועים הוא קיבל ציון 7.81 ב־MT-Bench, שמציב אותו מעל מודלים פתוחים גדולים בהרבה של 70B ומאוד קרוב ל־ChatGPT ממרץ 2023 שקיבל 7.94. במבחן הקוד HumanEval הוא הגיע ל־55.5 ובמבחן המתמטיקה GSM8k ל־77.3, מה שמראה יכולת פתרון בעיות טובה יחסית לגודל שלו, אם כי במבחני חשיבה מורכבים כמו MMLU הוא עדיין עומד על 64.3 ונשאר מוגבל ביחס למודלים ענקיים.

מתאים ל

  • בוט שיחה עצמאי

    הוא מציג ציון 7.81 ב־MT-Bench ויכול לשמש כעוזר שיחה מקומי שלא דורש שרתי ענק.

  • עוזר לפיתוח קוד בסיסי

    כולל מצב ייעודי לכתיבת קוד והגיע לתוצאה של 55.5 במבחן HumanEval.

  • מערכת מענה על שאלות

    תומך בחלון הקשר של 8,192 טוקנים ומאפשר שליפת מידע מטקסטים ארוכים.

איפה זה נופל

למרות הציונים היפים, המודל סובל מכל המגבלות של מודלי בסיס קטנים. הוא נוטה להזיות של מידע שאינו קיים, מתקשה במשימות חשיבה מורכבות, ועלול להיכשל בחישובים מתמטיים או באתגרי תכנות מסובכים. היוצרים מציינים במפורש שהוא מייצר לעיתים תוכן פוגעני, מוטה או תשובות לשאלות לא בטוחות, ולכן חובה להציב מנגנוני סינון ובקרה לפני שחושפים אותו למשתמשי קצה.

שאלות
נפוצות

איזה כרטיס מסך צריך כדי להריץ אותו?

הקבצים שוקלים 13.5GB ולפי תיעוד הפרויקט מומלץ להשתמש בכרטיס מסך עם לפחות 24GB זיכרון. הרצה באמצעות vLLM תיתן את המענה המהיר ביותר לעומס בקשות.

האם המודל בטוח לשימוש מיידי מול לקוחות?

לא בלי שכבת הגנה נוספת. הכרטיס מזהיר במפורש מפני יצירת מידע שגוי, הטיות ותשובות שאינן בטוחות, כך שחובה להוסיף מנגנוני סינון ובדיקת עובדות.

איך מריצים

המשקל הכולל של הקבצים הוא 13.5GB בפורמט bfloat16. כדי להריץ אותו בהספק סביר תצטרכו כרטיס מסך מקומי עם 24GB זיכרון, והמפתחים ממליצים להשתמש בשרת API מבוסס vLLM שתומך בפרוטוקול של OpenAI ישירות בפורט 18888.

אפשר להריץ אותו גם דרך transformers הרגיל אבל הביצועים יהיו איטיים משמעותית. אם אין לכם חומרה ייעודית עם 24GB VRAM או שאתם לא צריכים שרת שרץ מקומית מטעמי פרטיות, פשוט יותר לצרוך מודלים דרך API חיצוני ולא לתחזק שרת עצמאי.

from transformers import pipeline

pipe = pipeline("text-generation", model="openchat/openchat_3.5")
print(pipe("שלום"))

הרישיון

הפרויקט מופץ תחת רישיון apache-2.0 מלא. זה אומר שמותר להשתמש בו לצרכים מסחריים, לשנות את הקוד והמשקולות ולהטמיע אותו במוצרים פנימיים או חיצוניים בלי לשלם תמלוגים, כל עוד שומרים על תנאי הרישיון המקוריים ומצרפים את הקרדיט הנדרש.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗