GPT
L

Llama-3-Instruct-8B-SPPO-Iter3

קוד פתוח

UCLA-AGIapache-2.02024-06-25

  • transformers
  • safetensors
  • llama
  • text-generation
  • conversational

גרסה מכווננת של מודל ההוראות מבית מטא שנוצרה באוניברסיטת UCLA. היא מיועדת למי שמחפש היענות טובה יותר לפרומפטים באנגלית בלי להגדיל את נפח הזיכרון הנדרש.

  • 8Bפרמטרים
  • 8,192טוקנים בהקשר
  • 15.0 GBמשקל הקבצים
  • 8,437הורדות בחודש

מה זה

החוקרים ב־UCLA לקחו את מודל ההוראות של מטא ואימנו אותו מחדש בשיטת יישור שנקראת SPPO. במקום להסתמך על תיוג אנושי חדש, האימון התבסס כולו על דאטה סינתטי שמחולק לשלושה סבבים, וזו הגרסה שסיימה את הסבב השלישי.

התוצאות במבחני הביצועים מראות שהתהליך בעיקר שיפר את היכולת לענות בצורה משכנעת. ב־AlpacaEval שיעור הניצחון שלו עומד על 39.85 אחוזים, קפיצה של כמה אחוזים לעומת הסבב הראשון. במבחני ידע קלאסיים כמו MMLU עם ציון 65.60 או מתמטיקה עם 74.91 ב־gsm8k, השינוי כמעט לא מורגש בהשוואה לגרסאות הקודמות.

מתאים ל

  • מענה מובנה להנחיות באנגלית

    משיג ציון 68.28 ב־IFEval, מה שהופך אותו למתאים למשימות הדורשות הקפדה על פורמט ומבנה.

  • צ'אטבוט לשירות לקוחות

    מציג שיעור ניצחון גבוה ב־AlpacaEval ויודע לייצר תשובות ארוכות ומשכנעות.

  • ניסויי יישור על גבי 8B

    נקודת מוצא טובה לחוקרים שרוצים לבדוק ביצועים של מודלים שאומנו על דאטה סינתטי.

איפה זה נופל

המודל אומן רק באנגלית, כך שאין מה לבנות עליו לעבודה בעברית. בנוסף, במבחנים מתקדמים של חשיבה ופתרון בעיות המספרים נמוכים מאוד: ציון של 7.33 ב־MATH Lvl 5 ורק 2.01 ב־GPQA. המשמעות היא שהוא כותב יפה ועוקב טוב אחרי הוראות עם ציון 68.28 ב־IFEval, אבל יתקשה במשימות לוגיות מורכבות או בחישובים מדויקים.

שאלות
נפוצות

האם המודל הזה תומך בעברית?

הכרטיס מצהיר על תמיכה באנגלית בלבד. כל הדאטה הסינתטי באימון היה באנגלית, ולכן לא מומלץ להשתמש בו ליישומים בעברית.

מה ההבדל בין Iter3 לגרסאות 1 ו־2 מאותה סדרה?

הסבב השלישי מציג את התוצאות הגבוהות ביותר ב־AlpacaEval עם אורך תשובה ממוצע של 2,066 תווים. במבחני ידע כלליים ההבדלים ביניהם שוליים למדי.

איך מריצים

המשקל הכולל של הקבצים עומד על 15 גיגה־בייט בפורמט bfloat16, כך שצריך כרטיס מסך עם לפחות 16 גיגה־בייט זיכרון כדי לטעון אותו, או כרטיס של 24 גיגה־בייט כדי להריץ הסקת מסקנות בצורה יציבה עם קונטקסט מלא. אפשר לטעון אותו ישירות דרך ספריית transformers של פייתון.

אם אין לכם שרת ייעודי או כרטיס מתאים, להחזיק תשתית כזו בענן בשביל מודל 8B זה בזבוז זמן וכסף. במקרים כאלה עדיף לגשת ישירות ל־API מסחרי שמריץ מודלים פתוחים, במיוחד אם אתם רק בודקים התכנות.

from transformers import pipeline

pipe = pipeline("text-generation", model="UCLA-AGI/Llama-3-Instruct-8B-SPPO-Iter3")
print(pipe("שלום"))

הרישיון

החוקרים דיווחו על רישיון apache-2.0, שמאפשר שימוש מסחרי, שינוי קוד והפצה חופשית בלי תמלוגים. יחד עם זאת, הבסיס שעליו הוא נבנה הוא מודל של מטא, ולכן חשוב לבדוק את תנאי השימוש המקוריים של Llama 3 לפני שמשלבים אותו במוצר מסחרי רחב.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗