GPT
D

decapoda-research-llama-7B-hf

קוד פתוח

baffo32other2023-04-10

  • transformers
  • pytorch
  • llama
  • text-generation
  • text-generation-inference

הסבה ישירה של משקלי LLaMA הראשונים לשימוש פשוט בספריית transformers. פתרון מתאים למי שחוקר את הבסיס המקורי של מטא ורוצה לטעון אותו בלי המרות ידניות מסורבלות.

  • 12.6 GBמשקל הקבצים
  • 1,475הורדות בחודש
  • 68לייקים
  • 32שכבות

מה זה

מדובר במודל שפה גולמי בגודל שבעה מיליארד פרמטרים שפותח במקור על ידי צוות FAIR של מטא ואומן בין סוף 2022 לתחילת 2023. המאגר הספציפי הזה לוקח את המשקלים המקוריים ומסדר אותם בפורמט שמתאים ישירות לספריית transformers, מה שחוסך את הצורך בהרצת סקריפטים של המרה.

המודל אומן על טריליון טוקנים ממקורות רשת כמו CCNet, C4, ויקיפדיה ומאגרי קוד. במבחני היגיון הוא מציג תוצאות טובות לגודלו, כמו 76.5 ב־BoolQ ו־79.8 ב־PIQA, אך נתקע במשימות מורכבות יותר כמו ARC-c עם ציון 47.6. הוא מתנהג כמודל בסיס שמשלים טקסט ולא כמנוע צ'אט שמחזיר תשובות מנוסחות היטב.

מתאים ל

  • מחקר על מודלי בסיס

    ניתוח התנהגות מודלים גולמיים שלא עברו התאמה על ידי בני אדם.

  • אימון ייעודי מקומי

    בסיס להתאמה אישית או כוונון עדין למשימות מוגדרות באנגלית.

  • בדיקת הטיות ורעילות

    מדידת הטיות מובנות בטקסטים שנוצרו מדאטה גולמי מהרשת.

איפה זה נופל

המודל הזה לא עבר אימון עם משוב אנושי, מה שאומר שהוא מייצר הזיות, טקסט פוגעני ותשובות שגויות לעיתים קרובות. הוא מתאים בעיקר לאנגלית. למרות שחומרי האימון כללו עשרים שפות, עברית לא נכללת ברשימת השפות של ויקיפדיה והספרים שנכנסו אליו. אסור בשום אופן לבנות עליו החלטות קריטיות שנוגעות לחיי אדם.

שאלות
נפוצות

האם המודל יודע לענות לשאלות כמו צ'אטבוט?

לא. זהו מודל השלמת טקסט בסיסי שלא אומן לעקוב אחרי הוראות או לנהל שיחה, והוא עלול להמשיך את השאלה במקום לענות עליה.

האם אפשר להשתמש בו במוצר מסחרי?

לא, הרישיון המקורי הוא מחקרי ולא מסחרי, כך ששימוש בתוך מוצר מפר את תנאי השימוש.

איך המודל מתמודד עם עברית?

הוא אינו מיועד לעברית. נתוני האימון התמקדו באנגלית ובשפות אירופיות מסוימות, ועברית אינה חלק מהשפות המוצהרות במאגרי הטקסט שלו.

איך מריצים

כדי להריץ אותו בדיוק float16 מלא תצטרכו להקצות קצת יותר מ־12.6 ג'יגה-בייט של זיכרון כרטיס מסך, כך שכרטיס של 16 ג'יגה-בייט מחזיק אותו היטב. המודל מחולק כאן ל־42 קבצים שונים, אז תהליך ההורדה והטעינה הראשונית ייקח קצת זמן ודורש חיבור יציב.

אם אתם צריכים רק מענה מהיר לשאלות או ממשק שיחה מוכן, פנייה ל־API חיצוני עדיפה בהרבה על תחזוקה עצמאית של תשתית כבדה כזו.

from transformers import pipeline

pipe = pipeline("text-generation", model="baffo32/decapoda-research-llama-7B-hf")
print(pipe("שלום"))

הקבצים

42 קבצים במאגר, 12.6 GB סך הכול. הקישורים מובילים ישירות ל־Hugging Face.

הרישיון

הרישיון מוגדר תחת רישיון ייעודי לא-מסחרי של מטא. הוא נועד למטרות מחקר בלבד, ואסור לחלוטין לשלב את המשקלים האלה במוצר מסחרי או בשירות בתשלום.

הרישיון המלא בעמוד המודל ↗