GPT
G

gpt2-medium

קוד פתוח

openai-communitymit2022-03-02

  • transformers
  • pytorch
  • tf
  • jax
  • rust

גרסת 380 מיליון פרמטרים שמיועדת למחקר ולמשימות יצירת טקסט קלות באנגלית. בוחרים בה בעיקר כשצריך מודל קל משקל שרץ מקומית בלי דרישות חומרה כבדות.

  • 380Mפרמטרים
  • 1,024טוקנים בהקשר
  • 11.6 GBמשקל הקבצים
  • 361,996הורדות בחודש

מה זה

הארכיטקטורה מבוססת שנאי ומאומנת בשיטת חיזוי המילה הבאה על גבי מאגר של ארבעים גיגה בייט טקסט מקישורים ברדיט. המודל מיועד לשפה האנגלית בלבד, ואינו כולל נתונים מוויקיפדיה. עם גודל של 380 מיליון פרמטרים, הוא מתפקד כשלב ביניים בין הגרסה הבסיסית לגרסאות הגדולות יותר בסדרה.

בבדיקות אפס דוגמאות הוא השיג דיוק של 55.48 אחוזים במבחן למבדה וערכי פרפלקסיטי כמו 22.76 בוויקיטקסט 2. המספרים האלה מראים יכולת סבירה להשלמת מילים במשפטים מובנים, אבל רחוקים מלהציג הבנה עמוקה או יכולת ניתוח מורכבת בהשוואה למודלים מודרניים.

מתאים ל

  • מחקר על הטיות במודלים

    משמש לבחינת סטריאוטיפים והתנהגות של מודלי שפה שנוצרו על נתונים גולמיים מהרשת.

  • השלמת טקסט יצירתי באנגלית

    מתאים לסיוע בכתיבת שירה, סיפורים ובדיות קצרות בזכות הארכיטקטורה היוצרת שלו.

  • יצירת תוכן למשחקי מחשב

    משתלב כמנוע פשוט לדיאלוגים מומצאים של דמויות שאינם דורשים דיוק עובדתי.

איפה זה נופל

היוצרים מדגישים שהמודל אינו מבדיל בין עובדות לבדיון, ולכן אסור להסתמך עליו לכל שימוש שדורש דיוק עובדתי. חלון ההקשר מוגבל ל־1,024 טוקנים, מה שמונע עיבוד מסמכים ארוכים. המאגר הכיל תוכן גולמי מהרשת ללא סינון עמוק, ולכן הפלטים כוללים הטיות קשות, סטריאוטיפים ותכנים פוגעניים. בנוסף, המודל אינו מאומן לעברית כלל, וכל ניסיון להזין שפה אחרת מאנגלית יניב שגיאות או טקסט שבור.

שאלות
נפוצות

האם המודל תומך בעיבוד טקסט בעברית?

הוא אומן על טקסטים באנגלית בלבד. אם תזינו עברית, הפירוק למילים ייכשל והפלט יהיה חסר משמעות לחלוטין.

האם אפשר להשתמש בו לבוט שעונה ללקוחות?

היוצרים ממליצים שלא לשלב אותו במערכות מול בני אדם בלי מחקר הטיות מקדים. הוא נוטה להמציא עובדות ועלול לייצר תוכן פוגעני.

איך מריצים

טוענים את המודל דרך ספריית הטרנספורמרס בפייתון עם פייטרוץ' או טנזורפלו. קבצי המאגר שוקלים 11.6 גיגה בייט וכוללים גרסאות שונות של המשקלים, אך המודל עצמו תופס זיכרון עבודה צנוע מאוד בזמן ריצה. מעבד גרפי פשוט עם ארבעה עד שמונה גיגה בייט זיכרון יספיק לביצועי זמן תגובה טובים, והוא יכול לרוץ גם על מעבד מרכזי רגיל.

אם אתם צריכים רק להשלים פסקאות קצרות או לעשות ניסויי מחקר בודדים, אין צורך בשרת ייעודי. מנגד, אם המטרה היא לקבל תשובות אינטליגנטיות בצ'אט או לעבד טקסטים ארוכים, עדיף להשתמש בשרותי ענן חיצוניים שמריצים מודלים עדכניים יותר.

from transformers import pipeline

pipe = pipeline("text-generation", model="openai-community/gpt2-medium")
print(pipe("שלום"))

הרישיון

הרישיון הוא MIT שמאפשר שימוש חופשי, כולל שילוב במוצרים מסחריים ושינוי קוד המקור. חובה לצרף את תנאי הרישיון המקוריים ואת הצהרת היעדר האחריות של היוצרים. שימו לב שהכרטיס מזכיר גרסה מותאמת של הרישיון במאגר של אופנאיי, ולכן מומלץ לבדוק את קובץ התנאים המצורף לפני הפצה מסחרית.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש

הרישיון המלא בעמוד המודל ↗