GPT
G

gpt2

קוד פתוח

openai-communitymit2022-03-02

  • transformers
  • pytorch
  • tf
  • jax
  • tflite

גרסת הבסיס הוותיקה בארכיטקטורת רגרסיה עצמית באנגלית, ששוקלת 137 מיליון פרמטרים. היא מתאימה בעיקר לפיתוח מקומי קליל, ניסויי מחקר ואימון עדין למשימות ממוקדות.

  • 137Mפרמטרים
  • 1,024טוקנים בהקשר
  • 5.2 GBמשקל הקבצים
  • 14,770,863הורדות בחודש

מה זה

הגרסה הזו היא המהדורה הקטנה ביותר במשפחה, ואומנה לחזות את הטוקן הבא על גבי טקסט גולמי באנגלית. הדאטהסט המקורי, WebText, כלל 40 גיגה בייט של דפי אינטרנט שהגיעו מקישורים ברדיט עם ניקוד חיובי מינימלי, ללא תוכן מוויקיפדיה כלל. הוא לומד ייצוג פנימי של השפה ומשמש לחילוף תכונות או יצירת המשך לטקסט קיים.

במדדי Zero-shot ללא אימון נוסף, הוא מציג דיוק של 45.99 אחוזים במבחן LAMBADA ופרפלקסיטי של 35.13. במבחני CBT הוא מגיע לדיוק של 87.65 אחוזים בשמות עצם נפוצים ו־83.4 אחוזים בישויות. במילים פשוטות, הוא מייצר טקסט שנשמע קוהרנטי תחבירית, אבל חסר יכולת הבנה עמוקה או לוגיקה מורכבת שמוצאים במודלים מודרניים.

מתאים ל

  • השלמת טקסט מקומית

    יצירת המשך לטיוטות קצרות באנגלית על חומרה חלשה ובסביבה ללא חיבור רשת.

  • חילוץ וקטורים ותכונות

    שימוש בשכבות המודל לצורך ייצוג טקסט באנגלית עבור מודלים קלאסיים.

  • אימון עדין ממוקד

    בסיס קל משקל שרץ מהר לצורך התאמה לסגנון כתיבה צר או סיווג ספציפי.

איפה זה נופל

יוצרי המודל מזהירים במפורש שהוא לא מבדיל בין עובדות לבדיון, ולכן לא מתאים למשימות שדורשות דיוק עובדתי. הנתונים נאספו ישירות מהאינטרנט ללא סינון עמוק, ויש בו הטיות מובנות בנושאי מגדר, גזע ודת שאינן שונות בין הגרסאות הקטנות לגדולות. חלון ההקשר מוגבל ל־1,024 טוקנים, והוא אומן על אנגלית בלבד. אם תזרקו עליו עברית, תקבלו ג'יבריש מוחלט או כשלים בפירוק הטוקנים.

שאלות
נפוצות

האם המודל תומך בעברית?

לא. המודל אומן אך ורק על טקסטים באנגלית מרחבי הרשת. הטוקנייזר שלו אינו מותאם לעברית, והוא אינו מסוגל לקרוא או לייצר משפטים תקינים בשפה.

האם אפשר להסתמך על התשובות שלו כעובדות?

ממש לא. כרטיס המודל מדגיש שהוא אינו יודע להבדיל בין עובדה לבדיה ונוטה להזיות. הוא מיועד ליצירת מלל סטטיסטי בלבד ולא ישמש כמקור ידע אמין.

איך מריצים

טוענים אותו ישירות דרך ספריית transformers בפייתון באמצעות PyTorch או TensorFlow, עם טוקנייזר BPE ייעודי ואוצר מילים של 50,257 מונחים. המשקל של הקבצים עומד על 5.2 גיגה בייט, כך שאפשר להריץ אותו בלי מאמץ על כל מעבד מודרני ממוצע או כרטיס מסך בסיסי לחלוטין בלי לפתוח שרתים ייעודיים.

אם אתם מחפשים איכות פלט טובה יותר, יש למשפחה גרסאות Medium, Large ו־XL. אם אתם צריכים רק תגובות מהירות באנגלית במערכת מקומית מנותקת רשת, עדיף להריץ אותו ישירות במקום לשלם על API חיצוני.

from transformers import pipeline

pipe = pipeline("text-generation", model="openai-community/gpt2")
print(pipe("שלום"))

הרישיון

הרישיון הוא MIT. מותר להשתמש בו לצרכים מסחריים, לשנות אותו, להפיץ אותו ולשלב אותו במוצרים סגורים בלי תשלום תמלוגים. התנאי היחיד הוא שמירת הצהרת זכויות היוצרים והרישיון המקורי בתוך העותקים של הקוד או המוצר.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש

הרישיון המלא בעמוד המודל ↗