GPT
P

pythia-6.9b

קוד פתוח

EleutherAIapache-2.02023-02-14

  • transformers
  • pytorch
  • safetensors
  • gpt_neox
  • text-generation

זה מודל בסיס שנועד בעיקר למחקר מדעי של למידת מכונה. הייחוד שלו הוא גישה מלאה לכל שלבי האימון המקוריים שלו.

  • 7Bפרמטרים
  • 2,048טוקנים בהקשר
  • 25.8 GBמשקל הקבצים
  • 182,562הורדות בחודש

מה זה

המודל מגיע ממעבדת EleutherAI, והוא נבנה קודם כול בשביל חוקרים שרוצים להבין מה באמת קורה בתוך רשתות עצביות בזמן האימון. במקום לקבל רק משקלים סופיים, מקבלים כאן 154 נקודות ביקורת שונות לאורך מסלול הלמידה, מהצעד הראשון ועד צעד 143,000. כל הגרסאות במשפחה הזו ראו בדיוק את אותם 299,892,736,000 טוקנים מאגר The Pile ובאותו הסדר.

למרות שמטרת הפיתוח לא הייתה שבירת שיאים במשימות קצה, המפתחים מדווחים שהביצועים שלו תואמים או עוקפים מודלים מקבילים כמו OPT או GPT-Neo בגודל דומה. הוא אומן באנגלית בלבד ומבוסס על הארכיטקטורה של GPT-NeoX עם 32 שכבות ודיוק של float16.

מתאים ל

  • מחקר יכולות פנימיות

    154 נקודות שמירה מאפשרות לבדוק בדיוק באיזה שלב אימון מודלים קולטים דפוסים מסוימים.

  • בסיס להתאמה אישית

    אפשר לקחת את משקלי הבסיס ולאמן אותם נקודתית למשימות ספציפיות באנגלית.

  • השוואת תהליכי אימון

    כל סדרת הגדלים ראתה את אותם הנתונים בדיוק, מה שמאפשר השוואה מדעית נקייה בין גדלים.

איפה זה נופל

זה לא צ'אטבוט ואי אפשר להשתמש בו כמו במוצר מוכן. הוא לא עבר התאמה עם משוב אנושי, ולכן הוא לא יודע לעקוב אחרי הוראות ועלול לפלוט טקסט פוגעני או עובדות מומצאות לחלוטין. הוא אומן על The Pile באנגלית בלבד ללא סינון כפילויות, ולכן לא מתאים לעברית או לתרגום.

אותה משפחה

pythia יצא ב־6 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם המודל יודע לענות לשאלות כמו ChatGPT?

לא. המודל פשוט חוזה את הטוקן הבא ברצף. הוא לא עבר כוונון להוראות או התאמת שיחה, ולכן הוא ימשיך את הטקסט שכתבתם במקום לענות עליו.

האם הוא תומך בעברית?

לא, הוא אומן באנגלית בלבד על מאגר The Pile. הוא אינו מיועד לשפות אחרות או למשימות תרגום.

איך מריצים

המשקלים תופסים 25.8 גיגה בייט בפורמט float16, כך שתצטרכו כרטיס מסך עם לפחות 16 עד 24 גיגה בייט זיכרון רק כדי לטעון אותו, או להשתמש בכימות. הטעינה נעשית ישירות דרך ספריית transformers הרגילה של Hugging Face, וניתן לגשת לכל שלב אימון באמצעות פרמטר ה־revision שמציין את מספר הצעד.

אם כל מה שאתם צריכים זה שירות טקסט פשוט ולא ניסויי אימון או התאמה אישית, שרת עצמאי לגודל כזה ידרוש חומרה יקרה שלא מצדיקה את עצמה לעומת שימוש ב־API קיים.

from transformers import pipeline

pipe = pipeline("text-generation", model="EleutherAI/pythia-6.9b")
print(pipe("שלום"))

הרישיון

הרישיון הוא Apache 2.0. מותר להשתמש בו לצרכים מסחריים, לשנות אותו, לאמן אותו מחדש ולהפיץ אותו, כל עוד שומרים על תנאי הרישיון המקוריים והודעות זכויות היוצרים.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗