GPT
1

14B-DPO-alpha

קוד פתוח

CausalLMwtfpl2023-11-02

  • transformers
  • pytorch
  • llama
  • text-generation
  • llama2

גרסת אלפא בגודל 14 מיליארד פרמטרים שעברה כוונון DPO, מכוונת לאנגלית וסינית ומציגה ציון MT-Bench שמתקרב לזה של GPT-3.5 בתוך משקל שמיועד לריצה מקומית.

  • 8,192טוקנים בהקשר
  • 26.4 GBמשקל הקבצים
  • 402הורדות בחודש
  • 122לייקים

מה זה

מדובר במודל שפה שנשען על ארכיטקטורת LlamaForCausalLM עם הקשר של 8,192 טוקנים, כאשר הדגש כאן הוא אימון ישיר להעדפות אנושיות באמצעות DPO. המפתחים מסבירים שלא מדובר בהמשך אימון ישיר על גבי גרסת הבסיס הרגילה שלהם, אלא בפיצול מקביל שבו שונו חלק מהפרמטרים הפנימיים. המטרה המרכזית הייתה להתחרות במודלים בקטגוריית גודל זו.

במבחן MT-Bench המודל מציג ציון של 7.61, מה שמציב אותו מעל Zephyr בגרסאות ה־7B שלו ודי קרוב ל־7.94 של GPT-3.5-Turbo. בפועל, המשמעות היא יכולת שיחה ומענה עקביות יחסית למודל בגודל הזה, בלי צורך במשאבים של מודלי ענק, לפחות בכל הנוגע למשימות טקסט שוטפות באנגלית ובסינית.

מתאים ל

  • עבודה מול טקסטים בסינית

    הוא אומן מראש עם תמיכה מוצהרת בסינית לצד אנגלית, ומתאים למשימות דו-לשוניות.

  • שרת מקומי ללא הגבלות תוכן

    מאחר שאין לו מנגנוני סירוב מובנים, הוא מאפשר מחקר וניתוח טקסטים ללא צנזורה עצמית.

  • חלופת קוד פתוח סבירה לענן

    בציון 7.61 ב־MT-Bench הוא נותן פלט קרוב ל־GPT-3.5 במשימות שיחה כלליות באנגלית.

איפה זה נופל

המודל אומן על מידע גולמי מהרשת שלא עבר סינון, והמפתחים מצהירים בגלוי שלא היו להם משאבים לבצע סינון בטיחותי, התאמת RLHF לאתיקה או אימון עם דוגמאות שמסרבות לענות. המשמעות היא שהפלט עלול להכיל שפה פוגענית, תכנים אלימים או פורנוגרפיה ללא שום מנגנון חסימה פנימי. חובה לבנות שכבת בדיקות וסינון מילים משלכם לפני שמחברים אותו לממשק משתמש כלשהו, ומעבר לכך עברית אינה ברשימת השפות הנתמכות שלו.

שאלות
נפוצות

האם המודל מבין ומייצר עברית?

המודל הוגדר רשמית לאנגלית וסינית בלבד. הוא לא אומן על עברית כשפת יעד, ולכן אין להסתמך עליו למשימות בשפה זו.

אפשר להעלות אותו ישר כבוט לשירות לקוחות?

לא מומלץ בכלל בלי שכבת הגנה חיצונית. המפתחים מצהירים שהדאטה לא סונן ואין מנגנוני בטיחות פנימיים, כך שהוא עלול לפלוט תוכן פוגעני.

איך מריצים

כדי להריץ אותו במשקל מלא בדיוק bfloat16 תצטרכו כ־26.4 גיגה-בייט פנויים בזיכרון של כרטיס המסך, מה שמחייב חומרה ייעודית כמו כרטיס עם 32 או 48 גיגה זיכרון גרפי. אם אין לכם גישה למעבדים גרפיים כאלה בשרת מקומי, קריאה למודל חיצוני דרך ספק ענן תהיה זולה ופשוטה בהרבה.

הקוד עצמו נתמך ישירות דרך ספריית transformers הרגילה של פייתון, כך שאין צורך בהתקנות מיוחדות מעבר לטעינת הקבצים הרגילה. מי שמחזיק תחנת עבודה צנועה יותר יצטרך לבצע קוונטיזציה כדי לדחוס את המשקל לכרטיסים נפוצים יותר של 16 או 24 גיגה.

from transformers import pipeline

pipe = pipeline("text-generation", model="CausalLM/14B-DPO-alpha")
print(pipe("שלום"))

הרישיון

הרישיון המדווח הוא WTFPL, רישיון מתירני לחלוטין שאומר שמותר לכם לעשות עם הקבצים והמשקולות כל מה שתרצו, כולל שימוש מסחרי, שינוי והפצה, בלי שום תנאים או דרישות קרדיט מצד היוצרים.

הרישיון המלא בעמוד המודל ↗