GPT
D

DialoGPT-medium

קוד פתוח

microsoftmit2022-03-02

  • transformers
  • pytorch
  • tf
  • jax
  • rust

microsoft עומדים גם מאחורי Sho, ויש עליו סקירה כאן.

מודל שיחה ותיק שמתאים בעיקר לצ'אט קליל באנגלית. מי שבוחר בו מחפש בוט מקומי שלא דורש משאבי ענן כבדים ויודע לנהל דיאלוג בסיסי.

  • 1,024טוקנים בהקשר
  • 5.1 GBמשקל הקבצים
  • 205,424הורדות בחודש
  • 439לייקים

מה זה

מדובר בהתאמה של ארכיטקטורת GPT-2 שמיקרוסופט אימנה ספציפית על 147 מיליון שרשורי שיחה מתוך רדיט. במקום לנסות לפתור בעיות היגיון או לתמצת מסמכים, הוא מתמקד כולו ביצירת תגובות שנשמעות טבעיות בתוך שיחה מרובת שלבים. המטרה כאן היא לדבר כמו משתמש רגיל ברשת, עם סגנון ישיר ולעיתים עוקצני.

במבחני הערכה אנושית שנערכו עבורו בשיחות קצרות של תור בודד, המעריכים דיווחו שאיכות התגובות שלו התקרבה לרמה של תשובות אנושיות במבחן טיורינג. זה אומר שהוא מצטיין בסמול טוק קצר, אבל לא בבניית טיעונים מורכבים. הוא שונה ממודלי שפה כלליים באותו גודל בכך שהוא הונדס מראש לדבר כדיאלוג ולא רק להשלים פסקאות של טקסט רציף.

מתאים ל

  • בוט שיחה למשחקים

    מתאים לדמויות בלי תפקיד קריטי שצריכות לקשקש קצת באנגלית קלילה בלי להעמיס על החומרה.

  • סביבת בדיקות מקומית

    מאפשר לבדוק לוגיקת צ'אט ושרשורי שיחה באפליקציה על המחשב בלי לשלם על קריאות רשת.

  • אימון המשך ממוקד

    בסיס נוח למי שרוצה לכוונן מודל דיאלוג קטן על דאטה פנימי ספציפי באנגלית.

איפה זה נופל

חלון ההקשר מוגבל מאוד ועומד על 1,024 טוקנים בלבד, מה שאומר שאחרי כמה חילופי דברים קצרים הוא ישכח לגמרי את תחילת השיחה. מעבר לזה, בגלל שהוא אומן על דיונים מרדיט, הוא נוטה לאמץ דעות מוזרות, להישמע ציני מדי, ולא מתאים בשום אופן לשירות לקוחות רציני או למתן מידע מדויק. אין כאן שום ערובה לנכונות עובדתית, ואסור לחבר אותו למערכת שפולטת מידע רגיש ללא סינון קפדני.

שאלות
נפוצות

האם המודל תומך בשיחות בעברית?

לא באופן מעשי. הוא אומן על שרשורים באנגלית מרדיט, ולכן הוא לא מתאים לעיבוד שפה טבעית בעברית ויחזיר תוצאות משובשות או חסרות משמעות.

איך שומרים איתו על הקשר של שיחה שלמה?

צריך לשרשר את ההודעות הקודמות יחד עם הטוקנים המפרידים ולהזין אותן מחדש בכל תור, תוך שמירה שלא לעבור את המגבלה הקשיחה של 1,024 טוקנים.

איך מריצים

המשקל הכולל של הקבצים מגיע ל־5.1 גיגה בייט, כך שצריך כרטיס מסך בסיסי עם לפחות 6 עד 8 גיגה זיכרון כדי לטעון אותו ולהריץ הסקת מסקנות במהירות סבירה, או לחלופין להסתפק בריצה איטית יותר על המעבד. טוענים אותו ישירות דרך ספריית transformers עם המחלקה GPT2LMHeadModel.

אם אתם מפתחים שירות שצריך לשרת אלפי משתמשים במקביל או שאתם מחפשים תשובות מורכבות בעברית, להחזיק שרת ייעודי בשבילו יהיה בזבוז זמן ועדיף לפנות למודלים מודרניים יותר דרך ממשקי ענן.

from transformers import pipeline

pipe = pipeline("text-generation", model="microsoft/DialoGPT-medium")
print(pipe("שלום"))

הרישיון

רישיון MIT פתוח ומתירני לחלוטין. מותר להשתמש בו לצרכים מסחריים, לשנות אותו, לאמן עליו הלאה ולשלב אותו במוצרים סגורים בלי לשלם תמלוגים, כל עוד שומרים על הודעת זכויות היוצרים המקורית.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש

הרישיון המלא בעמוד המודל ↗