GPT
D

distilbert-base-cased-distilled-squad

קוד פתוח

distilbertapache-2.02022-03-02

  • transformers
  • pytorch
  • tf
  • rust
  • safetensors

זה מודל קטן ומהיר שמחלץ תשובות מתוך טקסט באנגלית. בוחרים בו כשחייבים זמן תגובה נמוך ועלויות הרצה אפסיות, ומוכנים לוותר על מעט דיוק בשביל זה.

  • 65Mפרמטרים
  • 512טוקנים בהקשר
  • 1.7 GBמשקל הקבצים
  • 220,753הורדות בחודש

מה זה

מדובר בגרסה מכווצת של ברט שעברה אימון ייעודי על מאגר שאלות ותשובות בשם SQuAD 1.1. הרעיון פשוט, הוא מקבל פסקה ושאלה באנגלית, ומצביע בדיוק על רצף המילים מתוך הפסקה שעונה על השאלה. הוא שומר על אותיות גדולות וקטנות, כך שהוא מתאים לטקסטים שבהם שמות של חברות, מותגים או שמות אנשים קריטיים להבנה.

במבחן התוצאה על ערכת הבדיקה של המאגר, הוא מגיע לציון F1 של 87.1 לעומת 88.7 של המודל המלא. הפער הזה קטן מאוד, נקודה וחצי סך הכול, אבל התמורה היא מודל עם 40% פחות פרמטרים שרץ 60% מהר יותר. למי שצריך חילוץ תשובות קלאסי ומקומי בלי לתחזק שרתים מנופחים, זו פשרה מצוינת.

מתאים ל

  • חילוץ נתונים מטקסט באנגלית

    שולפים מונחים, שמות או תאריכים מתוך פסקאות קצרות במהירות גבוהה ועל גבי מעבד רגיל.

  • מענה לשאלות על מסמכים

    סורקים תוצאות חיפוש או קטעי מידע ומציגים למשתמש בדיוק את המשפט שעונה לו.

  • סיווג ושליפת מידע במכשיר קצה

    מריצים עיבוד שפה ישירות על מחשבים פשוטים בלי לשלוח נתונים החוצה ובלי לייקר עלויות.

איפה זה נופל

הוא לא מייצר טקסט חופשי, אלא רק מסמן נקודת התחלה וסיום בתוך הפסקה שסיפקתם לו. בנוסף, הוא אומן על גרסה ישנה של המאגר שבה תמיד יש תשובה בטקסט, ולכן כשתשאלו שאלה שאין לה מענה, הוא עדיין ינחש קטע כלשהו ויחזיר ציון ביטחון שגוי. הוא גם נוטה לקבע הטיות חברתיות, כמו ניחוש של דמות גברית כששואלים מיהו המנכ״ל, גם בלי ביסוס בטקסט.

שאלות
נפוצות

האם המודל הזה מתאים לטקסטים בעברית?

לא. המודל אומן מראש על מאגרים באנגלית בלבד ושומר על אותיות לטיניות גדולות וקטנות. הרצה על טקסט עברי תניב תוצאות חסרות משמעות.

האם הוא יודע לנסח תשובה משל עצמו?

לא, הוא מודל חילוץ ולא מודל גנרטיבי. הוא סורק את הטקסט שאתם שולחים ומחזיר אינדקס של מילת ההתחלה ומילת הסיום של התשובה.

מה קורה כשהתשובה בכלל לא מופיעה בפסקה?

הוא ינסה לנחש בכוח ויחזיר קטע כלשהו מתוך הטקסט, לפעמים אפילו בציון הסתברות גבוה. ככה המאגר שעליו הוא אומן בנוי, ולכן צריך לבדוק את התוצאות בזהירות.

איך מריצים

בגלל שיש לו רק 65 מיליון פרמטרים והוא שוקל 1.7 גיגה בייט, אפשר להריץ אותו ישירות דרך ספריית transformers בתוך פייתון או טנסורפלו בלי שום כרטיס מסך ייעודי. מעבד סטנדרטי לגמרי בשרת צנוע מחזיק אותו בקלות ומחזיר תשובות מהר.

אין סיבה לשלם לספקי ענן על API עבור מודל כזה. שווה לפנות ל־API חיצוני רק אם המוצר שלכם צריך תשובות מורכבות יותר שלא מנוסחות מילה במילה בתוך הטקסט, או אם היקף הפניות שלכם אפסי ואתם לא רוצים להחזיק תהליך רקע רץ.

from transformers import pipeline

pipe = pipeline("question-answering", model="distilbert/distilbert-base-cased-distilled-squad")
print(pipe("שלום"))

הרישיון

הרישיון הוא Apache 2.0. מותר להשתמש בו למוצרים מסחריים, לשנות אותו, להריץ אותו אצלכם ולהפיץ אותו חופשי. התנאי העיקרי הוא להשאיר את הצהרת זכויות היוצרים והרישיון המקורי בקוד.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗