GPT
E

e5-small

קוד פתוח

intfloatmit2022-12-07

  • sentence-transformers
  • pytorch
  • onnx
  • safetensors
  • bert

מודל שיבוץ קומפקטי ומהיר במיוחד לחיפוש טקסט באנגלית. הוא מתאים למי שחייב לרוץ בזול על מעבד בלי לאבד את הדיוק של המודלים הגדולים.

  • 33Mפרמטרים
  • 512טוקנים בהקשר
  • 382 MBמשקל הקבצים
  • 28,359הורדות בחודש

מה זה

מדובר במודל שמייצר וקטורים להשוואת טקסטים על בסיס ארכיטקטורת ברט, שמכיל רק שלושים ושלושה מיליון פרמטרים. הוא מיועד לתרחישים שבהם מודלים כבדים מייקרים את השרתים או איטיים מדי בזמן אמת.

בבדיקות הביצועים של מדד MTEB הוא מחזיק תוצאות מפתיעות לגודלו. במשימות של דירוג מחדש בפורומים טכניים כמו AskUbuntu הוא מגיע לציון MRR של מעל שבעים ושלוש, ובסיווג סנטימנט באמזון הוא חוצה שמונים ושבעה אחוזי דיוק. המשמעות היא שאתם מקבלים איכות שימושית מאוד בלי לשלם מחיר ביצועים כבד.

נקודת החוזק שלו היא שליפת מידע ממוקדת. הוא מצליח לאתר מסמכים קשורים מתוך מאגרי שאלות ותשובות במהירות גבוהה, אבל הוא מיועד לשפה האנגלית בלבד ולא יתאים למי שמחפש פתרון רב לשוני.

מתאים ל

  • חיפוש טקסטואלי מקומי

    שליפת שאלות דומות באנגלית מתוך מאגר שאלות ותשובות טכני בזמן אמת.

  • סיווג פניות תמיכה

    מיון ראשוני ומהיר של כוונת משתמש באנגלית, במיוחד בתחומי בנקאות.

  • אשכול מאמרים

    קיבוץ כותרות ותקצירים קצרים לקבוצות נושאים בלי צורך בחומרה כבדה.

איפה זה נופל

הוא מוגבל לחלוטין לאנגלית. מי שינסה להזין לו עברית יקבל תוצאות גרועות, כי הוא פשוט לא מכיר את השפה. בנוסף, חלון הקלט עומד על 512 טוקנים, מה שאומר שטקסטים ארוכים ייחתכו ולא יקבלו ייצוג מלא.

במשימות של שליפת מידע מתמטי או מדעי מורכב, כמו במבחן CQADupstack Mathematica, הביצועים שלו נמוכים משמעותית עם מדד MAP של פחות מעשרים אחוז. אל תבנו עליו לסיווג דק של ביקורות מדורגות, שם הוא השיג רק כארבעים ושניים אחוזי דיוק.

אותה משפחה

e5-small יצא ב־2 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם אפשר להשתמש במודל הזה לחיפוש בעברית?

לא. המודל אומן ותומך רשמית באנגלית בלבד. אם תריצו עליו טקסטים בעברית תקבלו וקטורים אקראיים שלא משקפים משמעות.

כמה שרתים צריך כדי לעבד איתו כמויות גדולות?

המודל שוקל 382 מגה בייט בלבד. שרת צנוע עם מעבד סטנדרטי בלי GPU יספיק לכם כדי לייצר שיבוצים לאלפי משפטים בשניות ספורות.

איך מריצים

אתם טוענים אותו דרך ספריית sentence-transformers ישירות בפייתון, והוא תופס פחות מגיגה זיכרון כשהוא רץ. אין שום צורך בכרטיס מסך ייעודי, הוא טס גם על ליבת מעבד רגילה בשרת ענן בסיסי או במחשב מקומי.

המשקל שלו בקבצים הוא 382 מגה בייט, כך שזמן העלייה שלו באוויר כמעט אפסי. בגלל שהוא כל כך קל וזול להרצה עצמית, אין שום סיבה הגיונית להשתמש בשרתים חיצוניים או לשלם על קריאות שירות צד שלישי עבורו.

from sentence_transformers import SentenceTransformer

m = SentenceTransformer("intfloat/e5-small")
v = m.encode(["שלום עולם"])

הרישיון

רישיון MIT פתוח ומתירני. אתם יכולים לשלב אותו במוצר מסחרי, לשנות את הקוד ולהפיץ אותו חופשי. התנאי היחיד הוא השארת הודעת זכויות היוצרים המקורית והסרת אחריות מהיוצר.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש

הרישיון המלא בעמוד המודל ↗