GPT
M

mxbai-rerank-large-v1

קוד פתוח

mixedbread-aiapache-2.02024-02-29

  • transformers
  • onnx
  • safetensors
  • deberta-v2
  • text-classification

הוא מדרג מחדש תוצאות חיפוש באנגלית כדי לדייק מערכות שליפה. לוקחים אותו כשהחיפוש הווקטורי מחזיר תוצאות סבירות, אבל רוצים שהקטע המדויק באמת יגיע למקום הראשון.

  • 435Mפרמטרים
  • 512טוקנים בהקשר
  • 3.0 GBמשקל הקבצים
  • 30,763הורדות בחודש

מה זה

זהו קרוס-אנקודר בגודל 435 מיליון פרמטרים שמבוסס על ארכיטקטורת DeBERTa-v3 ומיועד לשלב השני במערכות חיפוש ו־RAG. בניגוד למודלי הטמעה רגילים שמשווים וקטורים נפרדים של שאילתה ומסמך, הוא מעביר את השאילתה והטקסט יחד דרך כל 24 השכבות שלו. המעבר המשותף מאפשר לו לזהות קשרים עמוקים וניואנסים שחיפוש וקטורי פשוט מפספס לחלוטין.

המשמעות של הגודל הזה ברורה: 435 מיליון פרמטרים נותנים דיוק גבוה בהרבה ממודלים זעירים של דירוג, אך במחיר של זמן עיבוד. הוא לא מחליף את מנוע החיפוש הקיים, אלא מקבל ממנו רשימה מצומצמת, למשל 50 או 100 פסקאות שנשלפו ראשונות, ומסדר אותן מחדש לפי מידת הרלוונטיות האמיתית לשאילתה.

מתאים ל

  • שיפור תשובות RAG

    סינון עשרות פסקאות שנשלפו ממאגר וקטורי והגשת הרלוונטיות ביותר לחלון המודל המייצר.

  • דירוג מחדש בחיפוש אתרים

    קבלת תוצאות ראשוניות ממנוע חיפוש טקסטואלי באנגלית וסידורן לפי התאמה מדויקת.

  • סינון קטעים לצ'אטבוט תמיכה

    וידוא שמסמך התמיכה הנכון באנגלית נבחר מתוך עשרות תוצאות אפשריות של משתמש.

איפה זה נופל

חלון ההקשר מוגבל ל־512 טוקנים בלבד. אי אפשר להזין לו מסמכים שלמים, והוא מחייב פירוק מוקדם של הטקסט לפסקאות קצרות, במיוחד כי השאילתה והמסמך חולקים יחד את אותם 512 טוקנים.

בנוסף, הוא אומן עבור השפה האנגלית בלבד. אם תזינו לו טקסטים בעברית תקבלו תוצאות גרועות או חסרות משמעות לחלוטין, ולכן הוא לא מתאים למאגרי מידע ישראליים מקומיים.

אותה משפחה

mxbai-rerank-large יצא ב־2 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם המודל תומך בטקסטים בעברית?

לא. המודל מוגדר ומאומן עבור השפה האנגלית בלבד. שימוש בו על שאילתות או מסמכים בעברית יפיק דירוג שגוי ולא אמין.

האם הוא יכול להחליף את מסד הנתונים הווקטורי שלי?

לא. מודל דירוג כזה לא סורק מיליוני מסמכים בזמן אמת בגלל חישוב כבד. השימוש הנכון בו הוא כשלב שני, שמדרג מחדש רק את 50 עד 100 התוצאות הראשונות ששלפתם מוקדם יותר.

מה קורה אם הטקסט ארוך מ־512 טוקנים?

הטקסט ייחתך מעבר למגבלה הזו והמידע שבסופו יאבד. חובה לפצל מראש את המסמכים לפסקאות קצרות כדי שגם השאילתה וגם הפסקה ייכנסו יחד למגבלת האורך.

איך מריצים

משקל הקבצים עומד על 3.0 גיגה-בייט בפורמט float16, מה שאומר שאפשר להריץ אותו בקלות על כרטיס מסך בודד בעל זיכרון צנוע, ואפילו על מעבד חזק אם התעבורה נמוכה. מריצים אותו דרך ספריית transformers הרגילה של פייתון ללא צורך בהגדרות מיוחדות.

אם אתם צריכים לדרג עשרות תוצאות בלבד בכל פנייה עבור עומס משתמשים בינוני, שרת פנימי קטן עם GPU בסיסי יעשה את העבודה בעלות נמוכה. שירות API חיצוני משתלם רק אם היקף השאילתות שלכם קופץ בפולסים חדים ולא מצדיק החזקת שרת ייעודי שפועל מסביב לשעון.

from transformers import pipeline

pipe = pipeline("text-ranking", model="mixedbread-ai/mxbai-rerank-large-v1")
print(pipe("שלום"))

הרישיון

רישיון הפצה פתוח מסוג Apache 2.0. מותר להשתמש בו לצרכים מסחריים, לשנות את הקוד והמשקולות, ולשלב אותו במוצרים פנימיים או חיצוניים, בתנאי ששומרים על הודעת זכויות היוצרים ומצרפים עותק של הרישיון המקורי.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗