GPT
M

mxbai-embed-xsmall-v1

קוד פתוח

mixedbread-aiapache-2.02024-09-13

  • sentence-transformers
  • onnx
  • safetensors
  • openvino
  • gguf

מודל שיכוך קטן במיוחד שנועד לאחזור טקסט מהיר, עם תמיכה נדירה בנפח של 4,096 טוקנים ביחס למשקל נוצה של 24 מיליון פרמטרים.

  • 24Mפרמטרים
  • 4,096טוקנים בהקשר
  • 735 MBמשקל הקבצים
  • 23,788הורדות בחודש

מה זה

מדובר במודל מבוסס ארכיטקטורת ברט בעל 6 שכבות בלבד, שהותאם לחילוץ וקטורים מייצגים מטקסט באנגלית. השילוב בין גודל זעיר של 24 מיליון פרמטרים לחלון הקשר רחב מעניק לו יתרון ברור בעיבוד מסמכים ארוכים יחסית, בלי לייצר צוואר בקבוק של חומרה יקרה.

במבחני אחזור נתונים הוא מציג תמונה מעורבת. בבדיקות כמו הוטפוט קיו איי הוא משיג דיוק מרשים בתוצאה הראשונה עם ציון של כמעט חמישים ושמונה אחוזים, אבל במשימות של אימות עובדות או טקסטים מתמטיים מורכבים הביצועים נחתכים משמעותית. כשמבקשים ממנו למצוא קשרים לוגיים מסובכים, הנפח המצומצם שלו מורגש מיד.

מתאים ל

  • אחזור מסמכים ארוכים

    מתאים לחיפוש בקבצי טקסט של אלפי מילים בלי לחתוך פסקאות, בזכות חלון רחב במיוחד.

  • חיפוש בפורומים וקהילות

    עובד טוב באיתור שאלות דומות ושרשורים טכניים כלליים באנגלית על חומרה ותוכנה.

  • עיבוד על שרתי קצה חלשים

    צריכת הזיכרון הנמוכה שלו מתאימה להתקנה על שרתי מעבד זולים או שירותי ענן קטנים.

איפה זה נופל

הבעיה המרכזית שלו היא היעדר תמיכה בשפות שאינן אנגלית. הוא אומן על אנגלית בלבד, וכל ניסיון לתחקר איתו מסמכים בעברית יוביל לקריסה באיכות האחזור. בנוסף, 6 שכבות לא מספיקות בשביל לכידת ניואנסים עמוקים בנושאים טכניים צפופים כמו מתמטיקה, כפי שמעידות התוצאות הנמוכות במבחני בנצ'מרק ייעודיים.

שאלות
נפוצות

האם המודל תומך בטקסטים בעברית?

המודל הוגדר ואומן על השפה האנגלית בלבד. הרצה של טקסטים בעברית תניב וקטורים באיכות ירודה שלא יאפשרו אחזור מדויק.

האם צריך כרטיס מסך כדי להשתמש בו בייצור?

אין שום צורך בכרטיס גרפי. עם עשרים וארבעה מיליון פרמטרים ומשקל קבצים קטן, מעבד מרכזי רגיל מטפל בו בקלות.

איך מריצים

טוענים אותו ישירות דרך ספריית סנטנס טרנספורמרס בקוד פייתון רגיל. הקבצים שוקלים 735 מגה בייט ורצים בדיוק חצי צף, כך שכל מעבד ביתי מודרני מריץ אותו בלי שום צורך במאיץ גרפי ייעודי.

במשקל כזה אין שום היגיון לשלם על קריאות רשת חיצוניות או להתעסק בניהול מפתחות שירות. כל עוד מדובר בטקסט אנגלי, עדיף להריץ אותו ישירות בתהליך המקומי של השרת שלכם.

ollama run hf.co/mixedbread-ai/mxbai-embed-xsmall-v1:Q8_0

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הקוד והמשקולות מופצים תחת רישיון אפאצ'י שתיים אפס. מותר להשתמש בו באופן חופשי לחלוטין בפרויקטים מסחריים או פנימיים, לשנות את הקבצים ולהפיץ אותם בתוך המוצר, כל עוד שומרים על הודעת זכויות היוצרים המקורית.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗