GPT
A

Xenova/all-MiniLM-L6-v2

קוד פתוח

Xenovaapache-2.02023-05-02

  • transformers.js
  • onnx
  • bert
  • feature-extraction

גרסת ווב קלה למודל שיודע לייצר וקטורים ישירות בתוך דפדפן או סביבת נוד. מתאים למי שרוצה חיפוש סמנטי מקומי בג'אווהסקריפט בלי לשלם על שרת ייעודי.

  • 512טוקנים בהקשר
  • 328 MBמשקל הקבצים
  • 2,703,488הורדות בחודש
  • 144לייקים

מה זה

מדובר בהמרה של מודל הטמעות המילים הוותיק למשקלי ONNX, שמיועדת לעבודה עם הספרייה transformers.js. המודל מחזיר וקטורים באורך של 384 ערכים מתוך טקסטים קצרים, ומשמש בעיקר למשימות חילוץ מאפיינים, סיווג, או השוואת דמיון בין משפטים. מכיוון שהוא מבוסס על שש שכבות בלבד, הוא בנוי לרוץ מהר ובמשקל נמוך בהרבה מרובי מודלי השפה הגדולים.

הייחוד כאן הוא הנגישות לצד לקוח. במקום להחזיק תשתית פייתון מורכבת רק כדי להוציא אמבדינגס, אפשר לטעון אותו ישירות בקוד ג'אווהסקריפט רגיל. זה פותר את התלות בשרתים חיצוניים עבור שאילתות חיפוש פשוטות, כל עוד מדובר בטקסטים קצרים יחסית שעומדים במגבלות המבנה שלו.

מתאים ל

  • חיפוש סמנטי בדפדפן

    מאפשר לבצע התאמת טקסטים מהירה ישירות בממשק המשתמש בלי תלות ברשת.

  • עיבוד נתונים בנוד

    מתאים לשרתי ג'אווהסקריפט קלים שצריכים וקטורים של משפטים בלי להקים סביבת פייתון.

  • קיבוץ תגיות ומשפטים

    מייצר ייצוג מספרי להשוואת דמיון בין משפטים קצרים לצורך מיון מהיר.

איפה זה נופל

הקלט מוגבל ל־512 טוקנים, ולכן הוא לא מתאים למסמכים ארוכים, פסקאות מורכבות או מאמרים שלמים בלי לחתוך אותם מראש. בנוסף, מדובר במודל קטן עם שש שכבות בלבד, כך שההבנה שלו לדקויות סמנטיות מורכבות פחות עמוקה ממודלים כבדים, ואין כאן התאמה ייעודית לשפות שאינן אנגלית על פי המפרט.

שאלות
נפוצות

האם המודל דורש כרטיס מסך מיוחד כדי לעבוד טוב?

לא. מדובר במודל של שש שכבות במשקל 328 מגהבייט שנבנה במיוחד לרוץ בסביבות קלות, והוא פועל במהירות סבירה על מעבד רגיל לחלוטין.

אפשר להזין לו מסמכים שלמים לחיפוש?

לא מומלץ. חלון ההקשר עומד על 512 טוקנים בלבד, כך שכל טקסט מעבר לזה ייחתך או יאבד משמעות, ועדיף להשתמש בו למשפטים בודדים או לפסקאות קצרות.

איך מריצים

מתקינים את ספריית transformers דרך npm, טוענים pipeline של חילוץ מאפיינים, ומעבירים מערך מחרוזות לקבלת טנזור מנורמל. הקבצים שוקלים 328 מגהבייט בסך הכול, כך שאין שום צורך בכרטיס מסך חיצוני או חומרה כבדה, והוא עובד היטב על מעבד רגיל של מחשב אישי או שרת בסיסי.

אם אתם רצים בצד לקוח במכשיר נייד עם חיבור רשת חלש, הורדה של מאות מגהבייט בפעם הראשונה עלולה להיות כבדה למשתמשים. במצב כזה, או כשרוצים לחסוך זיכרון בדפדפן, עדיף להריץ שרת מרוחק או לקרוא לנקודת קצה חיצונית במקום להכריח את הדפדפן לעבד לבד.

pip install -U huggingface_hub
hf download Xenova/all-MiniLM-L6-v2

הרישיון

רישיון apache-2.0 מאפשר שימוש מסחרי חופשי, הפצה, שינוי ושילוב במוצרים סגורים. התנאי היחיד הוא שמירה על הודעת זכויות היוצרים והרישיון המקורי בקבצים. אפשר להטמיע אותו במוצר בלי לשלם תמלוגים ובלי לפתוח את הקוד שלכם.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗