GPT
G

gme-Qwen2-VL-7B-Instruct

קוד פתוח

Alibaba-NLPapache-2.02024-12-21

  • sentence-transformers
  • safetensors
  • qwen2_vl
  • image-text-to-text
  • mteb

מודל שיודע לייצר וקטורים להשוואת טקסט ותמונות על בסיס ארכיטקטורה של שמונה מיליארד פרמטרים. מתאים למי שבונה חיפוש סמנטי משולב וזקוק לדיוק גבוה באנגלית ובסינית.

  • 8.3Bפרמטרים
  • 32,768טוקנים בהקשר
  • 30.9 GBמשקל הקבצים
  • 2,809הורדות בחודש

מה זה

מדובר במודל שמפיק ייצוגים וקטוריים מורכבים להשוואת דמיון, סיווג וחיפוש מידע, כשהבסיס שלו הוא מודל הראייה והשפה של עליבאבא. הוא פועל באמצעות עשרים ושמונה שכבות ומביא חלון הקשר עמוק במיוחד של 32,768 טוקנים, מה שמאפשר להזין לו מסמכים שלמים או קלטים ארוכים מבלי לקטוע אותם.

במבחני הביצועים של MTEB רואים תוצאות חזקות מאוד בסיווג רגש עם ציון דיוק של 97.32, ובמשימות דירוג מחדש בסינית הוא חוצה את קו ה־90 נקודות. עם זאת, במשימות אחזור מורכבות בעולם הטכני כמו Mathematica או הפורומים של CQADupstack, דיוק התוצאה הראשונה יורד לכיוון ה־17 עד 21 נקודות בלבד, כך שהשליפה הראשונית אינה חסינה מטעויות.

מתאים ל

  • חיפוש סמנטי במסמכים ארוכים

    חלון של 32 אלף טוקנים מאפשר להמיר קבצים שלמים לווקטור אחד ללא צורך בפיצול אגרסיבי.

  • דירוג מחדש למערכות באנגלית

    המודל מציג ציוני דיוק גבוהים במיוחד במיון מחדש של תוצאות חיפוש באנגלית ובסינית.

  • סיווג טקסטים וביקורות

    בדיקות הראו מעל 97 אחוזי דיוק בסיווג קוטביות וסנטימנט בקטלוגים מסחריים.

איפה זה נופל

המודל מוגדר רשמית לאנגלית ולסינית בלבד, ואין שום נתונים על תמיכה בעברית. שימוש בו לקלטים מקומיים צפוי להיכשל או להניב תוצאות ירודות. בנוסף, קובצי המשקל כבדים מאוד ודורשים עיבוד משמעותי לכל בקשה בודדת, דבר שיוצר צוואר בקבוק בזמני תגובה ביחס למודלי וקטורים קלים וקלאסיים.

אותה משפחה

gme-Qwen2-VL יצא ב־2 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם המודל יתאים לחיפוש טקסטואלי בעברית?

הוא הוכשר ותועד לאנגלית ולסינית בלבד. כל שימוש בעברית ייעשה על אחריותכם וללא תמיכה מובטחת בארכיטקטורה.

האם חייבים מאיץ גרפי חזק בשביל להשתמש בו?

כן, הקבצים שוקלים מעל 30 גיגה בייט ומכילים 8.3 מיליארד פרמטרים. ללא כרטיס עם זיכרון ייעודי גדול, לא תוכלו להרים אותו בזמני תגובה סבירים.

איך מריצים

המשקל הכולל של הקבצים מגיע ל־30.9 גיגה בייט בדיוק float32, כך שאי אפשר להריץ אותו על חומרה ביתית פשוטה. כדי לטעון אותו לזיכרון נקי בשרת תצטרכו כרטיס גרפי ייעודי של 32 גיגה בייט לפחות, ועדיף להמיר אותו מראש לחצי דיוק כדי לא לחנוק את החומרה.

ההרצה מתבצעת ישירות מתוך ספריית sentence-transformers המוכרת. אם אין לכם תשתית ענן עם מאיץ מתאים או שאתם מחפשים רק פיילוט מהיר, עדיף לפנות ל־API מנוהל שחוסך את הניהול והתשלום השוטף על שרת כבד כזה.

from sentence_transformers import SentenceTransformer

m = SentenceTransformer("Alibaba-NLP/gme-Qwen2-VL-7B-Instruct")
v = m.encode(["שלום עולם"])

הרישיון

רישיון apache-2.0 מתיר שימוש חופשי לגמרי, כולל פיתוח מסחרי והטמעה בתוך מוצרים למכירה. מותר לשנות את הקוד ולהפיץ אותו, בתנאי ששומרים על הודעת זכויות היוצרים המקורית.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗