GPT
S

sarvam-1-v0.5

קוד פתוח

sarvamaiother2024-08-13

  • transformers
  • safetensors
  • llama
  • text-generation
  • conversational

מודל קטן של 2.5 מיליארד פרמטרים שנבנה במיוחד לעבודה בעשר שפות הודיות ובאנגלית. הוא פותר את בעיית הניפוח בטוקניזציה שיש במודלים מערביים על שפות תת-היבשת.

  • 2.5Bפרמטרים
  • 8,192טוקנים בהקשר
  • 4.7 GBמשקל הקבצים
  • 1,472הורדות בחודש

מה זה

מדובר בצ'קפוינט מוקדם שאומן מאפס על שני טריליון טוקנים, מתוך כוונה להגיע לארבעה טריליון בגרסה המלאה. המודל מתמקד באנגלית ובעשר שפות הודיות כמו הינדי, בנגלית וטמילית, ואינו כולל שום ידע בעברית.

היתרון המרכזי כאן הוא הטוקנייזר. במודלים כמו לאמה 3.1 או ג'מה 2, מילה בשפה הודית מתפרקת למספר עצום של חתיכות, עם מדד פיצול ממוצע של מעל 9 או 4 בהתאמה. כאן הממוצע עומד על 2.08 בלבד, טוב יותר אפילו מ־GPT-4o. זה אומר ריצה מהירה בהרבה ופחות חנק של חלון ההקשר כשעובדים בשפות האלה.

מתאים ל

  • מחקר טוקניזציה הודית

    ניתוח יעילות חלוקת הטוקנים בשפות הודיות מול ארכיטקטורות של מודלים גדולים.

  • אימון מודל מותאם אישית

    נקודת התחלה לאימון מונחה על טקסטים בשפות כמו הינדי או טמילית על חומרה קלה.

  • השלמת טקסט בהינדי

    משימות המשך משפטים פשוטות בתקציב מחשוב נמוך מאוד ובמהירות גבוהה.

איפה זה נופל

זהו צ'קפוינט בסיסי בלבד שלא עבר שום שלב של אימון המשך, התאמה להוראות או כוונון עדין. הוא לא יודע לענות לצ'אט אלא רק להשלים טקסט באופן גולמי. בנוסף, המודל אומן על מחצית מכמות הנתונים המתוכננת, והיוצרים עצמם מפנים לגרסה המלאה והסופית שכבר זמינה. אם אתם מחפשים מודל שמבין עברית, אין לו שום תמיכה בשפה הזו.

אותה משפחה

sarvam-1 יצא ב־2 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם המודל הזה תומך בעברית?

לא. הוא אומן מאפס במפורש רק על עשר שפות הודיות ועל אנגלית. ניסיון להזין לו עברית ייתקל בטוקנייזר לא מותאם ובחוסר יכולת לייצר פלט הגיוני.

למה להעדיף את הגרסה הזו ולא את sarvam-1 המלאה?

אין סיבה מעשית כזו, אלא אם כן אתם חוקרים שרוצים להשוות ביצועים של שלב אימון מוקדם מול מודל שלם. הגרסה המלאה אומנה על כפול טוקנים וזמינה להורדה.

איך מריצים

המשקל הכולל של הקבצים הוא 4.7 גיגה-בייט בפורמט bfloat16, כך שכרטיס מסך בסיסי עם 8 או 12 גיגה זיכרון יריץ אותו בקלות מקומית דרך ספריית transformers הרגילה של פייתון. אפשר אפילו להתנסות בו במחברת קולאב פשוטה.

למרות זאת, מכיוון שזו גרסת ביניים מוקדמת ויש כבר גרסה מאומנת ומלאה בשם sarvam-1, אין היגיון טכני להרים בשבילו שרת ייעודי לעבודה שוטפת. אם המטרה היא בדיקת ארכיטקטורה או מחקר על הטוקנייזר ספציפית, הריצה המקומית סבירה.

from transformers import pipeline

pipe = pipeline("text-generation", model="sarvamai/sarvam-1-v0.5")
print(pipe("שלום"))

הרישיון

הרישיון מוגדר כ־other ללא פירוט ברור בעמוד. מצב כזה אומר שאסור להניח שמותר להשתמש בו במוצר מסחרי, וחובה לבדוק את תנאי השימוש המדויקים מול המפתחים לפני שמשלבים אותו בקוד פנימי.

הרישיון המלא בעמוד המודל ↗