GPT
L

Llama-3-Open-Ko-8B

קוד פתוח

beomiother2024-04-22

  • transformers
  • safetensors
  • llama
  • text-generation
  • facebook

התאמה קוריאנית של לאמה 3 שממשיכה אימון מקדים על עשרות גיגהבייט טקסט. המטרה כאן היא בסיס טבעי לקוריאנית שמתאים להמשך כוונון.

  • 8Bפרמטרים
  • 8,192טוקנים בהקשר
  • 15.0 GBמשקל הקבצים
  • 2,672הורדות בחודש

מה זה

המודל הזה לוקח את משקלי הבסיס של מטא ומעביר אותם אימון המשך על יותר משישים גיגהבייט של טקסטים בקוריאנית, בהיקף של 17.7 מיליארד טוקנים. הוא שומר על הארכיטקטורה המקורית של שמונה מיליארד פרמטרים, אבל הטוקנייזר והייצוג הפנימי מכוונים לעבודה חלקה יותר בשפה הזו לצד אנגלית.

במבחני ביצועים בקוריאנית הוא מציג תמונה מעורבת. במשימות כמו ניתוח סנטימנט בקו־בסט הוא מגיע לדיוק של מעל תשעים וחמישה אחוזים, אבל במבחני ידע מורכבים כמו קיי־אמ־אמ־אל־יו הוא עומד על ארבעים אחוז התאמה בלבד. זה אומר שהוא מבין את השפה ברמת התחביר וההקשר הבסיסי, אך אינו מחזיק בידע עמוק במקצועות מורכבים.

מתאים ל

  • בסיס לכוונון בקוריאנית

    נקודת מוצא מעולה לאימון מודל שיחה ייעודי שמיועד לשוק הקוריאני.

  • סיווג טקסטים בקוריאנית

    משיג תוצאות חזקות בזיהוי סנטימנט והבנת משפטים בשפה.

  • השלמת טקסט טכני

    מתאים למשימות ג'נרוציה שמשלבות אנגלית ומחשבים יחד עם קוריאנית.

איפה זה נופל

זהו מודל בסיס להשלמת טקסט ולא מודל שיחה שעבר כוונון להוראות. אם תשאלו אותו שאלה ישירה בלי פורמט מתאים, תקבלו המשך טקסט חופשי ולא תשובה מסודרת. חיתוך הידע שלו עומד על יוני 2023, ובמבחני ידע מקומי בקוריאנית כמו היסטוריה או פטנטים הדיוק נמוך מאוד, סביב עשרים ושבעה אחוזים בלבד.

אותה משפחה

Llama-3-Open-Ko יצא ב־2 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם אפשר להשתמש בו ישירות כצ'אטבוט?

לא בלי עבודה נוספת. מדובר במודל ג'נרטיבי בסיסי שממשיך משפטים, וכדי לבנות ממנו עוזר צריך לבצע כוונון להוראות או להשתמש בגרסת התצוגה המקדימה שהוציא המפתח.

האם יש למודל תמיכה בעברית?

לא. המודל אומן והותאם ספציפית לאנגלית ולקוריאנית בלבד, וכל ניסיון לייצר איתו תוכן בעברית יפיק תוצאות גרועות או שבורות לחלוטין.

איך מריצים

במשקל של 15 גיגהבייט ובדיוק של חצי דיוק, תצטרכו כרטיס מסך אחד עם לפחות 16 עד 24 גיגהבייט זיכרון כדי להעלות אותו ישירות בספריית טרנספורמרס או וי־אל־אל־אם. אם תבצעו קוונטיזציה עצמאית, אפשר לדחוף אותו גם לחומרה ביתית צנועה יותר.

מי שרק בודק את השפה הקוריאנית ומחפש מודל שיחה מוכן, עדיף שיפנה לגרסאות ההוראות או למודלים מסחריים מבוססי שירות. המודל הזה דורש אירוח עצמי והרצה של תשתית מקומית.

from transformers import pipeline

pipe = pipeline("text-generation", model="beomi/Llama-3-Open-Ko-8B")
print(pipe("שלום"))

הרישיון

הפרויקט כפוף לרישיון הקהילתי של לאמה 3 מבית מטא. הרישיון מתיר שימוש מחקרי ומסחרי, בכפוף למגבלות מדיניות השימוש המקובל של מטא ורף משתמשים חודשי של החברה המקורית.

הרישיון המלא בעמוד המודל ↗