GPT
L

Llama3-Chinese-8B-Instruct

קוד פתוח

FlagAlphaרישיון לא דווח2024-04-23

  • transformers
  • safetensors
  • llama
  • text-generation
  • llama3

גרסה מכווננת של לאמה 3 שמיועדת ספציפית לשיחה בסינית. אם אתם בונים שירות לשוק הסיני ורוצים שליטה מקומית בקוד פתוח, זה כיוון ששווה לבדוק.

  • 8,192טוקנים בהקשר
  • 15.0 GBמשקל הקבצים
  • 16,835הורדות בחודש
  • 79לייקים

מה זה

מדובר בהתאמה של המודל הבסיסי בגודל שמונה מיליארד פרמטרים, שפותחה בשיתוף פעולה בין קהילת לאמה הסינית לבין חברת AtomEcho. המטרה המרכזית כאן היא שיפור ביצועי הדיאלוג והבנת השפה הסינית, תחום שבו מודלים מערביים מקוריים לפעמים מתקשים או מייצרים טקסט מגושם.

הכרטיס לא מציג טבלאות ביצועים מספריות או השוואות למבחנים סטנדרטיים, כך שקשה לדעת במדויק במה הוא עוקף כוונונים אחרים בלי להריץ בעצמכם. עם זאת, הוא נשען ישירות על התשתית המוכרת של ספריית transformers, מה שהופך את השילוב שלו לצפוי ונוח בלי צורך בהתאמות קוד מיוחדות.

מתאים ל

  • בוט שירות בסינית

    מענה לפניות של משתמשים דוברי סינית על בסיס ארכיטקטורה יציבה שתוכננה לשיחה.

  • תרגום וניסוח מחדש

    התאמת תוכן באנגלית לסגנון טבעי ושוטף בסינית במערכות פנימיות.

  • עיבוד טקסטים בשוק האסייתי

    סיווג ותמצות מסמכים מקומיים כשצריך להריץ את הכל על שרתים פרטיים.

איפה זה נופל

בכרטיס המודל אין פירוט של ממש לגבי מגבלות ספציפיות, הטיות, או ביצועים בשפות אחרות. אל תבנו עליו למשימות בעברית, סביר מאוד שהיא נפגעה או שהיא חלשה בהרבה מסינית ומאנגלית. בנוסף, בהיעדר מבחני ביצועים מתועדים בדף, אתם צריכים לבדוק בעצמכם הזיות ודיוק עובדתי לפני שאתם סומכים עליו מול לקוחות אמיתיים.

שאלות
נפוצות

האם המודל הזה מתאים לפרויקטים בעברית?

לא. המיקוד כאן הוא שיחה בסינית על בסיס לאמה 3, ולא נעשתה כאן שום עבודה ייעודית לעברית. אם אתם צריכים עברית, עדיף לחפש התאמות מקומיות או להישאר עם מודל הבסיס הרשמי.

האם אפשר להשתמש בו ישירות באפליקציה מסחרית?

לא מומלץ כרגע, פשוט כי אין רישיון רשמי בדף המודל. מבחינה משפטית זה שטח אפור ומסוכן, ועדיף לבדוק מול המפתחים במאגר הגיטהאב שלהם מה התנאים לפני שמשלבים אותו בקוד של חברה.

איך מריצים

כדי להריץ אותו כמו שהוא בדיוק של float16, תצטרכו כרטיס מסך עם לפחות 16 עד 20 גיגה בייט זיכרון גרפי, בהתחשב בעובדה שמשקל המשקולות לבד מגיע ל־15 גיגה בייט. ההרצה נעשית ישירות דרך פייפליין סטנדרטי של יצירת טקסט בפייתון עם תבנית הצ'אט המובנית של המודל.

אם אתם לא מחזיקים בחומרה מתאימה מקומית, עדיף להרים שרת ייעודי בענן או לקחת מודל שמציע גישה ישירה בממשק חיצוני, אחרת ההרצה תזחל על מעבד רגיל.

from transformers import pipeline

pipe = pipeline("text-generation", model="FlagAlpha/Llama3-Chinese-8B-Instruct")
print(pipe("שלום"))

הרישיון

היוצרים לא דיווחו על רישיון בדף המודל. במצב כזה אין אישור מפורש לשימוש מסחרי, ואי אפשר לדעת אם מותר לשלב אותו במוצר בלי להסתכן משפטית. עד שהם יגדירו רישיון ברור, הוא מתאים בעיקר לבדיקות ולמחקר פנימי.

הרישיון המלא בעמוד המודל ↗