GPT
L

Llama-3-Taiwan-8B-Instruct

קוד פתוח

yentinglinllama32024-06-04

  • transformers
  • safetensors
  • llama
  • text-generation
  • zhtw

גרסה מכווננת של לאמה 3 שממוקדת במנדרינית מסורתית לצד אנגלית. המודל פונה למי שמחפש משקל קל של שמונה מיליארד פרמטרים עם ביצועים מדויקים לתוכן טייוואני.

  • 8Bפרמטרים
  • 8,192טוקנים בהקשר
  • 15.0 GBמשקל הקבצים
  • 78,661הורדות בחודש

מה זה

מדובר בהתאמה של המודל הפתוח של מטא, שעברה אימון נוסף על טקסטים במנדרינית מסורתית ובאנגלית מתחומי המשפט, הרפואה, התעשייה והאלקטרוניקה. המטרה כאן היא לתת מענה לשפה ולתרבות המקומית בטייוואן, תחום שבו מודלים כלליים נוטים להציג שגיאות או להשתמש במינוח מסין היבשתית.

במדד הידע הכללי TMLU המודל מגיע לציון של 59.50%, ובמבחן ההקשר המקומי Taiwan Truthful QA הוא מקבל 61.11%. ההשוואה מול דגם הבסיס המקורי של שמונה מיליארד פרמטרים מראה קפיצה ברורה, כשהמקורי נעצר ב־46.83% במבחן האמינות המקומי. הוא עוקף בקלות כלים בגודל דומה במשימות האלה, אך עדיין נשאר הרחק מאחורי גרסת השבעים מיליארד של אותה סדרה.

מתאים ל

  • בוט שיחה במנדרינית מסורתית

    התאמה טובה לניסוחים מקומיים בטייוואן עם תוצאה של 7.21 במבחן השיחה הרב שלבית TW MT-Bench.

  • חילוץ מידע וקריאות פונקציה

    הכרטיס מדגים תמיכה מלאה בהחזרת מבני נתונים ומיפוי ישויות לצד הפעלת פונקציות מוגדרות.

  • מערכות RAG מבוססות מסמכים

    מתאים לשליפה ותשובות על מאגרי ידע עסקיים המנוסחים במנדרינית מסורתית ובאנגלית.

איפה זה נופל

היוצרים מבהירים במפורש שהתוצר אינו מיועד ליישומים בסיכון גבוה, כולל ייעוץ רפואי, משפטי או פיננסי. למרות האימון על מסמכים משפטיים, במבחן המשפט הטייוואני המודל השיג 53.11% בלבד, תוצאה שמחייבת בדיקה זהירה ואוסרת הסתמכות אוטומטית. מעבר לכך, אין פה פתרון למשימות בעברית, שכן האימון התמקד כולו בשילוב בין אנגלית למנדרינית.

אותה משפחה

Llama-3-Taiwan יצא ב־2 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם המודל הזה מתאים לעבודה בעברית?

לא. המודל אומן והותאם באופן מובהק למנדרינית מסורתית ולאנגלית בלבד. אין לו תמיכה או ביצועים שנבדקו בעברית.

מה ההבדל בינו לבין גרסת ה־70B של אותו פרויקט?

גרסת ה־70B חזקה משמעותית בכל המבחנים, למשל 74.76% ב־TMLU לעומת 59.50% בדגם הזה. מצד שני, דגם ה־8B שוקל רק 15 גיגה בייט ודורש הרבה פחות משאבי מחשוב.

האם אפשר להריץ אותו ישירות עם ספריות סטנדרטיות?

כן, המודל נתמך ישירות דרך ספריית transformers ומתאים גם לפריסה דרך vLLM. חשוב להקפיד על הוספת system message בכל פנייה, כפי שמציינים היוצרים.

איך מריצים

המשקל הכולל של הקבצים עומד על 15.0 גיגה בייט בפורמט bfloat16, כך שהרצה מקומית מלאה מחייבת כרטיס גרפי עם זיכרון ייעודי מתאים לנפח הזה. מי שאין לו חומרה מתאימה יצטרך לפנות לשרת מרוחק, שירות ענן או קריאות API. הספריות הנתמכות להרצה הן transformers וסביבות כמו vLLM, ויש הגדרה קריטית אחת שהמפתחים מדגישים בכרטיס: חובה להגדיר תמיד הודעת מערכת (system message) כדי שהשיחה תעבוד בצורה תקינה.

from transformers import pipeline

pipe = pipeline("text-generation", model="yentinglin/Llama-3-Taiwan-8B-Instruct")
print(pipe("שלום"))

הרישיון

הרישיון הוא רישיון לאמה 3 של מטא. הוא מאפשר שימוש מסחרי ומחקר, אך כפוף למדיניות השימוש המקובלת וההגבלות של מטא, כולל תנאי שימוש ייעודיים ברף משתמשים חודשי גבוה מאוד.

  • שימוש מסחרי עד 700 מיליון משתמשים
  • שינוי הקוד
  • חובת ייחוס

הרישיון המלא בעמוד המודל ↗